Scalable master data management and identity resolution
A Julia package for data clustering
Integrate multiple high-dimensional datasets with fuzzy k-means
Julia extension for Visual Studio Code
Apache IoTDB
All-in-one text de-duplication
World's first open source data quality & data preparation project
osDQ dedicated to create apache spark based data pipeline using JSON
Data quality analysis, profiling, cleansing, duplicate detection +more