data-cleaning
Dépôts open source suivis étiquetés data-cleaning, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de data-cleaning sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés data-cleaning.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
La bibliothèque open source de Cleanlab est le package d'IA centré sur les données standard pour la qualité des données et l'apprentissage automatique avec des données et des étiquettes réelles et imparfaites.
★ 11 638-2Évolution des étoiles sur les 7 derniers jours - #2★ 11 054+7Évolution des étoiles sur les 7 derniers jours
- #3
Miller est l'équivalent de awk, sed, cut, join et sort pour les données indexées par nom telles que CSV, TSV et JSON tabulaire.
★ 10 008+3Évolution des étoiles sur les 7 derniers jours - #4
Préparation de données simplifiée grâce aux derniers opérateurs et pipelines basés sur les LLM.
★ 7 893+68Évolution des étoiles sur les 7 derniers jours - #5
Une bibliothèque de test de données statistiques légère, flexible et expressive.
★ 4 447+4Évolution des étoiles sur les 7 derniers jours - #6
Notebooks Jupyter et jeux de données issus de la série de vidéos sur pandas
★ 2 250-1Évolution des étoiles sur les 7 derniers jours - #7★ 1 651+0Évolution des étoiles sur les 7 derniers jours
- #8★ 1 620+0Évolution des étoiles sur les 7 derniers jours
- #9
Flux de travail de préparation de données agiles simplifiés avec Pandas, Dask, cuDF, Dask-cuDF, Vaex et PySpark
★ 1 536+0Évolution des étoiles sur les 7 derniers jours - #10★ 1 456+1Évolution des étoiles sur les 7 derniers jours
- #11
La boîte à outils de transformation et d'analyse de données JavaScript inspirée par Pandas et LINQ.
★ 1 392+0Évolution des étoiles sur les 7 derniers jours - #12
Modèle de dialogue éducatif open source de l'ICALK, East China Normal University. Modèle de base général, déploiement GPU, nettoyage de données. Hommage à : LLaMA, MOSS, BELLE, Ziya, vLLM
★ 968+1Évolution des étoiles sur les 7 derniers jours - #13
Un guide complet pour construire un entrepôt de données moderne avec SQL Server, incluant les processus ETL, la modélisation des données et l'analyse.
★ 932+14Évolution des étoiles sur les 7 derniers jours - #14
Système ML de qualité production pour la détection automatique des erreurs d'unité de mesure | Précision 88-92% | Autonomie 94% | Workflow KNIME.
★ 817+0Évolution des étoiles sur les 7 derniers jours - #15
Liste de publications mise à jour en continu sur les avancées des agents de données. Dépôt associé à notre article "A Survey of Data Agents: Emerging Paradigm or Overstated Hype?"
★ 733+10Évolution des étoiles sur les 7 derniers jours - #16
Bibliothèque Python simple d'utilisation proposant des fonctions personnalisées pour le nettoyage et l'analyse de données.
★ 523+1Évolution des étoiles sur les 7 derniers jours - #17
Schema-Inspector est un module JavaScript simple de nettoyage et de validation d'objets.
★ 503+0Évolution des étoiles sur les 7 derniers jours