Aller au contenu principal
buildradar
Sign in
Sujet · data-cleaning

data-cleaning

Dépôts open source suivis étiquetés data-cleaning, triés par étoiles.

Dépôts
17
Total d'étoiles
59 402
Étoiles en moyenne
3 494
Part
0,00%

Sujets qui apparaissent souvent aux côtés de data-cleaning sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés data-cleaning.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • cleanlab@cleanlab

    La bibliothèque open source de Cleanlab est le package d'IA centré sur les données standard pour la qualité des données et l'apprentissage automatique avec des données et des étiquettes réelles et imparfaites.

    11 638-2Évolution des étoiles sur les 7 derniers jours
  • fiftyone@voxel51

    Affinez des jeux de données de haute qualité et des modèles d'IA visuelle.

    11 054+7Évolution des étoiles sur les 7 derniers jours
  • miller@johnkerl

    Miller est l'équivalent de awk, sed, cut, join et sort pour les données indexées par nom telles que CSV, TSV et JSON tabulaire.

    10 008+3Évolution des étoiles sur les 7 derniers jours
  • DataFlow@OpenDCAI

    Préparation de données simplifiée grâce aux derniers opérateurs et pipelines basés sur les LLM.

    7 893+68Évolution des étoiles sur les 7 derniers jours
  • pandera@unionai-oss

    Une bibliothèque de test de données statistiques légère, flexible et expressive.

    4 447+4Évolution des étoiles sur les 7 derniers jours
  • pandas-videos@justmarkham

    Notebooks Jupyter et jeux de données issus de la série de vidéos sur pandas

    2 250-1Évolution des étoiles sur les 7 derniers jours
  • skrub@skrub-data

    Apprentissage automatique avec des dataframes.

    1 651+0Évolution des étoiles sur les 7 derniers jours
  • DAT8@justmarkham

    Cours de science des données 2015 de General Assembly à Washington, DC

    1 620+0Évolution des étoiles sur les 7 derniers jours
  • optimus@hi-primus

    Flux de travail de préparation de données agiles simplifiés avec Pandas, Dask, cuDF, Dask-cuDF, Vaex et PySpark

    1 536+0Évolution des étoiles sur les 7 derniers jours
  • janitor@sfirke

    Outils simples pour le nettoyage de données en R

    1 456+1Évolution des étoiles sur les 7 derniers jours
  • data-forge-ts@data-forge

    La boîte à outils de transformation et d'analyse de données JavaScript inspirée par Pandas et LINQ.

    1 392+0Évolution des étoiles sur les 7 derniers jours
  • EduChat@ECNU-ICALK

    Modèle de dialogue éducatif open source de l'ICALK, East China Normal University. Modèle de base général, déploiement GPU, nettoyage de données. Hommage à : LLaMA, MOSS, BELLE, Ziya, vLLM

    968+1Évolution des étoiles sur les 7 derniers jours
  • Un guide complet pour construire un entrepôt de données moderne avec SQL Server, incluant les processus ETL, la modélisation des données et l'analyse.

    932+14Évolution des étoiles sur les 7 derniers jours
  • Système ML de qualité production pour la détection automatique des erreurs d'unité de mesure | Précision 88-92% | Autonomie 94% | Workflow KNIME.

    817+0Évolution des étoiles sur les 7 derniers jours
  • awesome-data-agents@HKUSTDial

    Liste de publications mise à jour en continu sur les avancées des agents de données. Dépôt associé à notre article "A Survey of Data Agents: Emerging Paradigm or Overstated Hype?"

    733+10Évolution des étoiles sur les 7 derniers jours
  • klib@akanz1

    Bibliothèque Python simple d'utilisation proposant des fonctions personnalisées pour le nettoyage et l'analyse de données.

    523+1Évolution des étoiles sur les 7 derniers jours
  • schema-inspector@schema-inspector

    Schema-Inspector est un module JavaScript simple de nettoyage et de validation d'objets.

    503+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets