Saltar al contenido principal
buildradar
Sign in
Tema · data-cleaning

data-cleaning

Repositorios de código abierto monitorizados etiquetados con data-cleaning, ordenados por estrellas.

Repositorios
17
Estrellas totales
59.402
Estrellas de media
3494
Proporción
0,00%

Temas que aparecen con frecuencia junto a data-cleaning en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con data-cleaning.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • cleanlab@cleanlab

    La librería de código abierto de Cleanlab es el paquete estándar de IA centrada en datos para la calidad de datos y el aprendizaje automático con datos y etiquetas del mundo real desordenados.

    11.638-2Variación de estrellas de los últimos 7 días
  • fiftyone@voxel51

    Refina conjuntos de datos de alta calidad y modelos de IA visual

    11.054+7Variación de estrellas de los últimos 7 días
  • miller@johnkerl

    Miller es como awk, sed, cut, join y sort para datos indexados por nombre como CSV, TSV y JSON tabular

    10.008+3Variación de estrellas de los últimos 7 días
  • DataFlow@OpenDCAI

    Preparación de datos sencilla con los últimos operadores y pipelines basados en LLMs

    7893+68Variación de estrellas de los últimos 7 días
  • pandera@unionai-oss

    Una biblioteca de pruebas de datos estadísticos ligera, flexible y expresiva

    4447+4Variación de estrellas de los últimos 7 días
  • pandas-videos@justmarkham

    Notebooks de Jupyter y conjuntos de datos de la serie de videos de pandas.

    2250-1Variación de estrellas de los últimos 7 días
  • skrub@skrub-data

    Machine learning con dataframes.

    1651+0Variación de estrellas de los últimos 7 días
  • DAT8@justmarkham

    Curso de ciencia de datos de 2015 de General Assembly en Washington, DC.

    1620+0Variación de estrellas de los últimos 7 días
  • optimus@hi-primus

    :truck: Flujos de trabajo de preparación de datos ágiles facilitados con Pandas, Dask, cuDF, Dask-cuDF, Vaex y PySpark

    1536+0Variación de estrellas de los últimos 7 días
  • janitor@sfirke

    Herramientas sencillas para la limpieza de datos en R.

    1456+1Variación de estrellas de los últimos 7 días
  • data-forge-ts@data-forge

    Kit de herramientas de transformación y análisis de datos en JavaScript inspirado en Pandas y LINQ.

    1392+0Variación de estrellas de los últimos 7 días
  • EduChat@ECNU-ICALK

    Un modelo de chat educativo de código abierto de ICALK, East China Normal University. Modelo base general, despliegue en GPU, limpieza de datos. Homenaje a: LLaMA, MOSS, BELLE, Ziya, vLLM

    968+1Variación de estrellas de los últimos 7 días
  • Una guía completa para construir un almacén de datos moderno con SQL Server, incluyendo procesos ETL, modelado de datos y análisis.

    934+14Variación de estrellas de los últimos 7 días
  • Sistema de ML de grado de producción para la detección automática de errores en unidades de medida | 88-92% de precisión | 94% de autonomía | Flujo de trabajo en KNIME.

    817+0Variación de estrellas de los últimos 7 días
  • awesome-data-agents@HKUSTDial

    Lista de artículos actualizada continuamente sobre avances en Agentes de Datos. Repositorio complementario a nuestro artículo "Una encuesta sobre Agentes de Datos: ¿Paradigma emergente o exageración excesiva?"

    733+10Variación de estrellas de los últimos 7 días
  • klib@akanz1

    Biblioteca de Python fácil de usar con funciones personalizadas para limpiar y analizar datos.

    523+1Variación de estrellas de los últimos 7 días
  • schema-inspector@schema-inspector

    Schema-Inspector es un módulo simple de saneamiento y validación de objetos JavaScript.

    503+0Variación de estrellas de los últimos 7 días
← Volver a temas