data-cleaning
Repositorios de código abierto monitorizados etiquetados con data-cleaning, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a data-cleaning en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con data-cleaning.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
La librería de código abierto de Cleanlab es el paquete estándar de IA centrada en datos para la calidad de datos y el aprendizaje automático con datos y etiquetas del mundo real desordenados.
★ 11.638-2Variación de estrellas de los últimos 7 días - #2★ 11.054+7Variación de estrellas de los últimos 7 días
- #3
Miller es como awk, sed, cut, join y sort para datos indexados por nombre como CSV, TSV y JSON tabular
★ 10.008+3Variación de estrellas de los últimos 7 días - #4
Preparación de datos sencilla con los últimos operadores y pipelines basados en LLMs
★ 7893+68Variación de estrellas de los últimos 7 días - #5★ 4447+4Variación de estrellas de los últimos 7 días
- #6
Notebooks de Jupyter y conjuntos de datos de la serie de videos de pandas.
★ 2250-1Variación de estrellas de los últimos 7 días - #7★ 1651+0Variación de estrellas de los últimos 7 días
- #8★ 1620+0Variación de estrellas de los últimos 7 días
- #9
:truck: Flujos de trabajo de preparación de datos ágiles facilitados con Pandas, Dask, cuDF, Dask-cuDF, Vaex y PySpark
★ 1536+0Variación de estrellas de los últimos 7 días - #10★ 1456+1Variación de estrellas de los últimos 7 días
- #11
Kit de herramientas de transformación y análisis de datos en JavaScript inspirado en Pandas y LINQ.
★ 1392+0Variación de estrellas de los últimos 7 días - #12
Un modelo de chat educativo de código abierto de ICALK, East China Normal University. Modelo base general, despliegue en GPU, limpieza de datos. Homenaje a: LLaMA, MOSS, BELLE, Ziya, vLLM
★ 968+1Variación de estrellas de los últimos 7 días - #13
Una guía completa para construir un almacén de datos moderno con SQL Server, incluyendo procesos ETL, modelado de datos y análisis.
★ 934+14Variación de estrellas de los últimos 7 días - #14
Sistema de ML de grado de producción para la detección automática de errores en unidades de medida | 88-92% de precisión | 94% de autonomía | Flujo de trabajo en KNIME.
★ 817+0Variación de estrellas de los últimos 7 días - #15
Lista de artículos actualizada continuamente sobre avances en Agentes de Datos. Repositorio complementario a nuestro artículo "Una encuesta sobre Agentes de Datos: ¿Paradigma emergente o exageración excesiva?"
★ 733+10Variación de estrellas de los últimos 7 días - #16
Biblioteca de Python fácil de usar con funciones personalizadas para limpiar y analizar datos.
★ 523+1Variación de estrellas de los últimos 7 días - #17
Schema-Inspector es un módulo simple de saneamiento y validación de objetos JavaScript.
★ 503+0Variación de estrellas de los últimos 7 días