data-cleaning
Repositórios de código aberto acompanhados marcados com data-cleaning, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de data-cleaning no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com data-cleaning.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
A biblioteca de código aberto da Cleanlab é o pacote de IA centrado em dados padrão para qualidade de dados e aprendizado de máquina com dados e rótulos reais e desordenados.
★ 11.638-2Variação de estrelas nos últimos 7 dias - #2★ 11.054+7Variação de estrelas nos últimos 7 dias
- #3
Miller é como awk, sed, cut, join e sort para dados indexados por nome, como CSV, TSV e JSON tabular
★ 10.008+3Variação de estrelas nos últimos 7 dias - #4
Preparação de dados fácil com operadores e pipelines baseados nos LLMs mais recentes.
★ 7.893+68Variação de estrelas nos últimos 7 dias - #5★ 4.447+4Variação de estrelas nos últimos 7 dias
- #6
Jupyter notebooks e conjuntos de dados da série de vídeos sobre pandas.
★ 2.250-1Variação de estrelas nos últimos 7 dias - #7★ 1.651+0Variação de estrelas nos últimos 7 dias
- #8★ 1.620+0Variação de estrelas nos últimos 7 dias
- #9
Fluxos de trabalho de preparação de dados ágeis facilitados com Pandas, Dask, cuDF, Dask-cuDF, Vaex e PySpark
★ 1.536+0Variação de estrelas nos últimos 7 dias - #10★ 1.456+1Variação de estrelas nos últimos 7 dias
- #11
Kit de ferramentas de transformação e análise de dados em JavaScript inspirado em Pandas e LINQ.
★ 1.392+0Variação de estrelas nos últimos 7 dias - #12
Um modelo de chat educacional de código aberto do ICALK, East China Normal University. Modelo de base geral, implantação em GPU, limpeza de dados. Homenagem a: LLaMA, MOSS, BELLE, Ziya, vLLM
★ 968+1Variação de estrelas nos últimos 7 dias - #13
Um guia abrangente para construir um data warehouse moderno com SQL Server, incluindo processos de ETL, modelagem de dados e análises.
★ 932+14Variação de estrelas nos últimos 7 dias - #14
Sistema de ML de nível de produção para detecção automatizada de erros de unidade de medida | Precisão de 88-92% | Autonomia de 94% | Fluxo de trabalho KNIME
★ 817+0Variação de estrelas nos últimos 7 dias - #15
Lista de artigos atualizada continuamente sobre avanços em Data Agents. Repositório complementar ao nosso artigo "A Survey of Data Agents: Emerging Paradigm or Overstated Hype?"
★ 730+10Variação de estrelas nos últimos 7 dias - #16
Biblioteca Python fácil de usar com funções personalizadas para limpeza e análise de dados.
★ 523+1Variação de estrelas nos últimos 7 dias - #17
Schema-Inspector é um módulo simples de validação e higienização de objetos JavaScript.
★ 503+0Variação de estrelas nos últimos 7 dias