Pular para o conteúdo principal
buildradar
Sign in
Tópico · data-cleaning

data-cleaning

Repositórios de código aberto acompanhados marcados com data-cleaning, ordenados por estrelas.

Repositórios
17
Total de estrelas
59.402
Média de estrelas
3.494
Participação
0,00%

Tópicos que aparecem com frequência ao lado de data-cleaning no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com data-cleaning.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • cleanlab@cleanlab

    A biblioteca de código aberto da Cleanlab é o pacote de IA centrado em dados padrão para qualidade de dados e aprendizado de máquina com dados e rótulos reais e desordenados.

    11.638-2Variação de estrelas nos últimos 7 dias
  • fiftyone@voxel51

    Refine conjuntos de dados de alta qualidade e modelos de IA visual

    11.054+7Variação de estrelas nos últimos 7 dias
  • miller@johnkerl

    Miller é como awk, sed, cut, join e sort para dados indexados por nome, como CSV, TSV e JSON tabular

    10.008+3Variação de estrelas nos últimos 7 dias
  • DataFlow@OpenDCAI

    Preparação de dados fácil com operadores e pipelines baseados nos LLMs mais recentes.

    7.893+68Variação de estrelas nos últimos 7 dias
  • pandera@unionai-oss

    Uma biblioteca de teste de dados estatísticos leve, flexível e expressiva

    4.447+4Variação de estrelas nos últimos 7 dias
  • pandas-videos@justmarkham

    Jupyter notebooks e conjuntos de dados da série de vídeos sobre pandas.

    2.250-1Variação de estrelas nos últimos 7 dias
  • skrub@skrub-data

    Aprendizado de máquina com dataframes

    1.651+0Variação de estrelas nos últimos 7 dias
  • DAT8@justmarkham

    Curso de Ciência de Dados de 2015 da General Assembly em Washington, DC.

    1.620+0Variação de estrelas nos últimos 7 dias
  • optimus@hi-primus

    Fluxos de trabalho de preparação de dados ágeis facilitados com Pandas, Dask, cuDF, Dask-cuDF, Vaex e PySpark

    1.536+0Variação de estrelas nos últimos 7 dias
  • janitor@sfirke

    Ferramentas simples para limpeza de dados em R

    1.456+1Variação de estrelas nos últimos 7 dias
  • data-forge-ts@data-forge

    Kit de ferramentas de transformação e análise de dados em JavaScript inspirado em Pandas e LINQ.

    1.392+0Variação de estrelas nos últimos 7 dias
  • EduChat@ECNU-ICALK

    Um modelo de chat educacional de código aberto do ICALK, East China Normal University. Modelo de base geral, implantação em GPU, limpeza de dados. Homenagem a: LLaMA, MOSS, BELLE, Ziya, vLLM

    968+1Variação de estrelas nos últimos 7 dias
  • Um guia abrangente para construir um data warehouse moderno com SQL Server, incluindo processos de ETL, modelagem de dados e análises.

    932+14Variação de estrelas nos últimos 7 dias
  • Sistema de ML de nível de produção para detecção automatizada de erros de unidade de medida | Precisão de 88-92% | Autonomia de 94% | Fluxo de trabalho KNIME

    817+0Variação de estrelas nos últimos 7 dias
  • awesome-data-agents@HKUSTDial

    Lista de artigos atualizada continuamente sobre avanços em Data Agents. Repositório complementar ao nosso artigo "A Survey of Data Agents: Emerging Paradigm or Overstated Hype?"

    730+10Variação de estrelas nos últimos 7 dias
  • klib@akanz1

    Biblioteca Python fácil de usar com funções personalizadas para limpeza e análise de dados.

    523+1Variação de estrelas nos últimos 7 dias
  • schema-inspector@schema-inspector

    Schema-Inspector é um módulo simples de validação e higienização de objetos JavaScript.

    503+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos