data-analysis
Repositórios de código aberto acompanhados marcados com data-analysis, ordenados por estrelas.
- #151
Framework orientado pela comunidade, simples, porém poderoso, para computação distribuída sobre dados de forma rápida e econômica.
★ 871+1Variação de estrelas nos últimos 7 dias - #152
🌀 O que realmente está no seu pacote de dados do Discord?
★ 854+0Variação de estrelas nos últimos 7 dias - #153★ 831+0Variação de estrelas nos últimos 7 dias
- #154★ 816+0Variação de estrelas nos últimos 7 dias
- #155
Engenharia de recursos (feature engineering) é o processo de usar conhecimento do domínio para extrair recursos de dados brutos por meio de técnicas de mineração de dados. Esses recursos podem ser usados para melhorar o desempenho de algoritmos de aprendizado de máquina. A engenharia de recursos pode ser considerada como o próprio aprendizado de máquina aplicado.
★ 806+0Variação de estrelas nos últimos 7 dias - #156
scikit-mobility: análise de mobilidade em Python
★ 806+0Variação de estrelas nos últimos 7 dias - #157
Uma biblioteca Python alimentada por Modelos de Linguagem (LLMs) para descoberta e análise de dados conversacionais.
★ 787+1Variação de estrelas nos últimos 7 dias - #158
Código e dados para a segunda edição de "Practical SQL" por Anthony DeBarros, publicado pela No Starch Press.
★ 757+2Variação de estrelas nos últimos 7 dias - #159
DataFoundry é uma bancada de trabalho de IA de código aberto para análise de dados, unificando fontes de dados, conhecimento, ferramentas e tempo de execução de agentes em um espaço de trabalho governado para análises interativas.
★ 751+9Variação de estrelas nos últimos 7 dias - #160
Comece a programar em bancos de dados SQL. Este guia para iniciantes oferece tutoriais passo a passo, exemplos práticos, exercícios e recursos para dominar o SQL. Vamos desbloquear o poder dos dados com o SQL!
★ 741+0Variação de estrelas nos últimos 7 dias - #161
Lista de artigos atualizada continuamente sobre avanços em Data Agents. Repositório complementar ao nosso artigo "A Survey of Data Agents: Emerging Paradigm or Overstated Hype?"
★ 730+10Variação de estrelas nos últimos 7 dias - #162
Materiais para acompanhar o livro Hands-On Data Analysis with Pandas – Second Edition
★ 727+2Variação de estrelas nos últimos 7 dias - #163
Um pacote Python poderoso, agnóstico a formato e orientado pela comunidade para analisar e visualizar dados de ciências da Terra
★ 723+0Variação de estrelas nos últimos 7 dias - #164
Exporte playlists do Spotify usando a Web API. Analise-as no Jupyter notebook.
★ 717+4Variação de estrelas nos últimos 7 dias - #165
Plataforma de ciência de dados impulsionada por IA de código aberto.
★ 708+2Variação de estrelas nos últimos 7 dias - #166
Tabelas dinâmicas e gráficos com suporte a arrastar e soltar para Jupyter/IPython Notebook, utilizando PivotTable.js
★ 707-1Variação de estrelas nos últimos 7 dias - #167★ 705+0Variação de estrelas nos últimos 7 dias
- #168
Um Roadmap de ML (Machine Learning) Full Stack envolve o aprendizado das habilidades e tecnologias necessárias para se tornar proficiente em todos os aspectos de machine learning, incluindo coleta e pré-processamento de dados, desenvolvimento de modelos, implantação e manutenção.
★ 701+0Variação de estrelas nos últimos 7 dias - #169
Código e dados para a primeira edição de "Practical SQL" por Anthony DeBarros, publicado pela No Starch Press (2018).
★ 697-1Variação de estrelas nos últimos 7 dias - #170
Cliente Python e Toolkit para DataFrames, Big Data, Machine Learning e ETL no Elasticsearch
★ 693+1Variação de estrelas nos últimos 7 dias - #171
WeDataSphere é um conjunto de plataforma de big data completo e de nível financeiro.
★ 683+1Variação de estrelas nos últimos 7 dias - #172
ML-capsule é um projeto para iniciantes e entusiastas de ciência de dados experientes que não possuem um mentor e desejam aprender Machine Learning com projetos reais
★ 682+1Variação de estrelas nos últimos 7 dias - #173★ 679+1Variação de estrelas nos últimos 7 dias
- #174★ 672+9Variação de estrelas nos últimos 7 dias
- #175
Acompanhe sua Ciência de Dados. A biblioteca Python de código aberto da Skore acelera o desenvolvimento de modelos de ML com relatórios de avaliação automatizados, orientação metodológica inteligente e análise de validação cruzada abrangente.
★ 663+2Variação de estrelas nos últimos 7 dias - #176
ScienceClaw é um assistente de pesquisa pessoal construído com LangChain DeepAgents e infraestrutura AIO Sandbox, adotando uma arquitetura totalmente nova além do OpenClaw. Oferece maior segurança, melhor transparência e uma experiência mais amigável.
★ 661+3Variação de estrelas nos últimos 7 dias - #177
Análise de tabelas no Tkinter usando pandas DataFrames.
★ 659+1Variação de estrelas nos últimos 7 dias - #178
Ciclo de vida completo de um projeto de ciência de dados
★ 653+0Variação de estrelas nos últimos 7 dias - #179★ 651+0Variação de estrelas nos últimos 7 dias
- #180
A principal solução de código aberto para Qualidade de Dados
★ 651+0Variação de estrelas nos últimos 7 dias