data-science
Repositórios de código aberto acompanhados marcados com data-science, ordenados por estrelas.
- #451
Exemplos de técnicas para treinar modelos de ML interpretáveis, explicá-los e depurá-los quanto a precisão, discriminação e segurança.
★ 680+0Variação de estrelas nos últimos 7 dias - #452
Visualização de rede interativa em Python e Dash, alimentada por Cytoscape.js
★ 678+0Variação de estrelas nos últimos 7 dias - #453
Construa 12 aplicativos de dados em Python com Streamlit
★ 677+1Variação de estrelas nos últimos 7 dias - #454★ 673+9Variação de estrelas nos últimos 7 dias
- #455
RAGLight é um framework modular para Retrieval-Augmented Generation (RAG). Ele facilita a integração de diferentes LLMs, embeddings e vector stores, e agora inclui integração perfeita com MCP para conectar ferramentas externas e fontes de dados.
★ 673+1Variação de estrelas nos últimos 7 dias - #456
Plotlars é uma biblioteca Rust projetada para facilitar a integração entre a biblioteca de análise de dados Polars e a biblioteca Plotly.
★ 669+1Variação de estrelas nos últimos 7 dias - #457★ 664+2Variação de estrelas nos últimos 7 dias
- #458
🎨 Caixa de ferramentas para gerar gráficos com qualidade de publicação para periódicos da Cell, Nature e Science
★ 663+8Variação de estrelas nos últimos 7 dias - #459
Acompanhe sua Ciência de Dados. A biblioteca Python de código aberto da Skore acelera o desenvolvimento de modelos de ML com relatórios de avaliação automatizados, orientação metodológica inteligente e análise de validação cruzada abrangente.
★ 663+2Variação de estrelas nos últimos 7 dias - #460★ 661—Variação de estrelas nos últimos 7 dias
- #461
O Turbodbc é um módulo Python para acessar bancos de dados relacionais por meio da interface Open Database Connectivity (ODBC). O módulo está em conformidade com a especificação Python Database API Specification 2.0.
★ 659+1Variação de estrelas nos últimos 7 dias - #462
Uma coleção selecionada de recursos gratuitos para ajudar a aprofundar sua compreensão da linguagem de programação R. Atualizado regularmente. Contribuições incentivadas via pull request (consulte contributing.md).
★ 659+2Variação de estrelas nos últimos 7 dias - #463
Comparação de DataFrames em Pandas, Polars, Spark e Snowpark para humanos e muito mais!
★ 658+0Variação de estrelas nos últimos 7 dias - #464
Um repositório de conjuntos de dados bem legais que coletei para pesquisas em ciência de redes e aprendizado de máquina.
★ 655+0Variação de estrelas nos últimos 7 dias - #465
Ciclo de vida completo de um projeto de ciência de dados
★ 653+0Variação de estrelas nos últimos 7 dias - #466★ 651+0Variação de estrelas nos últimos 7 dias
- #467
A principal solução de código aberto para Qualidade de Dados
★ 651+0Variação de estrelas nos últimos 7 dias - #468
Materiais do curso: Ciência de Dados Geoespaciais
★ 650+0Variação de estrelas nos últimos 7 dias - #469★ 636+0Variação de estrelas nos últimos 7 dias
- #470★ 632+0Variação de estrelas nos últimos 7 dias
- #471
Second Brain é um framework agêntico que atua como um sistema operacional, usando inteligência de arquivos locais, automação de fluxos de trabalho e LLMs para concluir tarefas e se comunicar em múltiplos meios e plataformas de mensagens.
★ 631+12Variação de estrelas nos últimos 7 dias - #472
mRMR (mínima redundância e máxima relevância) para seleção automática de recursos em larga escala.
★ 629+0Variação de estrelas nos últimos 7 dias - #473
Cross Beat (xbe.at) - Seu hub para tutoriais de Python, aprendizado de máquina e IA. Explore tutoriais de Python, insights de IA e muito mais.
★ 626-1Variação de estrelas nos últimos 7 dias - #474
Se você veio de um dos meus tutoriais de ciência de dados, encontrará o código e os links para os tutoriais aqui. Espero que sejam úteis. Bons estudos e boa codificação!
★ 626+0Variação de estrelas nos últimos 7 dias - #475
Apresentações, anotações de artigos, anotações de aulas, posts de blog e pesquisas sobre ML 📉, estatística 📊 e IA 🤖.
★ 622+0Variação de estrelas nos últimos 7 dias - #476
Resumable Polymarket indexer: CLOB market metadata plus on-chain trades from Polygon, in one DuckDB file you can query with SQL
★ 621—Variação de estrelas nos últimos 7 dias - #477
Probabilidade e Estatística para Ciência de Dados: Uma introdução autossuficiente à probabilidade e estatística para ciência de dados, incluindo um PDF gratuito, 103 notebooks em Python usando 23 conjuntos de dados do mundo real, 118 vídeos com slides e soluções para 200 exercícios
★ 620+5Variação de estrelas nos últimos 7 dias - #478★ 620+0Variação de estrelas nos últimos 7 dias
- #479
Cursos completos de IA ministrados pela Humai
★ 619+0Variação de estrelas nos últimos 7 dias - #480
Aprenda Aprendizado de Máquina com o programa Amazon ML Summer School 2026. Acesse resumos de sessões, questões de múltipla escolha de anos anteriores, questões de programação e material de teste oficial. Pratique tarefas de codificação por módulo e construa uma base sólida para entrevistas e aplicações do mundo real.
★ 610+0Variação de estrelas nos últimos 7 dias