data-science
Repositorios de código abierto monitorizados etiquetados con data-science, ordenados por estrellas.
- #451
Ejemplos de técnicas para entrenar, explicar y depurar modelos de ML en cuanto a precisión, discriminación y seguridad.
★ 680+0Variación de estrellas de los últimos 7 días - #452
Visualización de redes interactiva en Python y Dash, impulsada por Cytoscape.js.
★ 678+0Variación de estrellas de los últimos 7 días - #453
Construye 12 aplicaciones de datos en Python con Streamlit.
★ 677+1Variación de estrellas de los últimos 7 días - #454
RAGLight es un framework modular para Generación Aumentada por Recuperación (RAG). Facilita la integración de diferentes LLM, embeddings y bases de datos vectoriales, e incluye integración con MCP para conectar herramientas y fuentes de datos externas.
★ 673+1Variación de estrellas de los últimos 7 días - #455★ 673+10Variación de estrellas de los últimos 7 días
- #456
Plotlars es una biblioteca de Rust diseñada para facilitar la integración entre la biblioteca de análisis de datos Polars y la biblioteca Plotly.
★ 669+1Variación de estrellas de los últimos 7 días - #457★ 664+2Variación de estrellas de los últimos 7 días
- #458
Realice un seguimiento de su ciencia de datos. La biblioteca de Python de código abierto de Skore acelera el desarrollo de modelos de ML con informes de evaluación automatizados, orientación metodológica inteligente y análisis exhaustivo de validación cruzada.
★ 663+2Variación de estrellas de los últimos 7 días - #459
🎨 Kit de herramientas para generar gráficos con calidad de publicación para revistas como Cell, Nature y Science.
★ 663+8Variación de estrellas de los últimos 7 días - #460★ 661—Variación de estrellas de los últimos 7 días
- #461
Turbodbc es un módulo de Python para acceder a bases de datos relacionales a través de la interfaz Open Database Connectivity (ODBC). El módulo cumple con la especificación 2.0 de la API de bases de datos de Python.
★ 659+1Variación de estrellas de los últimos 7 días - #462
Una colección curada de recursos gratuitos para ayudar a profundizar su comprensión del lenguaje de programación R. Se actualiza regularmente. Se aceptan contribuciones mediante pull request (ver contributing.md).
★ 659+2Variación de estrellas de los últimos 7 días - #463
Comparación de DataFrames de Pandas, Polars, Spark y Snowpark para humanos y más.
★ 658+0Variación de estrellas de los últimos 7 días - #464
Un repositorio de conjuntos de datos interesantes recopilados para la investigación en ciencia de redes y aprendizaje automático.
★ 655+0Variación de estrellas de los últimos 7 días - #465
Ciclo de vida completo de un proyecto de ciencia de datos
★ 653+0Variación de estrellas de los últimos 7 días - #466★ 651+0Variación de estrellas de los últimos 7 días
- #467
La solución de código abierto líder en calidad de datos.
★ 651+0Variación de estrellas de los últimos 7 días - #468
Materiales del curso: Ciencia de datos geoespaciales
★ 650+1Variación de estrellas de los últimos 7 días - #469★ 636+0Variación de estrellas de los últimos 7 días
- #470★ 632+0Variación de estrellas de los últimos 7 días
- #471
Second Brain es un framework de agentes que actúa como un sistema operativo, utilizando inteligencia de archivos locales, automatización de flujos de trabajo y LLMs para completar tareas y comunicarse a través de múltiples modalidades y plataformas de mensajería.
★ 631+13Variación de estrellas de los últimos 7 días - #472
mRMR (mínima redundancia, máxima relevancia) para la selección automática de características a gran escala.
★ 629+0Variación de estrellas de los últimos 7 días - #473
Si vienes de uno de mis tutoriales de ciencia de datos, aquí encontrarás el código y los enlaces a los tutoriales. Espero que te sean útiles. ¡Feliz aprendizaje y programación!
★ 626+0Variación de estrellas de los últimos 7 días - #474
Cross Beat (xbe.at): tu centro de tutoriales sobre Python, aprendizaje automático e IA. Explora tutoriales de Python, perspectivas de IA y más.
★ 626-1Variación de estrellas de los últimos 7 días - #475
Resumable Polymarket indexer: CLOB market metadata plus on-chain trades from Polygon, in one DuckDB file you can query with SQL
★ 623—Variación de estrellas de los últimos 7 días - #476
Presentaciones, notas de artículos, apuntes de clase, publicaciones de blog e investigación sobre ML 📉, estadística 📊 e IA 🤖.
★ 622+0Variación de estrellas de los últimos 7 días - #477
Probabilidad y estadística para ciencia de datos: una introducción completa que incluye un PDF gratuito, 103 notebooks de Python con 23 conjuntos de datos reales, 118 videos con diapositivas y soluciones a 200 ejercicios.
★ 620+5Variación de estrellas de los últimos 7 días - #478★ 620+0Variación de estrellas de los últimos 7 días
- #479
Cursos completos de IA dictados por Humai
★ 619+0Variación de estrellas de los últimos 7 días - #480
Aprende Machine Learning con el programa Amazon ML Summer School 2026. Accede a resúmenes de sesiones, preguntas de opción múltiple de años anteriores, ejercicios de programación y material oficial. Practica tareas de codificación por módulos y construye una base sólida para entrevistas y aplicaciones reales.
★ 610+1Variación de estrellas de los últimos 7 días