data-analysis
Repositorios de código abierto monitorizados etiquetados con data-analysis, ordenados por estrellas.
- #151
Framework impulsado por la comunidad, simple pero potente, para computación distribuida sobre datos de forma rápida y rentable.
★ 871+1Variación de estrellas de los últimos 7 días - #152
¿Qué hay realmente en tu paquete de datos de Discord?
★ 854+0Variación de estrellas de los últimos 7 días - #153★ 831+0Variación de estrellas de los últimos 7 días
- #154★ 816+0Variación de estrellas de los últimos 7 días
- #155
La ingeniería de características es el proceso de utilizar el conocimiento del dominio para extraer características de datos sin procesar mediante técnicas de minería de datos. Estas características pueden utilizarse para mejorar el rendimiento de los algoritmos de aprendizaje automático. La ingeniería de características puede considerarse como el aprendizaje automático aplicado en sí mismo.
★ 806+0Variación de estrellas de los últimos 7 días - #156
scikit-mobility: análisis de movilidad en Python
★ 806+0Variación de estrellas de los últimos 7 días - #157
Biblioteca de Python impulsada por modelos de lenguaje (LLM) para el descubrimiento y análisis de datos conversacionales.
★ 787+0Variación de estrellas de los últimos 7 días - #158
Código y datos para la segunda edición de "Practical SQL" de Anthony DeBarros, publicado por No Starch Press.
★ 757+1Variación de estrellas de los últimos 7 días - #159
DataFoundry es un entorno de trabajo de IA de código abierto para el análisis de datos, que unifica fuentes de datos, conocimientos, herramientas y tiempo de ejecución de agentes en un espacio de trabajo gobernado para análisis interactivos.
★ 751+5Variación de estrellas de los últimos 7 días - #160
Comienza con la programación de bases de datos SQL. Esta guía para principiantes ofrece tutoriales paso a paso, ejemplos prácticos, ejercicios y recursos para dominar SQL.
★ 741+0Variación de estrellas de los últimos 7 días - #161
Lista de artículos actualizada continuamente sobre avances en Agentes de Datos. Repositorio complementario a nuestro artículo "Una encuesta sobre Agentes de Datos: ¿Paradigma emergente o exageración excesiva?"
★ 730+4Variación de estrellas de los últimos 7 días - #162
Materiales para seguir el libro Hands-On Data Analysis with Pandas – Second Edition
★ 727+2Variación de estrellas de los últimos 7 días - #163
Un paquete de Python potente, agnóstico al formato y desarrollado por la comunidad para analizar y visualizar datos de ciencias de la Tierra.
★ 723+1Variación de estrellas de los últimos 7 días - #164
Exporta listas de reproducción de Spotify usando la Web API y analízalas en Jupyter notebook.
★ 716+4Variación de estrellas de los últimos 7 días - #165
Plataforma de ciencia de datos de código abierto impulsada por IA.
★ 708+0Variación de estrellas de los últimos 7 días - #166
Tablas dinámicas y gráficos de arrastrar y soltar para Jupyter/IPython Notebook, mediante PivotTable.js
★ 707+0Variación de estrellas de los últimos 7 días - #167★ 705+0Variación de estrellas de los últimos 7 días
- #168
Una hoja de ruta de Full Stack ML (Machine Learning) que abarca el aprendizaje de las habilidades y tecnologías necesarias para dominar todos los aspectos del aprendizaje automático, incluyendo la recopilación y preprocesamiento de datos, desarrollo de modelos, despliegue y mantenimiento.
★ 701+0Variación de estrellas de los últimos 7 días - #169
Código y datos para la primera edición de "Practical SQL" de Anthony DeBarros, publicado por No Starch Press (2018).
★ 697-1Variación de estrellas de los últimos 7 días - #170
Cliente y kit de herramientas de Python para DataFrames, Big Data, Machine Learning y ETL en Elasticsearch
★ 693+1Variación de estrellas de los últimos 7 días - #171
WeDataSphere es una suite de plataforma de big data integral de grado financiero.
★ 683+2Variación de estrellas de los últimos 7 días - #172
ML-capsule es un proyecto para principiantes y entusiastas de la ciencia de datos que no cuentan con un mentor y desean aprender Machine Learning. A través de este repositorio, pueden aprender ML, DL y tecnologías relacionadas mediante proyectos del mundo real para prepararse para entrevistas.
★ 682-1Variación de estrellas de los últimos 7 días - #173★ 679+1Variación de estrellas de los últimos 7 días
- #174★ 672+5Variación de estrellas de los últimos 7 días
- #175
Realice un seguimiento de su ciencia de datos. La biblioteca de Python de código abierto de Skore acelera el desarrollo de modelos de ML con informes de evaluación automatizados, orientación metodológica inteligente y análisis exhaustivo de validación cruzada.
★ 663+2Variación de estrellas de los últimos 7 días - #176
ScienceClaw es un asistente de investigación personal construido con LangChain DeepAgents y la infraestructura AIO Sandbox, que adopta una arquitectura completamente nueva más allá de OpenClaw. Ofrece mayor seguridad, mejor transparencia y una experiencia más fácil de usar.
★ 661+4Variación de estrellas de los últimos 7 días - #177
Análisis de tablas en Tkinter utilizando DataFrames de pandas.
★ 659+1Variación de estrellas de los últimos 7 días - #178
Ciclo de vida completo de un proyecto de ciencia de datos
★ 653+0Variación de estrellas de los últimos 7 días - #179★ 651+0Variación de estrellas de los últimos 7 días
- #180
La solución de código abierto líder en calidad de datos.
★ 651+0Variación de estrellas de los últimos 7 días