big-data
Repositorios de código abierto monitorizados etiquetados con big-data, ordenados por estrellas.
- #31
Motor de datos de alto rendimiento para IA y cargas de trabajo multimodales. Procesa imágenes, audio, video y datos estructurados a cualquier escala
★ 5736+4Variación de estrellas de los últimos 7 días - #32
Biblioteca de Python de Machine Learning simple y distribuida que adapta algoritmos de ML para Spark
★ 5245+3Variación de estrellas de los últimos 7 días - #33★ 5180+2Variación de estrellas de los últimos 7 días
- #34★ 5082+2Variación de estrellas de los últimos 7 días
- #35
Stream Framework es una biblioteca de Python que te permite crear feeds de noticias, flujos de actividad y sistemas de notificación utilizando Cassandra y/o Redis. Los autores de Stream-Framework también ofrecen un servicio en la nube para tecnología de feeds:
★ 4742-2Variación de estrellas de los últimos 7 días - #36
⚡️Un componente de Vue que soporta listas de gran cantidad de datos con alto rendimiento de renderizado y eficiencia.
★ 4505-1Variación de estrellas de los últimos 7 días - #37
Convierte fácilmente grandes conjuntos de URL de imágenes en un conjunto de datos de imágenes. Puede descargar, redimensionar y empaquetar 100M de URL en 20 horas en una sola máquina.
★ 4445+2Variación de estrellas de los últimos 7 días - #38
CrateDB es una base de datos SQL distribuida y escalable para almacenar y analizar cantidades masivas de datos casi en tiempo real, incluso con consultas complejas. Es compatible con PostgreSQL y está basada en Lucene.
★ 4432+3Variación de estrellas de los últimos 7 días - #39★ 4399+2Variación de estrellas de los últimos 7 días
- #40
Hoja de ruta de ciencia de datos de la A a la Z
★ 4354+3Variación de estrellas de los últimos 7 días - #41
🔨 🍇 💻 🚀 GraphScope: un sistema integral de computación de grafos a gran escala de Alibaba | 一站式图计算系统
★ 3557+1Variación de estrellas de los últimos 7 días - #42
Lexer y parser de SQL extensible para Rust
★ 3446+9Variación de estrellas de los últimos 7 días - #43
Apache Paimon es un formato de lago que permite construir una arquitectura Realtime Lakehouse con Flink y Spark tanto para operaciones de streaming como por lotes.
★ 3388+3Variación de estrellas de los últimos 7 días - #44★ 3374+1Variación de estrellas de los últimos 7 días
- #45
Reemplazo directo de Apache Spark escrito en Rust, que unifica el procesamiento por lotes, el procesamiento de flujos y las cargas de trabajo de IA intensivas en computación.
★ 3341+4Variación de estrellas de los últimos 7 días - #46
Una base de datos de grafos que admite más de 100 mil millones de datos, alto rendimiento y escalabilidad (incluye OLTP Engine, REST-API y Backends)
★ 3167+6Variación de estrellas de los últimos 7 días - #47
Una plataforma de informes de BI y paneles de BI de autoservicio, abierta y fácil de usar
★ 3098+1Variación de estrellas de los últimos 7 días - #48★ 2656+14Variación de estrellas de los últimos 7 días
- #49
ArcticDB es una base de datos DataFrame sin servidor y de alto rendimiento creada para el ecosistema de Data Science de Python.
★ 2505+8Variación de estrellas de los últimos 7 días - #50★ 2379+2Variación de estrellas de los últimos 7 días
- #51
Apache Ambari simplifica el aprovisionamiento, la gestión y la supervisión de clústeres de Apache Hadoop.
★ 2311+0Variación de estrellas de los últimos 7 días - #52
YTsaurus es una plataforma de big data de código abierto, escalable y tolerante a fallos.
★ 2203+0Variación de estrellas de los últimos 7 días - #53★ 2131+11Variación de estrellas de los últimos 7 días
- #54
Motor de consultas distribuidas de Apache DataFusion Ballista
★ 2127+7Variación de estrellas de los últimos 7 días - #55★ 2022+0Variación de estrellas de los últimos 7 días
- #56
Apache BookKeeper: un servicio de almacenamiento escalable, tolerante a fallos y de baja latencia optimizado para cargas de trabajo de solo anexado
★ 2011+1Variación de estrellas de los últimos 7 días - #57
Abstracción de datos fluida y elástica y aceleración para aplicaciones BigData/AI en la nube. (Proyecto bajo la CNCF)
★ 1967+0Variación de estrellas de los últimos 7 días - #58★ 1913+0Variación de estrellas de los últimos 7 días
- #59
Más de 500 recursos seleccionados para análisis de datos y ciencia de datos: Python, SQL, estadística, ML, IA, visualización, hojas de referencia, hojas de ruta y preparación de entrevistas. Para principiantes y expertos.
★ 1890+8Variación de estrellas de los últimos 7 días - #60
El acelerador Auron para marcos de computación distribuida (como Spark) aprovecha la ejecución vectorizada nativa para acelerar el procesamiento de consultas
★ 1798+2Variación de estrellas de los últimos 7 días