Saltar al contenido principal
buildradar
Sign in
Tema · big-data

big-data

Repositorios de código abierto monitorizados etiquetados con big-data, ordenados por estrellas.

110 repositorios
  • Daft@Eventual-Inc

    Motor de datos de alto rendimiento para IA y cargas de trabajo multimodales. Procesa imágenes, audio, video y datos estructurados a cualquier escala

    5736+4Variación de estrellas de los últimos 7 días
  • SynapseML@microsoft

    Biblioteca de Python de Machine Learning simple y distribuida que adapta algoritmos de ML para Spark

    5245+3Variación de estrellas de los últimos 7 días
  • calcite@apache

    Apache Calcite

    5180+2Variación de estrellas de los últimos 7 días
  • ignite@apache

    Apache Ignite

    5082+2Variación de estrellas de los últimos 7 días
  • Stream-Framework@tschellenbach

    Stream Framework es una biblioteca de Python que te permite crear feeds de noticias, flujos de actividad y sistemas de notificación utilizando Cassandra y/o Redis. Los autores de Stream-Framework también ofrecen un servicio en la nube para tecnología de feeds:

    4742-2Variación de estrellas de los últimos 7 días
  • ⚡️Un componente de Vue que soporta listas de gran cantidad de datos con alto rendimiento de renderizado y eficiencia.

    4505-1Variación de estrellas de los últimos 7 días
  • img2dataset@rom1504

    Convierte fácilmente grandes conjuntos de URL de imágenes en un conjunto de datos de imágenes. Puede descargar, redimensionar y empaquetar 100M de URL en 20 horas en una sola máquina.

    4445+2Variación de estrellas de los últimos 7 días
  • crate@crate

    CrateDB es una base de datos SQL distribuida y escalable para almacenar y analizar cantidades masivas de datos casi en tiempo real, incluso con consultas complejas. Es compatible con PostgreSQL y está basada en Lucene.

    4432+3Variación de estrellas de los últimos 7 días
  • fastjson2@alibaba

    🚄 FASTJSON2 es una biblioteca JSON de Java con un rendimiento excelente.

    4399+2Variación de estrellas de los últimos 7 días
  • Data-Science-Roadmap@Moataz-Elmesmary

    Hoja de ruta de ciencia de datos de la A a la Z

    4354+3Variación de estrellas de los últimos 7 días
  • GraphScope@alibaba

    🔨 🍇 💻 🚀 GraphScope: un sistema integral de computación de grafos a gran escala de Alibaba | 一站式图计算系统

    3557+1Variación de estrellas de los últimos 7 días
  • Lexer y parser de SQL extensible para Rust

    3446+9Variación de estrellas de los últimos 7 días
  • paimon@apache

    Apache Paimon es un formato de lago que permite construir una arquitectura Realtime Lakehouse con Flink y Spark tanto para operaciones de streaming como por lotes.

    3388+3Variación de estrellas de los últimos 7 días
  • koalas@databricks

    Koalas: API de pandas en Apache Spark

    3374+1Variación de estrellas de los últimos 7 días
  • sail@lakehq

    Reemplazo directo de Apache Spark escrito en Rust, que unifica el procesamiento por lotes, el procesamiento de flujos y las cargas de trabajo de IA intensivas en computación.

    3341+4Variación de estrellas de los últimos 7 días
  • hugegraph@apache

    Una base de datos de grafos que admite más de 100 mil millones de datos, alto rendimiento y escalabilidad (incluye OLTP Engine, REST-API y Backends)

    3167+6Variación de estrellas de los últimos 7 días
  • CBoard@TuiQiao

    Una plataforma de informes de BI y paneles de BI de autoservicio, abierta y fácil de usar

    3098+1Variación de estrellas de los últimos 7 días
  • kafka-ui@kafbat

    Interfaz Web de código abierto para gestionar clústeres de Apache Kafka

    2656+14Variación de estrellas de los últimos 7 días
  • ArcticDB@man-group

    ArcticDB es una base de datos DataFrame sin servidor y de alto rendimiento creada para el ecosistema de Data Science de Python.

    2505+8Variación de estrellas de los últimos 7 días
  • quary@quarylabs

    BI de código abierto para ingenieros

    2379+2Variación de estrellas de los últimos 7 días
  • ambari@apache

    Apache Ambari simplifica el aprovisionamiento, la gestión y la supervisión de clústeres de Apache Hadoop.

    2311+0Variación de estrellas de los últimos 7 días
  • ytsaurus@ytsaurus

    YTsaurus es una plataforma de big data de código abierto, escalable y tolerante a fallos.

    2203+0Variación de estrellas de los últimos 7 días
  • fluss@apache

    Apache Fluss es un almacenamiento de streaming diseñado para análisis en tiempo real.

    2131+11Variación de estrellas de los últimos 7 días
  • Motor de consultas distribuidas de Apache DataFusion Ballista

    2127+7Variación de estrellas de los últimos 7 días
  • drill@apache

    Apache Drill es una capa de consulta MPP distribuida para datos autodescriptivos.

    2022+0Variación de estrellas de los últimos 7 días
  • bookkeeper@apache

    Apache BookKeeper: un servicio de almacenamiento escalable, tolerante a fallos y de baja latencia optimizado para cargas de trabajo de solo anexado

    2011+1Variación de estrellas de los últimos 7 días
  • fluid@fluid-cloudnative

    Abstracción de datos fluida y elástica y aceleración para aplicaciones BigData/AI en la nube. (Proyecto bajo la CNCF)

    1967+0Variación de estrellas de los últimos 7 días
  • kudu@apache

    Espejo de Apache Kudu

    1913+0Variación de estrellas de los últimos 7 días
  • awesome-data-analysis@PavelGrigoryevDS

    Más de 500 recursos seleccionados para análisis de datos y ciencia de datos: Python, SQL, estadística, ML, IA, visualización, hojas de referencia, hojas de ruta y preparación de entrevistas. Para principiantes y expertos.

    1890+8Variación de estrellas de los últimos 7 días
  • auron@apache

    El acelerador Auron para marcos de computación distribuida (como Spark) aprovecha la ejecución vectorizada nativa para acelerar el procesamiento de consultas

    1798+2Variación de estrellas de los últimos 7 días
← Volver a temas