Saltar al contenido principal
buildradar
Sign in
Tema · bigdata

bigdata

Repositorios de código abierto monitorizados etiquetados con bigdata, ordenados por estrellas.

Repositorios
48
Estrellas totales
252.531
Estrellas de media
5261
Proporción
0,01%

Temas que aparecen con frecuencia junto a bigdata en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con bigdata.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • data-engineer-handbook@DataExpert-io

    Este es un repositorio con enlaces a todo lo que desearías aprender sobre ingeniería de datos

    43.905+88Variación de estrellas de los últimos 7 días
  • rustfs@rustfs

    🚀 2.3 veces más rápido que MinIO para cargas útiles de objetos de 4KB. RustFS es un sistema de almacenamiento de objetos de alto rendimiento, de código abierto y compatible con S3, que admite la migración y la coexistencia con otras plataformas compatibles con S3 como MinIO y Ceph.

    31.528+238Variación de estrellas de los últimos 7 días
  • TDengine@taosdata

    Base de datos de series temporales de alto rendimiento y escalable diseñada para escenarios de IoT industrial (IIoT)

    25.093+15Variación de estrellas de los últimos 7 días
  • Potenciando la inteligencia de datos con SQL distribuido para fragmentación, escalabilidad y seguridad en todas las bases de datos.

    20.791+10Variación de estrellas de los últimos 7 días
  • BigData-Notes@heibaiying

    Guía de introducción a Big Data :star:

    16.958+6Variación de estrellas de los últimos 7 días
  • Una lista curada de impresionantes frameworks de big data, recursos y otras maravillas.

    14.601+63Variación de estrellas de los últimos 7 días
  • juicefs@juicedata

    JuiceFS es un sistema de archivos POSIX distribuido construido sobre Redis y S3.

    14.371+19Variación de estrellas de los últimos 7 días
  • databend@databendlabs

    Data Agent Ready Warehouse: Uno para análisis, búsqueda, IA y entorno aislado de Python. Reconstruido desde cero. Arquitectura unificada en tu S3.

    9426+3Variación de estrellas de los últimos 7 días
  • vaex@vaexio

    DataFrame híbrido fuera de núcleo (out-of-core) de Apache Arrow/NumPy para Python, aprendizaje automático, visualización y exploración de grandes datos tabulares a mil millones de filas por segundo 🚀

    8509+1Variación de estrellas de los últimos 7 días
  • hudi@apache

    Inserciones actualizadas (upserts), eliminaciones y procesamiento incremental en Big Data.

    6227+12Variación de estrellas de los últimos 7 días
  • volcano@volcano-sh

    Un sistema de procesamiento por lotes nativo de la nube (proyecto bajo la CNCF)

    5907+30Variación de estrellas de los últimos 7 días
  • BigDataView@iGaoWei

    Más de 100 plantillas HTML5 de visualización de grandes datos; incluye industrias como comunidad, bienes raíces, gobierno, transporte, finanzas y banca, siendo las más nuevas, numerosas, completas y llamativas de la web. Actualizaciones en curso.

    5298+21Variación de estrellas de los últimos 7 días
  • chunjun@DTStack

    Un framework de integración de datos

    4100+1Variación de estrellas de los últimos 7 días
  • 🔨 Genera sentencias SQL estructuradas usando JSON, implementado con Vue3 + TypeScript + Vite + Ant Design + MonacoEditor. El proyecto es simple (enfocado en la lógica más que en la interfaz), ideal para practicar.

    3424-3Variación de estrellas de los últimos 7 días
  • avro@apache

    Apache Avro es un sistema de serialización de datos.

    3301+3Variación de estrellas de los últimos 7 días
  • BigDataGuide@MoRan1607

    Aprendizaje de Big Data, aprenda Big Data desde cero, incluyendo videos de aprendizaje de varias etapas de Big Data y materiales de entrevistas

    3219+9Variación de estrellas de los últimos 7 días
  • griddb@griddb

    GridDB es una base de datos de código abierto de próxima generación que hace que las series temporales de IoT y Big Data sean rápidas y sencillas.

    2475+0Variación de estrellas de los últimos 7 días
  • Aix-DB@apconw

    Aix-DB se basa en los frameworks LangChain/LangGraph, combinados con la arquitectura de colaboración multiagente MCP Skills, para lograr la conversión de extremo a extremo de lenguaje natural a información de datos.

    2237+10Variación de estrellas de los últimos 7 días
  • spark@dotnet

    .NET for Apache® Spark™ hace que Apache Spark™ sea fácilmente accesible para los desarrolladores de .NET.

    2097+0Variación de estrellas de los últimos 7 días
  • flinkStreamSQL@DTStack

    Extensión de SQL en tiempo real basada en Apache Flink de código abierto; implementa principalmente la unión (join) entre streams y tablas de dimensiones, compatible con toda la sintaxis de Flink SQL nativo.

    2051+0Variación de estrellas de los últimos 7 días
  • byzer-lang@byzer-org

    Byzer (anteriormente MLSQL): Un lenguaje de programación de código abierto de bajo código para pipelines de datos, analítica e IA.

    1835-1Variación de estrellas de los últimos 7 días
  • bigdata-growth@collabH

    Repositorio de conocimientos de Big Data que abarca el modelado de almacenes de datos, computación en tiempo real, Big Data, centros de datos (data mid-end), diseño de sistemas, Java, algoritmos, etc.

    1808+3Variación de estrellas de los últimos 7 días
  • genie@Netflix

    Servicio distribuido de orquestación de Big Data

    1767+0Variación de estrellas de los últimos 7 días
  • AutoCrawler@YoongiKim

    Rastreador web de imágenes multiproceso para Google y Naver (Selenium)

    1691-1Variación de estrellas de los últimos 7 días
  • spark-py-notebooks@jadianes

    Tutoriales de Apache Spark y Python (pySpark) para análisis de Big Data y Machine Learning en formato de notebooks de IPython / Jupyter.

    1660+1Variación de estrellas de los últimos 7 días
  • optimus@hi-primus

    :truck: Flujos de trabajo de preparación de datos ágiles facilitados con Pandas, Dask, cuDF, Dask-cuDF, Vaex y PySpark

    1536+0Variación de estrellas de los últimos 7 días
  • odd-platform@opendatadiscovery

    La primera plataforma de descubrimiento y observabilidad de datos de código abierto. Facilitamos la vida a los profesionales de datos para que puedas centrarte en tu negocio.

    1426+2Variación de estrellas de los últimos 7 días
  • celeborn@apache

    Apache Celeborn es un servicio elástico y de alto rendimiento para datos de shuffle y desbordamiento.

    1061-1Variación de estrellas de los últimos 7 días
  • cds@zeromicro

    Sincronización de datos en golang para ClickHouse.

    979+0Variación de estrellas de los últimos 7 días
  • livy@apache

    Apache Livy es una interfaz REST de código abierto para interactuar con Apache Spark desde cualquier lugar.

    960+0Variación de estrellas de los últimos 7 días
← Volver a temas