spark
Repositorios de código abierto monitorizados etiquetados con spark, ordenados por estrellas.
- #31
LakeSoul es un framework de Lakehouse nativo de la nube, de extremo a extremo y en tiempo real, diseñado para la ingesta rápida de datos, actualizaciones concurrentes, análisis incrementales, procesamiento de datos multimodales y búsqueda vectorial, impulsando cargas de trabajo de BI y AI de próxima generación.
★ 3249+2Variación de estrellas de los últimos 7 días - #32
Aprendizaje de Big Data, aprenda Big Data desde cero, incluyendo videos de aprendizaje de varias etapas de Big Data y materiales de entrevistas
★ 3224+5Variación de estrellas de los últimos 7 días - #33
Operador de Kubernetes para gestionar el ciclo de vida de las aplicaciones de Apache Spark en Kubernetes.
★ 3150+0Variación de estrellas de los últimos 7 días - #34
Servidor de trabajos REST para Apache Spark
★ 2836+0Variación de estrellas de los últimos 7 días - #35★ 2829+16Variación de estrellas de los últimos 7 días
- #36
:herb: Ejemplo de aprendizaje rápido basado en SpringBoot, que integra frameworks de código abierto encontrados por uno mismo, tales como: rabbitmq (cola de retraso), Kafka, jpa, redis, oauth2, swagger, jsp, docker, k3s, k3d, k8s, plugin de cifrado y descifrado mybatis, manejo de excepciones, salida de registros, desarrollo de múltiples módulos, empaquetado para múltiples entornos, caché, web scrapers, jwt, GraphQL, dubbo, zookeeper y Async, entre otros :pushpin:
★ 2787+1Variación de estrellas de los últimos 7 días - #37
Sistema de análisis de flujo de pasajeros con Big Data para el metro de Shenzhen 🚇🚄🌟
★ 2475+1Variación de estrellas de los últimos 7 días - #38
✨Spark es una herramienta de administración remota (RAT) basada en web, multiplataforma y con todas las funciones, escrita en Go, que te permite controlar todos tus dispositivos desde cualquier lugar.
★ 2386+3Variación de estrellas de los últimos 7 días - #39
Enlace de datos probabilístico rápido, preciso y escalable con compatibilidad para múltiples backends de SQL
★ 2375+6Variación de estrellas de los últimos 7 días - #40
Apache Kyuubi es una puerta de enlace distribuida y multiusuario para proporcionar SQL sin servidor en data warehouses y lakehouses.
★ 2364+1Variación de estrellas de los últimos 7 días - #41
TransmogrifAI es una biblioteca AutoML para construir flujos de trabajo de aprendizaje automático modulares, reutilizables y fuertemente tipados en Apache Spark con un ajuste manual mínimo
★ 2277+0Variación de estrellas de los últimos 7 días - #42
YTsaurus es una plataforma de big data de código abierto, escalable y tolerante a fallos.
★ 2203+0Variación de estrellas de los últimos 7 días - #43
Herramientas para gestionar firmware de productos DJI, con enfoque en cuatricópteros.
★ 2193+3Variación de estrellas de los últimos 7 días - #44
Una interfaz unificada para computación distribuida. Fugue ejecuta código SQL, Python, Pandas y Polars en Spark, Dask y Ray sin necesidad de reescrituras.
★ 2170+0Variación de estrellas de los últimos 7 días - #45★ 2166+0Variación de estrellas de los últimos 7 días
- #46
.NET for Apache® Spark™ hace que Apache Spark™ sea fácilmente accesible para los desarrolladores de .NET.
★ 2096-2Variación de estrellas de los últimos 7 días - #47★ 1994+1Variación de estrellas de los últimos 7 días
- #48
Conector de Apache Spark a Apache Cassandra
★ 1955+1Variación de estrellas de los últimos 7 días - #49
Repositorio de conocimientos de Big Data que abarca el modelado de almacenes de datos, computación en tiempo real, Big Data, centros de datos (data mid-end), diseño de sistemas, Java, algoritmos, etc.
★ 1811+3Variación de estrellas de los últimos 7 días - #50
El acelerador Auron para marcos de computación distribuida (como Spark) aprovecha la ejecución vectorizada nativa para acelerar el procesamiento de consultas
★ 1798+2Variación de estrellas de los últimos 7 días - #51
Resumen de la arquitectura de conocimiento full-stack para backend (Java, Golang)
★ 1768+2Variación de estrellas de los últimos 7 días - #52
Organización de código abierto ApacheCN: anuncios, presentaciones, miembros, actividades y canales de comunicación
★ 1754+0Variación de estrellas de los últimos 7 días - #53
Más de 2000 preguntas de entrevista para ingenieros de datos
★ 1721+5Variación de estrellas de los últimos 7 días - #54
Elassandra = Elasticsearch + Apache Cassandra
★ 1714+0Variación de estrellas de los últimos 7 días - #55
Tutoriales de Apache Spark y Python (pySpark) para análisis de Big Data y Machine Learning en formato de notebooks de IPython / Jupyter.
★ 1660+0Variación de estrellas de los últimos 7 días - #56★ 1625+0Variación de estrellas de los últimos 7 días
- #57
Los aspectos internos de Apache Spark
★ 1549+0Variación de estrellas de los últimos 7 días - #58★ 1544+1Variación de estrellas de los últimos 7 días
- #59
:truck: Flujos de trabajo de preparación de datos ágiles facilitados con Pandas, Dask, cuDF, Dask-cuDF, Vaex y PySpark
★ 1536+0Variación de estrellas de los últimos 7 días - #60★ 1498+1Variación de estrellas de los últimos 7 días