Saltar al contenido principal
buildradar
Sign in
Tema · spark

spark

Repositorios de código abierto monitorizados etiquetados con spark, ordenados por estrellas.

115 repositorios
  • LakeSoul@lakesoul-io

    LakeSoul es un framework de Lakehouse nativo de la nube, de extremo a extremo y en tiempo real, diseñado para la ingesta rápida de datos, actualizaciones concurrentes, análisis incrementales, procesamiento de datos multimodales y búsqueda vectorial, impulsando cargas de trabajo de BI y AI de próxima generación.

    3249+2Variación de estrellas de los últimos 7 días
  • BigDataGuide@MoRan1607

    Aprendizaje de Big Data, aprenda Big Data desde cero, incluyendo videos de aprendizaje de varias etapas de Big Data y materiales de entrevistas

    3224+5Variación de estrellas de los últimos 7 días
  • spark-operator@kubeflow

    Operador de Kubernetes para gestionar el ciclo de vida de las aplicaciones de Apache Spark en Kubernetes.

    3150+0Variación de estrellas de los últimos 7 días
  • spark-jobserver@spark-jobserver

    Servidor de trabajos REST para Apache Spark

    2836+0Variación de estrellas de los últimos 7 días
  • lucebox@Luce-Org

    Servidor de inferencia especulativa de LLM para hardware heterogéneo y de consumo

    2829+16Variación de estrellas de los últimos 7 días
  • spring-boot-quick@vector4wang

    :herb: Ejemplo de aprendizaje rápido basado en SpringBoot, que integra frameworks de código abierto encontrados por uno mismo, tales como: rabbitmq (cola de retraso), Kafka, jpa, redis, oauth2, swagger, jsp, docker, k3s, k3d, k8s, plugin de cifrado y descifrado mybatis, manejo de excepciones, salida de registros, desarrollo de múltiples módulos, empaquetado para múltiples entornos, caché, web scrapers, jwt, GraphQL, dubbo, zookeeper y Async, entre otros :pushpin:

    2787+1Variación de estrellas de los últimos 7 días
  • SZT-bigdata@geekyouth

    Sistema de análisis de flujo de pasajeros con Big Data para el metro de Shenzhen 🚇🚄🌟

    2475+1Variación de estrellas de los últimos 7 días
  • Spark@XZB-1248

    ✨Spark es una herramienta de administración remota (RAT) basada en web, multiplataforma y con todas las funciones, escrita en Go, que te permite controlar todos tus dispositivos desde cualquier lugar.

    2386+3Variación de estrellas de los últimos 7 días
  • splink@moj-analytical-services

    Enlace de datos probabilístico rápido, preciso y escalable con compatibilidad para múltiples backends de SQL

    2375+6Variación de estrellas de los últimos 7 días
  • kyuubi@apache

    Apache Kyuubi es una puerta de enlace distribuida y multiusuario para proporcionar SQL sin servidor en data warehouses y lakehouses.

    2364+1Variación de estrellas de los últimos 7 días
  • TransmogrifAI@salesforce

    TransmogrifAI es una biblioteca AutoML para construir flujos de trabajo de aprendizaje automático modulares, reutilizables y fuertemente tipados en Apache Spark con un ajuste manual mínimo

    2277+0Variación de estrellas de los últimos 7 días
  • ytsaurus@ytsaurus

    YTsaurus es una plataforma de big data de código abierto, escalable y tolerante a fallos.

    2203+0Variación de estrellas de los últimos 7 días
  • Herramientas para gestionar firmware de productos DJI, con enfoque en cuatricópteros.

    2193+3Variación de estrellas de los últimos 7 días
  • fugue@fugue-project

    Una interfaz unificada para computación distribuida. Fugue ejecuta código SQL, Python, Pandas y Polars en Spark, Dask y Ray sin necesidad de reescrituras.

    2170+0Variación de estrellas de los últimos 7 días
  • zio-quill@zio

    Consultas integradas en el lenguaje en tiempo de compilación para Scala

    2166+0Variación de estrellas de los últimos 7 días
  • spark@dotnet

    .NET for Apache® Spark™ hace que Apache Spark™ sea fácilmente accesible para los desarrolladores de .NET.

    2096-2Variación de estrellas de los últimos 7 días
  • gatk@broadinstitute

    Repositorio de código oficial para las versiones 4 y superiores de GATK

    1994+1Variación de estrellas de los últimos 7 días
  • Conector de Apache Spark a Apache Cassandra

    1955+1Variación de estrellas de los últimos 7 días
  • bigdata-growth@collabH

    Repositorio de conocimientos de Big Data que abarca el modelado de almacenes de datos, computación en tiempo real, Big Data, centros de datos (data mid-end), diseño de sistemas, Java, algoritmos, etc.

    1811+3Variación de estrellas de los últimos 7 días
  • auron@apache

    El acelerador Auron para marcos de computación distribuida (como Spark) aprovecha la ejecución vectorizada nativa para acelerar el procesamiento de consultas

    1798+2Variación de estrellas de los últimos 7 días
  • Tutorial@zhonghuasheng

    Resumen de la arquitectura de conocimiento full-stack para backend (Java, Golang)

    1768+2Variación de estrellas de los últimos 7 días
  • .github@apachecn

    Organización de código abierto ApacheCN: anuncios, presentaciones, miembros, actividades y canales de comunicación

    1754+0Variación de estrellas de los últimos 7 días
  • Más de 2000 preguntas de entrevista para ingenieros de datos

    1721+5Variación de estrellas de los últimos 7 días
  • elassandra@strapdata

    Elassandra = Elasticsearch + Apache Cassandra

    1714+0Variación de estrellas de los últimos 7 días
  • spark-py-notebooks@jadianes

    Tutoriales de Apache Spark y Python (pySpark) para análisis de Big Data y Machine Learning en formato de notebooks de IPython / Jupyter.

    1660+0Variación de estrellas de los últimos 7 días
  • almond@almond-sh

    Un kernel de Scala para Jupyter

    1625+0Variación de estrellas de los últimos 7 días
  • apache-spark-internals@japila-books

    Los aspectos internos de Apache Spark

    1549+0Variación de estrellas de los últimos 7 días
  • mleap@combust

    MLeap: Despliega canalizaciones de ML en producción

    1544+1Variación de estrellas de los últimos 7 días
  • optimus@hi-primus

    :truck: Flujos de trabajo de preparación de datos ágiles facilitados con Pandas, Dask, cuDF, Dask-cuDF, Vaex y PySpark

    1536+0Variación de estrellas de los últimos 7 días
  • nessie@projectnessie

    Nessie: Catálogo transaccional para Data Lakes con semántica similar a Git

    1498+1Variación de estrellas de los últimos 7 días
← Volver a temas