Pular para o conteúdo principal
buildradar
Sign in
Tópico · spark

spark

Repositórios de código aberto acompanhados marcados com spark, ordenados por estrelas.

115 repositórios
  • LakeSoul@lakesoul-io

    LakeSoul é um framework Lakehouse nativo em nuvem, de ponta a ponta e em tempo real, para ingestão rápida de dados, atualizações concorrentes, análises incrementais, processamento de dados multimodais e busca vetorial — impulsionando cargas de trabalho de BI e IA de próxima geração.

    3.249+2Variação de estrelas nos últimos 7 dias
  • BigDataGuide@MoRan1607

    Aprendizado de Big Data do zero, incluindo vídeos de treinamento, materiais de entrevista e guias de estudo para cada etapa.

    3.224+5Variação de estrelas nos últimos 7 dias
  • spark-operator@kubeflow

    Operador Kubernetes para gerenciar o ciclo de vida de aplicações Apache Spark no Kubernetes.

    3.150+0Variação de estrelas nos últimos 7 dias
  • spark-jobserver@spark-jobserver

    Servidor de jobs REST para Apache Spark

    2.836+0Variação de estrelas nos últimos 7 dias
  • lucebox@Luce-Org

    Servidor de inferência especulativa de LLM para hardware de consumo e heterogêneo

    2.829+16Variação de estrelas nos últimos 7 dias
  • spring-boot-quick@vector4wang

    Exemplos de aprendizado rápido baseados em Spring Boot, integrando frameworks de código aberto como: rabbitmq (fila de atraso), Kafka, jpa, redis, oauth2, swagger, jsp, docker, k3s, k3d, k8s, plugin de criptografia mybatis, tratamento de exceções, log, desenvolvimento multimodular, empacotamento multiambiente, cache, web crawler, jwt, GraphQL, dubbo, zookeeper e Async, entre outros.

    2.787+1Variação de estrelas nos últimos 7 dias
  • SZT-bigdata@geekyouth

    Sistema de análise de big data de fluxo de passageiros do metrô de Shenzhen 🚇🚄🌟

    2.475+1Variação de estrelas nos últimos 7 dias
  • Spark@XZB-1248

    Spark é uma ferramenta de administração remota (RAT) baseada na web, multiplataforma e completa, escrita em Go, que permite controlar todos os seus dispositivos de qualquer lugar.

    2.386+3Variação de estrelas nos últimos 7 dias
  • splink@moj-analytical-services

    Vinculação de dados probabilística rápida, precisa e escalável com suporte para múltiplos backends SQL.

    2.375+6Variação de estrelas nos últimos 7 dias
  • kyuubi@apache

    O Apache Kyuubi é um gateway distribuído e multi-tenant que fornece SQL serverless em data warehouses e lakehouses.

    2.364+1Variação de estrelas nos últimos 7 dias
  • TransmogrifAI@salesforce

    TransmogrifAI (pronunciado trăns-mŏgˈrə-fī) é uma biblioteca de AutoML para construir fluxos de trabalho de aprendizado de máquina fortemente tipados, reutilizáveis e modulares no Apache Spark com ajuste manual mínimo

    2.277+0Variação de estrelas nos últimos 7 dias
  • ytsaurus@ytsaurus

    YTsaurus é uma plataforma de big data de código aberto escalável e tolerante a falhas.

    2.203+0Variação de estrelas nos últimos 7 dias
  • Ferramentas para manipular firmwares de produtos DJI, com foco em quadricópteros.

    2.193+3Variação de estrelas nos últimos 7 dias
  • fugue@fugue-project

    Uma interface unificada para computação distribuída. O Fugue executa código SQL, Python, Pandas e Polars no Spark, Dask e Ray sem necessidade de reescrita.

    2.170+0Variação de estrelas nos últimos 7 dias
  • zio-quill@zio

    Consultas integradas à linguagem em tempo de compilação para Scala

    2.166+0Variação de estrelas nos últimos 7 dias
  • spark@dotnet

    .NET for Apache® Spark™ torna o Apache Spark™ facilmente acessível para desenvolvedores .NET.

    2.096-2Variação de estrelas nos últimos 7 dias
  • gatk@broadinstitute

    Repositório oficial de código para o GATK versões 4 em diante

    1.994+1Variação de estrelas nos últimos 7 dias
  • Conector do Apache Spark para Apache Cassandra

    1.955+1Variação de estrelas nos últimos 7 dias
  • bigdata-growth@collabH

    Repositório de conhecimento de Big Data abrangendo modelagem de data warehouse, computação em tempo real, Big Data, data middle platform, design de sistemas, Java, algoritmos, etc.

    1.811+3Variação de estrelas nos últimos 7 dias
  • auron@apache

    O acelerador Auron para frameworks de computação distribuída (ex: Spark) utiliza execução vetorizada nativa para acelerar o processamento de consultas

    1.798+2Variação de estrelas nos últimos 7 dias
  • Tutorial@zhonghuasheng

    Resumo da arquitetura de conhecimento full-stack para backend (Java, Golang)

    1.768+2Variação de estrelas nos últimos 7 dias
  • .github@apachecn

    Organização de código aberto ApacheCN: anúncios, introdução, membros, atividades e canais de comunicação

    1.754+0Variação de estrelas nos últimos 7 dias
  • Mais de 2000 perguntas de entrevista para engenheiros de dados.

    1.721+5Variação de estrelas nos últimos 7 dias
  • elassandra@strapdata

    Elassandra = Elasticsearch + Apache Cassandra

    1.714+0Variação de estrelas nos últimos 7 dias
  • spark-py-notebooks@jadianes

    Tutoriais de Apache Spark e Python (pySpark) para análise de Big Data e Machine Learning em notebooks IPython / Jupyter

    1.660+0Variação de estrelas nos últimos 7 dias
  • almond@almond-sh

    Um kernel Scala para Jupyter.

    1.625+0Variação de estrelas nos últimos 7 dias
  • apache-spark-internals@japila-books

    Os fundamentos internos do Apache Spark

    1.549+0Variação de estrelas nos últimos 7 dias
  • mleap@combust

    MLeap: Implante pipelines de ML em produção

    1.544+1Variação de estrelas nos últimos 7 dias
  • optimus@hi-primus

    Fluxos de trabalho de preparação de dados ágeis facilitados com Pandas, Dask, cuDF, Dask-cuDF, Vaex e PySpark

    1.536+0Variação de estrelas nos últimos 7 dias
  • nessie@projectnessie

    Nessie: Catálogo Transacional para Data Lakes com semântica semelhante ao Git

    1.498+1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos