跳到主要内容
buildradar
登录
主题 · spark

spark

标记 spark 主题、收录中的开源项目,按星标数排序。

共 115 个项目
  • LakeSoul@lakesoul-io

    LakeSoul 是一个端到端、实时、云原生 Lakehouse 框架,支持快速数据输入、并发更新、增量分析、多模态数据处理与向量搜索,推动下一代 BI 与 AI 工作负载。

    3,249+0近 7 天星标变化
  • BigDataGuide@MoRan1607

    大数据学习,从零开始学习大数据,包含大数据学习各阶段学习视频、面试资料

    3,224+0近 7 天星标变化
  • spark-operator@kubeflow

    Kubernetes operator,用于管理在 Kubernetes 上运行的 Apache Spark 应用生命周期

    3,150+0近 7 天星标变化
  • spark-jobserver@spark-jobserver

    用于 Apache Spark 的 REST 作业服务器

    2,836+0近 7 天星标变化
  • lucebox@Luce-Org

    适用于消费级与异构硬件的 LLM 推测式推理服务器

    2,829+0近 7 天星标变化
  • spring-boot-quick@vector4wang

    基于 Spring Boot 的快速学习示例,整合自己遇到的开源框架,如:RabbitMQ(延迟队列)、Kafka、JPA、Redis、OAuth2、Swagger、JSP、Docker、K3s、K3d、K8s、MyBatis 加解密插件、异常处理、日志输出、多模块开发、多环境打包、缓存 Cache、爬虫、JWT、GraphQL、Dubbo、ZooKeeper 与 Async 等。

    2,787+0近 7 天星标变化
  • SZT-bigdata@geekyouth

    深圳地铁大数据客流分析系统🚇🚄🌟

    2,475+0近 7 天星标变化
  • Spark@XZB-1248

    ✨ Spark 是一个用 Go 编写的、基于网页的、跨平台的且功能齐全的远程管理工具(RAT),可让你随时随地控制所有设备。

    2,386+0近 7 天星标变化
  • splink@moj-analytical-services

    快速、准确且可扩展的概率式数据链接,支持多种 SQL 后端

    2,375+0近 7 天星标变化
  • kyuubi@apache

    Apache Kyuubi 是一个分布式且具备多租户的网关,可在数据仓库与数据湖仓上提供无服务器 SQL 服务。

    2,364+0近 7 天星标变化
  • TransmogrifAI@salesforce

    TransmogrifAI 是一套 AutoML 库,用于在 Apache Spark 上构建模块化、可重复使用、强类型的机器学习工作流程,并将其手动调整降至最低

    2,277+0近 7 天星标变化
  • ytsaurus@ytsaurus

    YTsaurus 是一个可扩展且具容错能力的开源大数据平台。

    2,203+0近 7 天星标变化
  • 处理 DJI 产品固件的工具,专注于四轴飞行器。

    2,193+0近 7 天星标变化
  • fugue@fugue-project

    分布式计算的统一接口。Fugue 可以在 Spark、Dask 和 Ray 上执行 SQL、Python、Pandas 和 Polars 代码而无需重写。

    2,170+0近 7 天星标变化
  • zio-quill@zio

    适用于 Scala 的编译期语言集成查询

    2,166+0近 7 天星标变化
  • spark@dotnet

    .NET for Apache® Spark™ 让 .NET 开发者能够轻松使用 Apache Spark™。

    2,096+0近 7 天星标变化
  • gatk@broadinstitute

    GATK 4 及以上版本的官方代码库

    1,994+0近 7 天星标变化
  • Apache Spark 到 Apache Cassandra 的连接器

    1,955+0近 7 天星标变化
  • bigdata-growth@collabH

    大数据知识仓库涉及到数据仓库建模、实时计算、大数据、数据中台、系统设计、Java、算法等。

    1,811+0近 7 天星标变化
  • auron@apache

    用于分布式计算框架(如 Spark)的 Auron 加速器,利用原生向量化执行来加速查询处理

    1,798+0近 7 天星标变化
  • Tutorial@zhonghuasheng

    后端(Java Golang)全栈知识架构体系总结

    1,768+0近 7 天星标变化
  • .github@apachecn

    ApacheCN 开源组织:公告、介绍、成员、活动、交流方式

    1,754+0近 7 天星标变化
  • 超过 2000+ 道的数据工程师面试题

    1,721+0近 7 天星标变化
  • elassandra@strapdata

    Elassandra = Elasticsearch + Apache Cassandra

    1,714+0近 7 天星标变化
  • spark-py-notebooks@jadianes

    作为 IPython / Jupyter 笔记本的大数据分析与机器学习 Apache Spark & Python (pySpark) 教程

    1,660+0近 7 天星标变化
  • almond@almond-sh

    适用于 Jupyter 的 Scala 内核

    1,625+0近 7 天星标变化
  • apache-spark-internals@japila-books

    Apache Spark 内幕解析

    1,549+0近 7 天星标变化
  • mleap@combust

    MLeap:将 ML Pipelines 部署至生产环境

    1,544+0近 7 天星标变化
  • optimus@hi-primus

    :truck: 通过 Pandas、Dask、cuDF、Dask-cuDF、Vaex 和 PySpark 轻松实现敏捷数据准备工作流程。

    1,536+0近 7 天星标变化
  • nessie@projectnessie

    Nessie:具备 Git 语义的事务性数据湖目录

    1,498+0近 7 天星标变化
← 返回主题列表