メインコンテンツへスキップ
buildradar
Sign in
トピック · big-data

big-data

big-data がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

110 件のリポジトリ
  • genie@Netflix

    分散ビッグデータオーケストレーションサービス

    1,766-1直近 7 日のスター増減
  • matano@matanolabs

    AWS上でペタバイト規模の脅威ハンティング、検知・対応、サイバーセキュリティ分析を実現するオープンソースのセキュリティデータレイク。

    1,694+0直近 7 日のスター増減
  • spark-py-notebooks@jadianes

    IPython / Jupyterノートブック形式のビッグデータ分析および機械学習向けApache Spark & Python (pySpark) チュートリアル

    1,660+0直近 7 日のスター増減
  • tonbo@tonbo-io

    Tonbo は、サーバーレスおよびエッジランタイム向けの組み込みデータベースです。

    1,618+3直近 7 日のスター増減
  • just-dashboard@kantord

    :bar_chart: :clipboard: YAML または JSON ファイルを使用したダッシュボード

    1,582+1直近 7 日のスター増減
  • dremio-oss@dremio

    Dremio - モダンデータにおける失われたピース

    1,492+1直近 7 日のスター増減
  • carbondata@apache

    高性能なデータストアソリューション

    1,452+0直近 7 日のスター増減
  • avsc@mtth

    JavaScript 用の Avro :zap:

    1,384+0直近 7 日のスター増減
  • 高度で成熟したオープンソースのMPP(超規模並列処理)データベース。Greenplum Databaseのオープンソース代替品

    1,382+5直近 7 日のスター増減
  • scikit-learn-intelex@uxlfoundation

    Scikit-learn アプリケーションをシームレスに高速化する拡張機能

    1,356+0直近 7 日のスター増減
  • pyspark-tutorial@mahmoudparsian

    PySpark を使用した基本アルゴリズムを提供す PySpark-Tutorial

    1,280+0直近 7 日のスター増減
  • ozone@apache

    データ分析やオブジェクトストレージのワークロードに最適化された、スケーラブルで信頼性の高い分散ストレージシステム。

    1,270+1直近 7 日のスター増減
  • Apache Parquetファイルの閲覧とクエリを行うためのシンプルなWindowsデスクトップアプリケーション

    1,231+2直近 7 日のスター増減
  • graphframes@graphframes

    GraphFramesは、DataFrameベースのグラフ機能を提供するApache Spark用パッケージです。

    1,202+0直近 7 日のスター増減
  • amoro@apache

    Apache Amoro(incubating)は、オープンなデータレークフォーマット上に構築されたレークハウス管理システムです。

    1,171+0直近 7 日のスター増減
  • accumulo@apache

    Apache Accumulo

    1,165+2直近 7 日のスター増減
  • ClickBench@ClickHouse

    ClickBench: 分析データベース向けベンチマーク

    1,101+8直近 7 日のスター増減
  • awesome-data-catalogs@opendatadiscovery

    素晴らしいデータカタログとオブザーバビリティプラットフォームのまとめ

    1,068+5直近 7 日のスター増減
  • adam@bigdatagenomics

    Apache Avro、Apache Spark、Apache Parquet を使用して構築された特殊なファイル形式を持つ、ゲノミクス分析プラットフォーム ADAM。Apache 2 ライセンス。

    1,059+2直近 7 日のスター増減
  • MyScaleDB@myscale

    高性能なベクトル検索と全文検索をサポートする@ClickHouseのフォーク

    1,041+0直近 7 日のスター増減
  • Apache Flink Kubernetes Operator

    1,031+3直近 7 日のスター増減
  • データサイエンス、機械学習、ビッグデータ、ビジネスアナリティクスのキャリアリソースリポジトリ

    1,021+2直近 7 日のスター増減
  • listenbrainz-server@metabrainz

    ListenBrainzプロジェクト用のサーバー。配信されるフロントエンド(JavaScript/React)コードと、LBで使用されるすべてのデータ処理コンポーネントを含みます。

    1,007+4直近 7 日のスター増減
  • cudf-spark@NVIDIA

    Apache Spark用NVIDIA cuDFプラグイン - GPUでApache Sparkを高速化

    999+1直近 7 日のスター増減
  • Sparkクラスター内でH2Oの機能を提供するSparkling Water

    980+1直近 7 日のスター増減
  • delta-sharing@delta-io

    安全なデータ共有のためのオープンプロトコル

    958-1直近 7 日のスター増減
  • OnlineStats.jl@joshday

    ⚡ 統計用の1パスアルゴリズム

    897+0直近 7 日のスター増減
  • スペイン語でのデータエンジニアリングの基本概念、技術的な課題、リソースをまとめたリポジトリ 🧙✨

    896+1直近 7 日のスター増減
  • PGM-index@gvinciguerra

    従来のインデックスに比べ桁違いに少ない容量で、数十億件の配列アイテムに対する高速な検索、先行要素検索、範囲検索、更新を実現する最先端の学習済みデータ構造

    873+1直近 7 日のスター増減
  • ai_projects@miguelgfierro

    AI プロジェクト

    868+1直近 7 日のスター増減
← トピック一覧に戻る