メインコンテンツへスキップ
buildradar
Sign in
トピック · spark

spark

spark がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
115
総スター数
480,010
平均スター数
4,174
シェア
0.02%

spark と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、spark がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • data-engineering-zoomcamp@DataTalksClub

    Data Engineering Zoomcampは、本番環境対応のデータパイプラインを構築するための無料の9週間コースです。次のコホートは2026年1月に開始します。こちらからコースに参加してください 👇🏼

    45,183+114直近 7 日のスター増減
  • spark@apache

    Apache Spark - 大規模データ処理のための統合分析エンジン

    43,943+42直近 7 日のスター増減
  • データサイエンス用Pythonノートブック:ディープラーニング (TensorFlow, Theano, Caffe, Keras)、scikit-learn、Kaggle、ビッグデータ (Spark, Hadoop MapReduce, HDFS)、matplotlib、pandas、NumPy、SciPy、Pythonの基礎、AWS、および各種コマンドライン。

    29,339+5直近 7 日のスター増減
  • redash@getredash

    貴社のデータをデータドリブンに。あらゆるデータソースに接続し、データを簡単に可視化、ダッシュボード化、共有できます。

    28,778+11直近 7 日のスター増減
  • 最新のDockerコンテナ技術を、実際の事例からベストプラクティスを学ぶ!| 実際のDevOps実践を通じて、Docker&Container技術を学習・理解

    26,231+7直近 7 日のスター増減
  • BigData-Notes@heibaiying

    大データ入門ガイド :star:

    16,962+4直近 7 日のスター増減
  • ds-cheatsheets@FavioVazquez

    世界を支配するためのデータサイエンスチートシート一覧

    16,329-1直近 7 日のスター増減
  • ChuanhuChatGPT@GaiZhenbiao

    ChatGPT APIおよび多数のLLM用のGUI。エージェント、ファイルベースのQA、GPTファインチューニング、Web検索とのクエリに対応。すべてが洗練されたUIで提供される。

    15,274-2直近 7 日のスター増減
  • flink-learning@zhisheng17

    Flink学習ブログ。http://www.54tianzhisheng.cn/ Flinkの入門、概念、原理、実践、性能チューニング、ソースコード解析などの内容を網羅しています。Flink Connector、Metrics、Library、DataStream API、Table API & SQLなどの学習事例に加え、Flinkの実装適用における大規模プロジェクト事例(PVUV、ログストレージ、百億データリアルタイム重複排除、監視アラート)も共有しています。私のコラム「ビッグデータリアルタイム計算エンジン Flink 実践と性能最適化」をぜひご覧ください。

    15,096+1直近 7 日のスター増減
  • technology-talk@aalansehaiyang

    【大手企業面接専門コラム】Javaプログラマーが必要とする技術ガイド。面接問題、システムアーキテクチャ、キャリアの秘訣、主要なミドルウェアなど、あなたをより優れた存在にするための情報を提供します!

    14,733-1直近 7 日のスター増減
  • deeplearning4j@deeplearning4j

    JVMを使用してディープラーニングモデルをデプロイおよびトレーニングするためのツールのスイート。主な機能には、keras、tensorflow、onnx/pytorch用のモデルインポート、数学コードを実行するためのモジュール式で軽量なc++ライブラリ、およびコアc++ライブラリ上に構築されたJavaベースの数学ライブラリが含まれます。また、samediffも含まれており、これはディープラーニングを実行するためのpytorch/tensorflowライクなライブラリです...

    14,248+0直近 7 日のスター増減
  • sqlglot@tobymao

    Python用SQLパーサーおよびトランスパイラ

    9,588+9直近 7 日のスター増減
  • delta@delta-io

    Spark、PrestoDB、Flink、Trino、HiveなどのコンピューティングエンジンとAPIを備えたLakehouseアーキテクチャを構築できるオープンソースのストレージフレームワーク。

    8,984+22直近 7 日のスター増減
  • mage-ai@mage-ai

    🧙 データ統合および変換のためのデータパイプラインの構築、実行、管理。

    8,818+4直近 7 日のスター増減
  • h2o-3@h2oai

    H2Oは、オープンソースで分散型、高速かつスケーラブルな機械学習プラットフォームです。ディープラーニング、Gradient Boosting (GBM) & XGBoost、Random Forest、一般化線形モデル (Elastic Net付きGLM)、K-Means、PCA、一般化加法モデル (GAM)、RuleFit、サポートベクターマシン (SVM)、スタックドアンサンブル、自動機械学習 (AutoML) など。

    7,499+3直近 7 日のスター増減
  • alluxio@Alluxio

    クラウド上での分析および機械学習のためのデータオーケストレーションツール Alluxio

    7,234+3直近 7 日のスター増減
  • angel@Angel-ML

    大規模機械学習のための柔軟かつ強力なParameter Server。

    6,788+1直近 7 日のスター増減
  • zeppelin@apache

    SQL、Scalaなどを用いたデータ駆動型でインタラクティブなデータ分析および共同ドキュメントを可能にするWebベースのノートブック。

    6,655+0直近 7 日のスター増減
  • SynapseML@microsoft

    Spark向けにMLアルゴリズムを移植した、シンプルで分散型の機械学習Pythonライブラリ。

    5,245+3直近 7 日のスター増減
  • cube-studio@tencentmusic

    cube studioは、オープンソースのクラウドネイティブなオールインワン機械学習/深層学習/大規模モデルAIプラットフォームです。MLOpsのアルゴリズムリンク全工程、コンピューティングリソースレンタルプラットフォーム、ノートブックオンライン開発、ドラッグ&ドロップによるタスクフローパイプラインオーケストレーション、マルチマシン/マルチGPU分散学習、ハイパーパラメータ探索、推論サービスVGPU仮想化、エッジコンピューティング、アノテーションプラットフォームの自動アノテーション、deepseekなどの大規模モデルのSFTファインチューニング/報酬モデル/強化学習トレーニング、vllm/ollama/mindieによる大規模モデルのマルチマシン推論、プライベートナレッジベース、AIモデルマーケットをサポートし、国産CPU/GPU/NPU(昇騰エコシステム)をサポート、RDMAをサポート、pytorch/tf/mxnet/deepspeed/paddle/colossalai/horovod/ray/volcanoなどの分散処理をサポートします。

    5,078+3直近 7 日のスター増減
  • spark-nlp@JohnSnowLabs

    最先端の自然言語処理 (State of the Art Natural Language Processing)。

    4,160+1直近 7 日のスター増減
  • HELK@Cyb3rWard0g

    The Hunting ELK

    3,931+0直近 7 日のスター増減
  • RoaringBitmap@RoaringBitmap

    Javaにおけるより優れた圧縮ビットセット: Apache Spark、Netflix Atlas、Apache Pinot、Tablesawなど、多数で使用されています

    3,921+2直近 7 日のスター増減
  • deequ@awslabs

    Deequ は Apache Spark を基盤として構築されたライブラリであり、大規模データセットのデータ品質を測定する「データの単体テスト」を定義します

    3,642+0直近 7 日のスター増減
  • JSON を使用して構造化された SQL 文を生成します。Vue3 + TypeScript + Vite + Ant Design + MonacoEditor をベースに実装されており、シンプルなプロジェクト(ロジック重視、画面は軽量)で練習用に最適です。

    3,424+0直近 7 日のスター増減
  • linkis@apache

    Apache Linkis は、上位アプリケーションと基盤データエンジンの間の接続、ガバナンス、オーケストレーションを容易にする計算ミドルウェア層を構築します

    3,409+2直近 7 日のスター増減
  • paimon@apache

    Apache Paimon は、ストリーミングとバッチ処理の両方において Flink および Spark を用いたリアルタイムレイクハウスアーキテクチャの構築を可能にするレイクフォーマットです。

    3,388+3直近 7 日のスター増減
  • koalas@databricks

    Koalas: Apache Spark上のpandas API

    3,374+1直近 7 日のスター増減
  • sail@lakehq

    Rustで書かれた Apache Spark のドロップイン代替であり、バッチ処理、ストリーム処理、および計算負荷の高いAIワークロードを統合します。

    3,341+4直近 7 日のスター増減
  • DataSphereStudio@WeBankFinTech

    DataSphereStudio は、データ交換、秘匿化/クレンジング、分析/マイニング、品質測定、可視化、タスクスケジューリングなどのシナリオをカバーする、ワンストップのデータアプリケーション開発・管理ポータルです。

    3,262-1直近 7 日のスター増減
← トピック一覧に戻る