spark
spark がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
spark と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、spark がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1
Data Engineering Zoomcampは、本番環境対応のデータパイプラインを構築するための無料の9週間コースです。次のコホートは2026年1月に開始します。こちらからコースに参加してください 👇🏼
★ 45,183+114直近 7 日のスター増減 - #2★ 43,943+42直近 7 日のスター増減
- #3
データサイエンス用Pythonノートブック:ディープラーニング (TensorFlow, Theano, Caffe, Keras)、scikit-learn、Kaggle、ビッグデータ (Spark, Hadoop MapReduce, HDFS)、matplotlib、pandas、NumPy、SciPy、Pythonの基礎、AWS、および各種コマンドライン。
★ 29,339+5直近 7 日のスター増減 - #4★ 28,778+11直近 7 日のスター増減
- #5
最新のDockerコンテナ技術を、実際の事例からベストプラクティスを学ぶ!| 実際のDevOps実践を通じて、Docker&Container技術を学習・理解
★ 26,231+7直近 7 日のスター増減 - #6
大データ入門ガイド :star:
★ 16,962+4直近 7 日のスター増減 - #7
世界を支配するためのデータサイエンスチートシート一覧
★ 16,329-1直近 7 日のスター増減 - #8
ChatGPT APIおよび多数のLLM用のGUI。エージェント、ファイルベースのQA、GPTファインチューニング、Web検索とのクエリに対応。すべてが洗練されたUIで提供される。
★ 15,274-2直近 7 日のスター増減 - #9
Flink学習ブログ。http://www.54tianzhisheng.cn/ Flinkの入門、概念、原理、実践、性能チューニング、ソースコード解析などの内容を網羅しています。Flink Connector、Metrics、Library、DataStream API、Table API & SQLなどの学習事例に加え、Flinkの実装適用における大規模プロジェクト事例(PVUV、ログストレージ、百億データリアルタイム重複排除、監視アラート)も共有しています。私のコラム「ビッグデータリアルタイム計算エンジン Flink 実践と性能最適化」をぜひご覧ください。
★ 15,096+1直近 7 日のスター増減 - #10
【大手企業面接専門コラム】Javaプログラマーが必要とする技術ガイド。面接問題、システムアーキテクチャ、キャリアの秘訣、主要なミドルウェアなど、あなたをより優れた存在にするための情報を提供します!
★ 14,733-1直近 7 日のスター増減 - #11
JVMを使用してディープラーニングモデルをデプロイおよびトレーニングするためのツールのスイート。主な機能には、keras、tensorflow、onnx/pytorch用のモデルインポート、数学コードを実行するためのモジュール式で軽量なc++ライブラリ、およびコアc++ライブラリ上に構築されたJavaベースの数学ライブラリが含まれます。また、samediffも含まれており、これはディープラーニングを実行するためのpytorch/tensorflowライクなライブラリです...
★ 14,248+0直近 7 日のスター増減 - #12★ 9,588+9直近 7 日のスター増減
- #13
Spark、PrestoDB、Flink、Trino、HiveなどのコンピューティングエンジンとAPIを備えたLakehouseアーキテクチャを構築できるオープンソースのストレージフレームワーク。
★ 8,984+22直近 7 日のスター増減 - #14★ 8,818+4直近 7 日のスター増減
- #15
H2Oは、オープンソースで分散型、高速かつスケーラブルな機械学習プラットフォームです。ディープラーニング、Gradient Boosting (GBM) & XGBoost、Random Forest、一般化線形モデル (Elastic Net付きGLM)、K-Means、PCA、一般化加法モデル (GAM)、RuleFit、サポートベクターマシン (SVM)、スタックドアンサンブル、自動機械学習 (AutoML) など。
★ 7,499+3直近 7 日のスター増減 - #16★ 7,234+3直近 7 日のスター増減
- #17★ 6,788+1直近 7 日のスター増減
- #18★ 6,655+0直近 7 日のスター増減
- #19★ 5,245+3直近 7 日のスター増減
- #20
cube studioは、オープンソースのクラウドネイティブなオールインワン機械学習/深層学習/大規模モデルAIプラットフォームです。MLOpsのアルゴリズムリンク全工程、コンピューティングリソースレンタルプラットフォーム、ノートブックオンライン開発、ドラッグ&ドロップによるタスクフローパイプラインオーケストレーション、マルチマシン/マルチGPU分散学習、ハイパーパラメータ探索、推論サービスVGPU仮想化、エッジコンピューティング、アノテーションプラットフォームの自動アノテーション、deepseekなどの大規模モデルのSFTファインチューニング/報酬モデル/強化学習トレーニング、vllm/ollama/mindieによる大規模モデルのマルチマシン推論、プライベートナレッジベース、AIモデルマーケットをサポートし、国産CPU/GPU/NPU(昇騰エコシステム)をサポート、RDMAをサポート、pytorch/tf/mxnet/deepspeed/paddle/colossalai/horovod/ray/volcanoなどの分散処理をサポートします。
★ 5,078+3直近 7 日のスター増減 - #21★ 4,160+1直近 7 日のスター増減
- #22★ 3,931+0直近 7 日のスター増減
- #23
Javaにおけるより優れた圧縮ビットセット: Apache Spark、Netflix Atlas、Apache Pinot、Tablesawなど、多数で使用されています
★ 3,921+2直近 7 日のスター増減 - #24★ 3,642+0直近 7 日のスター増減
- #25
JSON を使用して構造化された SQL 文を生成します。Vue3 + TypeScript + Vite + Ant Design + MonacoEditor をベースに実装されており、シンプルなプロジェクト(ロジック重視、画面は軽量)で練習用に最適です。
★ 3,424+0直近 7 日のスター増減 - #26★ 3,409+2直近 7 日のスター増減
- #27
Apache Paimon は、ストリーミングとバッチ処理の両方において Flink および Spark を用いたリアルタイムレイクハウスアーキテクチャの構築を可能にするレイクフォーマットです。
★ 3,388+3直近 7 日のスター増減 - #28★ 3,374+1直近 7 日のスター増減
- #29★ 3,341+4直近 7 日のスター増減
- #30
DataSphereStudio は、データ交換、秘匿化/クレンジング、分析/マイニング、品質測定、可視化、タスクスケジューリングなどのシナリオをカバーする、ワンストップのデータアプリケーション開発・管理ポータルです。
★ 3,262-1直近 7 日のスター増減