メインコンテンツへスキップ
buildradar
Sign in
トピック · pyspark

pyspark

pyspark がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
23
総スター数
43,799
平均スター数
1,904
シェア
0.00%

pyspark と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、pyspark がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • ibis@ibis-project

    ポータブルなPythonデータフレームライブラリ

    6,650+1直近 7 日のスター増減
  • SynapseML@microsoft

    Spark向けにMLアルゴリズムを移植した、シンプルで分散型の機械学習Pythonライブラリ。

    5,245+3直近 7 日のスター増減
  • spark-nlp@JohnSnowLabs

    最先端の自然言語処理 (State of the Art Natural Language Processing)。

    4,160+1直近 7 日のスター増減
  • linkis@apache

    Apache Linkis は、上位アプリケーションと基盤データエンジンの間の接続、ガバナンス、オーケストレーションを容易にする計算ミドルウェア層を構築します

    3,409+2直近 7 日のスター増減
  • sail@lakehq

    Rustで書かれた Apache Spark のドロップイン代替であり、バッチ処理、ストリーム処理、および計算負荷の高いAIワークロードを統合します。

    3,341+4直近 7 日のスター増減
  • awesome-spark@awesome-spark

    Apache Spark の優れたパッケージとリソースのキュレーションリスト。

    1,893+0直近 7 日のスター増減
  • petastorm@uber

    Petastorm ライブラリを使用すると、Apache Parquet 形式のデータセットからディープラーニングモデルの単一マシンまたは分散トレーニングと評価を行うことができます。Tensorflow、Pytorch、PySpark などの ML フレームワークをサポートし、純粋な Python コードから使用できます。

    1,892+0直近 7 日のスター増減
  • narwhals@narwhals-dev

    データフレームライブラリ間の軽量で拡張可能な互換レイヤー

    1,714+4直近 7 日のスター増減
  • spark-py-notebooks@jadianes

    IPython / Jupyterノートブック形式のビッグデータ分析および機械学習向けApache Spark & Python (pySpark) チュートリアル

    1,660+0直近 7 日のスター増減
  • optimus@hi-primus

    :truck: Pandas、Dask、cuDF、Dask-cuDF、Vaex、PySpark を使ったアジャイルなデータ前処理ワークフローを簡単に実現

    1,536+0直近 7 日のスター増減
  • sparkmagic@jupyter-incubator

    リモートのSparkクラスターを操作するためのJupyterマジックおよびカーネル

    1,365-1直近 7 日のスター増減
  • hopsworks@logicalclocks

    Hopsworks - Feature Store を備えたデータ密集型 AI プラットフォーム

    1,304+1直近 7 日のスター増減
  • pyspark-tutorial@mahmoudparsian

    PySpark を使用した基本アルゴリズムを提供す PySpark-Tutorial

    1,280+0直近 7 日のスター増減
  • graphframes@graphframes

    GraphFramesは、DataFrameベースのグラフ機能を提供するApache Spark用パッケージです。

    1,202+0直近 7 日のスター増減
  • data-algorithms-book@mahmoudparsian

    Data Algorithms ブック向けの MapReduce、Spark、Java、Scala のコード集。

    1,080-2直近 7 日のスター増減
  • Sparkクラスター内でH2Oの機能を提供するSparkling Water

    980+1直近 7 日のスター増減
  • DevOps-Python-tools@HariSekhon

    80以上のDevOpsおよびデータCLIツール - AWS、GCP、GCF Python Cloud Functions、ログ匿名化ツール、Spark、Hadoop、HBase、Hive、Impala、Linux、Docker、Sparkデータコンバーターおよびバリデーター(Avro/Parquet/JSON/CSV/INI/XML/YAML)、Travis CI、AWS CloudFormation、Elasticsearch、Solrなど

    824+0直近 7 日のスター増減
  • koheesio@Nike-Inc

    効率的なデータパイプラインを構築するためのPythonフレームワーク。モジュール性とコラボレーションを促進し、シンプルで再利用可能なコンポーネントから複雑なパイプラインの作成を可能にします。

    818+0直近 7 日のスター増減
  • Scriptis@WeBankFinTech

    Scriptis は、スクリプト開発(SQL、Pyspark、HiveQL)、タスク送信(Spark、Hive)、UDF、関数、リソース管理、およびインテリジェント診断を行うためのインタラクティブなデータ分析ツールです。

    814+0直近 7 日のスター増減
  • chispa@MrPowers

    分かりやすいエラーメッセージを備えた PySpark テストヘルパーメソッド

    772-1直近 7 日のスター増減
  • quinn@mrpowers-io

    開発者の生産性を向上させるためのpysparkメソッド 📣 👯 🎉

    689+0直近 7 日のスター増減
  • datacompy@capitalone

    Pandas、Polars、Spark、SnowparkのDataFrameを人間味をもって比較するツールなど!

    658+0直近 7 日のスター増減
  • spark-standalone-cluster-on-docker@cluster-apps-on-docker

    Docker上のJupyterLabインターフェースを使用して独自のクラスターを構築し、Scala、Python (PySpark)、R (SparkR) で Apache Spark を学ぶ :zap:

    512+0直近 7 日のスター増減
← トピック一覧に戻る