メインコンテンツへスキップ
buildradar
Sign in
トピック · data-pipelines

data-pipelines

data-pipelines がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
25
総スター数
221,273
平均スター数
8,851
シェア
0.01%

data-pipelines と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、data-pipelines がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • pathway@pathwaycom

    ストリーム処理、リアルタイム分析、LLMパイプライン、RAGのためのPython ETLフレームワーク

    62,348-17直近 7 日のスター増減
  • airflow@apache

    Apache Airflow - ワークフローをプログラム的に作成、スケジューリング、監視するためのプラットフォーム

    46,701+63直近 7 日のスター増減
  • dagster@dagster-io

    データアセットの開発、本番運用、監視のためのオーケストレーションプラットフォーム

    16,092+19直近 7 日のスター増減
  • unstructured@Unstructured-IO

    ドキュメントを簡単に構造化データに変換。Unstructuredは、複雑なドキュメントを言語モデル向けのクリーンで構造化された形式に変換するためのオープンソースETLソリューションです。エンタープライズグレードのPlatform製品について、ウェブサイトで本番グレードのワークフロー、パーティショニング、エンリッチメント、チャンキング、埋め込みについて詳しくご覧ください。

    15,381+19直近 7 日のスター増減
  • Apache DolphinSchedulerはモダンなデータオーケストレーションプラットフォーム。ローコードで高性能なワークフローを構築可能。

    14,456+1直近 7 日のスター増減
  • kedro@kedro-org

    Kedroは本番環境対応のデータサイエンスのためのツールボックスです。ソフトウェアエンジニアリングのベストプラクティスを活用し、再現性、保守性、モジュール性のあるデータエンジニアリングおよびデータサイエンスパイプラインの作成を支援します。

    10,989+14直近 7 日のスター増減
  • mage-ai@mage-ai

    🧙 データ統合および変換のためのデータパイプラインの構築、実行、管理。

    8,818+4直近 7 日のスター増減
  • DataFlow@OpenDCAI

    最新のLLMsベースのオペレーターとパイプラインによる簡単なデータ準備。

    7,893+68直近 7 日のスター増減
  • fluvio@fluvio-community

    🦀 イベントストリーム処理。開発者が動的なデータを収集・変換し、応答性の高いデータ集約型アプリケーションを駆動させるためのもの。

    5,248-1直近 7 日のスター増減
  • preswald@StructuredLabs

    Preswaldは、Pythonベースのインタラクティブデータアプリ向けのWASMパッカーです。Pyodide、DuckDB、Pandas、Plotly、Matplotlibなどを使用して、特に可視化を含む複雑なデータワークフロー全体を単一ファイルにバンドルし、完全にブラウザ内で実行可能にします。オフラインで動作し、高速にロードされ、ドキュメントのように共有できるダッシュボード、レポート、ノートブックを構築できます。

    4,276-2直近 7 日のスター増減
  • docetl@ucbepic

    エージェンティックLLMを活用したデータ処理およびETLのためのシステム

    4,074+34直近 7 日のスター増減
  • maestro@Netflix

    Maestro: Netflixのワークフローオーケストレーター

    3,831+0直近 7 日のスター増減
  • meltano@meltano

    Meltano: データおよび ML 駆動型の製品アイデアを実現する、宣言型のコードファーストデータ統合エンジン。API 統合の記述、保守、スケーリングの手間から解放されます。

    2,616+2直近 7 日のスター増減
  • elementary@elementary-data

    データおよびアナリティクスエンジニア向けの dbt ネイティブなデータ可観測性ソリューション。数分でデータパイプラインを監視できます。プレミアム機能を備えたセルフホストまたはクラウドサービスとして利用可能です。

    2,405+4直近 7 日のスター増減
  • feldera@feldera

    Felderaインクリメンタル計算エンジン

    2,076+8直近 7 日のスター増減
  • data-engineering-wiki@data-engineering-community

    データエンジニアリングを学ぶための最適な場所。データエンジニアリングコミュニティによって構築・維持されています。

    2,021+3直近 7 日のスター増減
  • extractous@yobix-ai

    高速で効率的な非構造化データ抽出。Rustで記述され、多くの言語向けのバインディングを備えています。

    1,772+0直近 7 日のスター増減
  • bruin@bruin-data

    SQLとPythonでデータパイプラインを構築し、さまざまなソースからデータを取り込み、品質チェックを追加し、エンドツーエンドのフローを構築する

    1,683+4直近 7 日のスター増減
  • mleap@combust

    MLeap:ML パイプラインを本番環境にデプロイする

    1,544+1直近 7 日のスター増減
  • pyper@pyper-dev

    Python の並行処理をシンプルに

    1,517-1直近 7 日のスター増減
  • odd-platform@opendatadiscovery

    初のオープンソースデータディスカバリーおよび観測可能性プラットフォーム。データ実務者の作業を簡素化し、ビジネスに集中できるようにします。

    1,427+1直近 7 日のスター増減
  • mlops-python-package@fmind

    MLOpsの取り組みやデータパイプラインを迅速に開始し標準化するための、包括的なPythonパッケージテンプレート

    1,416+0直近 7 日のスター増減
  • amphi-etl@amphi-ai

    Pythonを基盤としたビジュアルデータ前処理ツール

    1,401+0直近 7 日のスター増減
  • optimus@raystack

    Optimusは、データ変換、データモデリング、パイプライン、データ品質管理のための、使いやすく信頼性の高い高性能なワークフローオーケストレーターです。

    766+2直近 7 日のスター増減
  • dbt-data-reliability@elementary-data

    この dbt パッケージは、メタデータ、成果物、テスト結果を収集し、異常検知、データ品質の監視、メタデータテーブルの構築を可能にします。Elementary OSS を駆動し、Elementary Cloud の完全な Data & AI Control Plane で使用される広範なコンテキストレイヤーを提供します。

    523+0直近 7 日のスター増減
← トピック一覧に戻る