メインコンテンツへスキップ
buildradar
Sign in
トピック · data-engineering

data-engineering

data-engineering がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

97 件のリポジトリ
  • sql-translator@whoiskatrin

    SQL Translatorは、AIを用いて自然言語のクエリをSQLコードに変換するツール。本プロジェクトは100%無料かつオープンソースです。

    4,321+0直近 7 日のスター増減
  • pandas on AWS - Athena, Glue, Redshift, Timestream, Neptune, OpenSearch, QuickSight, Chime, CloudWatchLogs, DynamoDB, EMR, SecretManager, PostgreSQL, MySQL, SQLServer, S3 (Parquet, CSV, JSON, EXCEL) との容易な統合

    4,119+0直近 7 日のスター増減
  • データエンジニアリングをゼロから学ぶための有用なリソースリスト

    4,009-2直近 7 日のスター増減
  • maestro@Netflix

    Maestro: Netflixのワークフローオーケストレーター

    3,831+0直近 7 日のスター増減
  • qsv@dathere

    超高速なデータラングリングツールキット

    3,774+4直近 7 日のスター増減
  • memphis@superstreamlabs

    Memphis.devは、スケーラビリティが高く手軽なデータストリーミングプラットフォームです

    3,440+0直近 7 日のスター増減
  • mlops-course@GokuMohandas

    本番環境グレードのMLアプリケーションの設計、開発、デプロイ、およびイテレーションの方法を学ぶ。

    3,399+2直近 7 日のスター増減
  • sail@lakehq

    Rustで書かれた Apache Spark のドロップイン代替であり、バッチ処理、ストリーム処理、および計算負荷の高いAIワークロードを統合します。

    3,341+4直近 7 日のスター増減
  • オープンソースのデータエンジニアリングプロジェクトのまとめリスト

    3,278+5直近 7 日のスター増減
  • devlake@apache

    :bar_chart: D3をベースに構築された、モジュール型のチャートコンポーネントライブラリ

    3,121+5直近 7 日のスター増減
  • second-brain-ai-assistant-course@decodingai-magazine

    LLM、エージェント、RAG、ファインチューニング、LLMOps、AIシステム技術を活用して「セカンドブレイン」AIアシスタントの構築を学ぶ。

    3,068+9直近 7 日のスター増減
  • meltano@meltano

    Meltano: データおよび ML 駆動型の製品アイデアを実現する、宣言型のコードファーストデータ統合エンジン。API 統合の記述、保守、スケーリングの手間から解放されます。

    2,616+2直近 7 日のスター増減
  • hamilton@apache

    Apache Hamiltonは、データサイエンティストやエンジニアが、テスト可能でモジュール式かつ自己文書化されたデータフローを定義するのを支援します。データ系統やメタデータを含み、Pythonが動作するすべての環境で実行・スケールします。

    2,584+1直近 7 日のスター増減
  • SAG@Zleap-AI

    RAG の新しい SOTA——人間とエージェントのための独自の検索アーキテクチャおよびオープンソースのナレッジベース。

    2,456+20直近 7 日のスター増減
  • metarank@metarank

    ユーザーエンゲージメントを向上させる、記事、リスティング、検索結果、レコメンデーション向けのローコード機械学習パーソナライズランキングサービス。使いやすいLearn-to-Rankエンジン

    2,434+0直近 7 日のスター増減
  • soda-core@sodadata

    モダンデータスタック向けのデータコントラクトエンジン。https://www.soda.io

    2,420-1直近 7 日のスター増減
  • datart@running-elephant

    Datartは次世代のデータ可視化オープンプラットフォームです

    2,303+1直近 7 日のスター増減
  • bytewax@bytewax

    Python ストリーム処理

    2,048+1直近 7 日のスター増減
  • data-engineering-wiki@data-engineering-community

    データエンジニアリングを学ぶための最適な場所。データエンジニアリングコミュニティによって構築・維持されています。

    2,021+3直近 7 日のスター増減
  • feathr@feathr-ai

    Feathr – エンタープライズ向けの拡張可能で統合されたデータおよび AI エンジニアリングプラットフォーム

    1,937+0直近 7 日のスター増減
  • awesome-dbt@Hiflylabs

    厳選された素晴らしい dbt リソースのリスト

    1,722+1直近 7 日のスター増減
  • 2000件以上のデータエンジニア面接問題。

    1,721+5直近 7 日のスター増減
  • mlrun@mlrun

    MLRunは、ライフサイクル全体を通じて継続的なMLアプリケーションを迅速に構築・管理するためのオープンソースのMLOpsプラットフォームです。開発およびCI/CD環境に統合され、本番データ、MLパイプライン、オンラインアプリケーションの配信を自動化します。

    1,694+1直近 7 日のスター増減
  • multiwoven@Multiwoven

    オープンソースの Reverse ETL。hightouch や census の代替ツール

    1,673+0直近 7 日のスター増減
  • データサイエンス、データエンジニアリング、機械学習、ディープラーニング、コンピュータサイエンス、プログラミング、ソフトウェアエンジニアリングなどの分野における 180 以上の YouTube チャンネルの包括的なリスト

    1,624+1直近 7 日のスター増減
  • nao@getnao

    👾 naoはオープンソースの分析エージェントです。(1) nao-core CLIでコンテキストを作成し、(2) 誰でも使えるnaoチャットインターフェースをデプロイします

    1,600+9直近 7 日のスター増減
  • just-dashboard@kantord

    :bar_chart: :clipboard: YAML または JSON ファイルを使用したダッシュボード

    1,582+1直近 7 日のスター増減
  • ktx@Kaelio

    ktxは、データおよび分析エージェント向けの実行可能なコンテキストレイヤーです。Claude Code、Codex、その他のAIエージェントが、企業の完全なコンテキストを把握して分析データベースを正確にクエリできるようにします。

    1,571+5直近 7 日のスター増減
  • quix-streams@quixio

    Kafka 向け Python ストリーミング DataFrame

    1,569+1直近 7 日のスター増減
  • pyper@pyper-dev

    Python の並行処理をシンプルに

    1,517-1直近 7 日のスター増減
← トピック一覧に戻る