data-engineering
data-engineering がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #31
SQL Translatorは、AIを用いて自然言語のクエリをSQLコードに変換するツール。本プロジェクトは100%無料かつオープンソースです。
★ 4,321+0直近 7 日のスター増減 - #32
pandas on AWS - Athena, Glue, Redshift, Timestream, Neptune, OpenSearch, QuickSight, Chime, CloudWatchLogs, DynamoDB, EMR, SecretManager, PostgreSQL, MySQL, SQLServer, S3 (Parquet, CSV, JSON, EXCEL) との容易な統合
★ 4,119+0直近 7 日のスター増減 - #33
データエンジニアリングをゼロから学ぶための有用なリソースリスト
★ 4,009-2直近 7 日のスター増減 - #34★ 3,831+0直近 7 日のスター増減
- #35★ 3,774+4直近 7 日のスター増減
- #36★ 3,440+0直近 7 日のスター増減
- #37
本番環境グレードのMLアプリケーションの設計、開発、デプロイ、およびイテレーションの方法を学ぶ。
★ 3,399+2直近 7 日のスター増減 - #38★ 3,341+4直近 7 日のスター増減
- #39
オープンソースのデータエンジニアリングプロジェクトのまとめリスト
★ 3,278+5直近 7 日のスター増減 - #40★ 3,121+5直近 7 日のスター増減
- #41
LLM、エージェント、RAG、ファインチューニング、LLMOps、AIシステム技術を活用して「セカンドブレイン」AIアシスタントの構築を学ぶ。
★ 3,068+9直近 7 日のスター増減 - #42
Meltano: データおよび ML 駆動型の製品アイデアを実現する、宣言型のコードファーストデータ統合エンジン。API 統合の記述、保守、スケーリングの手間から解放されます。
★ 2,616+2直近 7 日のスター増減 - #43
Apache Hamiltonは、データサイエンティストやエンジニアが、テスト可能でモジュール式かつ自己文書化されたデータフローを定義するのを支援します。データ系統やメタデータを含み、Pythonが動作するすべての環境で実行・スケールします。
★ 2,584+1直近 7 日のスター増減 - #44★ 2,456+20直近 7 日のスター増減
- #45
ユーザーエンゲージメントを向上させる、記事、リスティング、検索結果、レコメンデーション向けのローコード機械学習パーソナライズランキングサービス。使いやすいLearn-to-Rankエンジン
★ 2,434+0直近 7 日のスター増減 - #46★ 2,420-1直近 7 日のスター増減
- #47★ 2,303+1直近 7 日のスター増減
- #48★ 2,048+1直近 7 日のスター増減
- #49
データエンジニアリングを学ぶための最適な場所。データエンジニアリングコミュニティによって構築・維持されています。
★ 2,021+3直近 7 日のスター増減 - #50★ 1,937+0直近 7 日のスター増減
- #51
厳選された素晴らしい dbt リソースのリスト
★ 1,722+1直近 7 日のスター増減 - #52
2000件以上のデータエンジニア面接問題。
★ 1,721+5直近 7 日のスター増減 - #53
MLRunは、ライフサイクル全体を通じて継続的なMLアプリケーションを迅速に構築・管理するためのオープンソースのMLOpsプラットフォームです。開発およびCI/CD環境に統合され、本番データ、MLパイプライン、オンラインアプリケーションの配信を自動化します。
★ 1,694+1直近 7 日のスター増減 - #54
オープンソースの Reverse ETL。hightouch や census の代替ツール
★ 1,673+0直近 7 日のスター増減 - #55
データサイエンス、データエンジニアリング、機械学習、ディープラーニング、コンピュータサイエンス、プログラミング、ソフトウェアエンジニアリングなどの分野における 180 以上の YouTube チャンネルの包括的なリスト
★ 1,624+1直近 7 日のスター増減 - #56★ 1,600+9直近 7 日のスター増減
- #57
:bar_chart: :clipboard: YAML または JSON ファイルを使用したダッシュボード
★ 1,582+1直近 7 日のスター増減 - #58
ktxは、データおよび分析エージェント向けの実行可能なコンテキストレイヤーです。Claude Code、Codex、その他のAIエージェントが、企業の完全なコンテキストを把握して分析データベースを正確にクエリできるようにします。
★ 1,571+5直近 7 日のスター増減 - #59
Kafka 向け Python ストリーミング DataFrame
★ 1,569+1直近 7 日のスター増減 - #60★ 1,517-1直近 7 日のスター増減