メインコンテンツへスキップ
buildradar
Sign in
トピック · synthetic-data

synthetic-data

synthetic-data がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
35
総スター数
84,901
平均スター数
2,426
シェア
0.00%

synthetic-data と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、synthetic-data がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • machine-learning-for-trading@stefan-jansen

    トレーディングのための機械学習コード、第3版 — データソースの確保からライブ実行まで。

    20,762+43直近 7 日のスター増減
  • data-juicer@datajuicer

    基盤モデルのための、そして基盤モデルを使ったデータ処理! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

    6,975+26直近 7 日のスター増減
  • Kiln@Kiln-AI

    AIシステムの構築、評価、最適化。evals、RAG、エージェント、ファインチューニング、合成データ生成、データセット管理、MCPなどを含む。

    5,042+5直近 7 日のスター増減
  • mimesis@lk-geimfari

    Mimesisは、複数の言語やロケールで偽物だが現実的なデータを生成するためのPythonライブラリ

    4,839+0直近 7 日のスター増減
  • BlenderProc@DLR-RM

    フォトリアルな学習用画像生成のための、Blenderプロシージャルパイプライン

    3,693+5直近 7 日のスター増減
  • SDV@sdv-dev

    表形式データのための合成データ生成

    3,551+0直近 7 日のスター増減
  • distilabel@argilla-io

    Distilabel は、検証済みの研究論文に基づいた高速、信頼性、拡張性のあるパイプラインを必要とするエンジニア向けの、合成データおよび AI フィードバック用フレームワークです。

    3,384+3直近 7 日のスター増減
  • pgmpy@pgmpy

    因果推論および確率的推論のためのPythonツールキット

    3,323+2直近 7 日のスター増減
  • synthea@synthetichealth

    合成患者集団シミュレーター

    3,322+5直近 7 日のスター増減
  • SDGは、高品質な構造化表データ生成のために設計された特化型フレームワークです。

    2,436+1直近 7 日のスター増減
  • unrealcv@unrealcv

    UnrealCV: コンピュービジョンを Unreal Engine に接続する

    2,209+0直近 7 日のスター増減
  • DataDesigner@NVIDIA-NeMo

    🎨 NeMo Data Designer: スクラッチまたはシードデータから高品質な合成データを生成する。

    2,197+7直近 7 日のスター増減
  • greenmask@GreenmaskIO

    データベースの匿名化とテストデータ管理

    1,757+4直近 7 日のスター増減
  • curator@bespokelabsai

    事後学習および構造化データ抽出のための合成データキュレーション。

    1,722+2直近 7 日のスター増減
  • fg-data-synthetic@Data-Centric-AI-Community

    表形式データおよび時系列データ向けの合成データジェネレーター

    1,654+0直近 7 日のスター増減
  • aisheets@huggingface

    ノーコードで AI モデルを使用してデータセットを構築、拡張、変換

    1,641-1直近 7 日のスター増減
  • CTGAN@sdv-dev

    合成表形式データを生成するための条件付き GAN

    1,565+3直近 7 日のスター増減
  • synth@shuttle-hq

    宣言型データジェネレーター

    1,484+0直近 7 日のスター増減
  • intellagent@plurai-ai

    シミュレーションされた現実的な合成インタラクションを使用して、エージェントの包括的な診断と最適化を行うためのフレームワーク。

    1,257+0直近 7 日のスター増減
  • DataDreamer@datadreamer-dev

    DataDreamer: プロンプト。合成データの生成。モデルのトレーニングとアライメント。

    1,117+0直近 7 日のスター増減
  • synthadoc@axoviq-ai

    Synthadoc: 生ドキュメントを構造化されたローカルファーストのWikiに変換するオープンソースのLLM知識コンパイルエンジン。ツールを使用せずに自己管理および自己改善が可能な、従来のRAGに代わる透明性が高く人間が読める代替手段。

    1,116+2直近 7 日のスター増減
  • deepfabric@nolabs-ai

    単一のパイプラインで高品質な合成データの生成、トレーニング、測定、評価を行う

    885+3直近 7 日のスター増減
  • magpie@magpie-align

    [ICLR 2025] アライメント済み LLM に何も与えずにプロンプティングすることによる、ゼロからのアライメントデータ合成。効率的で高品質な合成データ生成パイプライン!

    881+2直近 7 日のスター増減
  • bonito@BatsResearch

    GPT を使用せずにデータ用の合成指示チューニングデータセットを生成するための軽量ライブラリ

    829+0直近 7 日のスター増減
  • verbalized-sampling@CHATS-lab

    確率付きの応答を要求することで LLM のモード崩壊を軽減する、トレーニング不要のプロンプティング戦略「Verbalized Sampling」。品質を維持しながら多様性を 2〜3 倍に向上させます。クリエイティブライティング、合成データ生成、対話シミュレーション向けの CLI/API を備えたモデル非依存のフレームワーク。

    803+1直近 7 日のスター増減
  • mostlyai@mostly-ai

    合成データSDK ✨

    798+5直近 7 日のスター増減
  • mamma@cuevhv

    MAMMA の公式コード: マーカーレスで高精度な多人数モーションキャプチャ

    795+8直近 7 日のスター増減
  • pygraft@nicolas-hbt

    手元で簡単に設定可能な、合成スキーマとナレッジグラフの生成ツール

    715+1直近 7 日のスター増減
  • synthcity@vanderschaarlab

    プライバシー、公平性、データ拡張のための合成表形式データを生成および評価するライブラリ。

    681+4直近 7 日のスター増減
  • Copulas@sdv-dev

    コピュラを使用して多変量データをモデリングするライブラリ

    652+0直近 7 日のスター増減
← トピック一覧に戻る