跳到主要內容
buildradar
Sign in
主題 · synthetic-data

synthetic-data

標記 synthetic-data 主題、收錄中的開源專案,依星數排序。

專案數
35
總星數
84,901
平均星數
2,426
佔比
0.00%

常跟 synthetic-data 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 synthetic-data 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • machine-learning-for-trading@stefan-jansen

    機器學習交易程式碼,第 3 版——從資料取得到即時執行

    20,762+43近 7 天星數變化
  • data-juicer@datajuicer

    為基礎模型提供資料處理!🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

    6,975+26近 7 天星數變化
  • Kiln@Kiln-AI

    構建、評估與優化 AI 系統。包含評估、RAG、代理、微調、合成數據生成、資料集管理、MCP 等。

    5,042+5近 7 天星數變化
  • mimesis@lk-geimfari

    Mimesis 是一個用於產生偽造但真實資料的 Python 函式庫,支援多語言與地區設定

    4,839+0近 7 天星數變化
  • BlenderProc@DLR-RM

    用於生成逼真訓練圖像的 Blender 程式流程管線

    3,693+5近 7 天星數變化
  • SDV@sdv-dev

    面向表格数据的合成数据生成

    3,551+0近 7 天星數變化
  • distilabel@argilla-io

    Distilabel 是一個基於已驗證研究論文的合成數據與 AI 回饋框架,專為需要快速、可靠且具擴充性管線的工程師設計。

    3,384+3近 7 天星數變化
  • pgmpy@pgmpy

    Python 因果與概率推理工具包

    3,323+2近 7 天星數變化
  • synthea@synthetichealth

    合成患者群體模擬器

    3,322+5近 7 天星數變化
  • SDG 是一個專門設計用於產生高品質結構化表格資料的框架。

    2,436+1近 7 天星數變化
  • unrealcv@unrealcv

    UnrealCV:將電腦視覺連接到 Unreal Engine

    2,209+0近 7 天星數變化
  • DataDesigner@NVIDIA-NeMo

    🎨 NeMo Data Designer:從頭開始或從種子資料生成高品質的合成資料。

    2,197+7近 7 天星數變化
  • greenmask@GreenmaskIO

    資料庫匿名化與測試資料管理

    1,757+4近 7 天星數變化
  • curator@bespokelabsai

    用於後訓練與結構化資料萃取的合成資料策展

    1,722+2近 7 天星數變化
  • fg-data-synthetic@Data-Centric-AI-Community

    用於表格與時間序列資料的合成資料生成器

    1,654+0近 7 天星數變化
  • aisheets@huggingface

    使用 AI 模型建構、豐富與轉換資料集,全程無需程式碼

    1,641-1近 7 天星數變化
  • CTGAN@sdv-dev

    用於生成綜合表格資料的條件式 GAN。

    1,565+3近 7 天星數變化
  • synth@shuttle-hq

    宣告式資料產生器

    1,484+0近 7 天星數變化
  • intellagent@plurai-ai

    使用模擬、逼真合成互動來全面診斷與最佳化 agent 的框架

    1,257+0近 7 天星數變化
  • DataDreamer@datadreamer-dev

    DataDreamer:提示、生成合成資料、訓練與對齊模型。

    1,117+0近 7 天星數變化
  • synthadoc@axoviq-ai

    Synthadoc:一個開源的 LLM 知識編譯引擎,可將原始文件轉換為結構化的本地優先 Wiki。這是傳統 RAG 的透明且人類可讀的替代方案,無需使用任何工具即可進行自我管理與自我改進。

    1,116+2近 7 天星數變化
  • deepfabric@nolabs-ai

    在單一管線中生成高品質合成資料、訓練、測量與評估

    885+3近 7 天星數變化
  • magpie@magpie-align

    [ICLR 2025] 透過提示已對齊的 LLMs 從零開始進行對齊資料合成。您的高效且高品質合成資料生成管線!

    881+2近 7 天星數變化
  • bonito@BatsResearch

    一個無需 GPT 即可為您的資料產生合成指令微調資料集的輕量級函式庫。

    829+0近 7 天星數變化
  • verbalized-sampling@CHATS-lab

    言語化取樣 (Verbalized Sampling) 是一種免訓練的提示策略,透過要求附帶機率的回應來緩解 LLM 中的模式崩潰。在維持品質的同時實現 2-3 倍的多樣性提升。具備 CLI/API 的模型無關框架,適用於創意寫作、合成資料生成與對話模擬。

    803+1近 7 天星數變化
  • mostlyai@mostly-ai

    合成資料 SDK ✨

    798+5近 7 天星數變化
  • mamma@cuevhv

    MAMMA 的官方程式碼:無標記精確多人動作擷取。

    797+8近 7 天星數變化
  • pygraft@nicolas-hbt

    隨手可得的合成綱要與知識圖譜可配置生成工具

    715+1近 7 天星數變化
  • synthcity@vanderschaarlab

    用於生成與評估合成表格資料以確保隱私、公平性及進行資料增強的程式庫。

    681+4近 7 天星數變化
  • Copulas@sdv-dev

    使用 Copula 模型化多變量資料的函式庫

    652+0近 7 天星數變化
← 返回主題列表