跳到主要内容
buildradar
Sign in
主题 · synthetic-data

synthetic-data

标记 synthetic-data 主题、收录中的开源项目,按星标数排序。

项目数
35
总星标数
84,901
平均星标数
2,426
占比
0.00%

常跟 synthetic-data 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 synthetic-data 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • machine-learning-for-trading@stefan-jansen

    机器学习交易代码,第 3 版——从数据获取到实时执行

    20,762+43近 7 天星标变化
  • data-juicer@datajuicer

    为基础模型提供数据处理!🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

    6,975+26近 7 天星标变化
  • Kiln@Kiln-AI

    构建、评估与优化 AI 系统。包含评估、RAG、代理、微调、合成数据生成、数据集管理、MCP 等。

    5,042+5近 7 天星标变化
  • mimesis@lk-geimfari

    Mimesis 是一个用于生成伪造但真实资料的 Python 函式库,支持多语言与地区设置

    4,839+0近 7 天星标变化
  • BlenderProc@DLR-RM

    用于生成逼真训练图像的 Blender 程序流程管线

    3,693+5近 7 天星标变化
  • SDV@sdv-dev

    面向表格数据的合成数据生成

    3,551+0近 7 天星标变化
  • distilabel@argilla-io

    Distilabel 是一个基于已验证研究论文的合成数据与 AI 反馈框架,专为需要快速、可靠且具扩展性流水线的工程师设计。

    3,384+3近 7 天星标变化
  • pgmpy@pgmpy

    Python 因果与概率推理工具包

    3,323+2近 7 天星标变化
  • synthea@synthetichealth

    合成患者群体模拟器

    3,322+5近 7 天星标变化
  • SDG 是一个专门设计用于生成高质量结构化表格数据的框架。

    2,436+1近 7 天星标变化
  • unrealcv@unrealcv

    UnrealCV:将计算机视觉连接到 Unreal Engine

    2,209+0近 7 天星标变化
  • DataDesigner@NVIDIA-NeMo

    🎨 NeMo Data Designer:从头开始或从种子数据生成高质量的合成数据。

    2,197+7近 7 天星标变化
  • greenmask@GreenmaskIO

    数据库匿名化与测试数据管理

    1,757+4近 7 天星标变化
  • curator@bespokelabsai

    用于后训练与结构化数据提取的合成数据策展

    1,722+2近 7 天星标变化
  • fg-data-synthetic@Data-Centric-AI-Community

    用于表格与时间序列数据的合成数据生成器

    1,654+0近 7 天星标变化
  • aisheets@huggingface

    使用 AI 模型构建、丰富与转换数据集,全程无需代码

    1,641-1近 7 天星标变化
  • CTGAN@sdv-dev

    用于生成综合表格数据的条件式 GAN。

    1,565+3近 7 天星标变化
  • synth@shuttle-hq

    声明式数据生成器

    1,484+0近 7 天星标变化
  • intellagent@plurai-ai

    使用模拟、逼真合成互动来全面诊断与优化 agent 的框架

    1,257+0近 7 天星标变化
  • DataDreamer@datadreamer-dev

    DataDreamer:提示、生成合成数据、训练与对齐模型。

    1,117+0近 7 天星标变化
  • synthadoc@axoviq-ai

    Synthadoc:一个开源的 LLM 知识编译引擎,可将原始文件转换为结构化的本地优先 Wiki。这是传统 RAG 的透明且人类可读的替代方案,无需使用任何工具即可进行自我管理与自我改进。

    1,116+2近 7 天星标变化
  • deepfabric@nolabs-ai

    在单一管线中生成高质量合成数据、训练、测量与评估

    885+3近 7 天星标变化
  • magpie@magpie-align

    [ICLR 2025] 通过提示已对齐的 LLMs 从零开始进行对齐数据合成。您的高效且高质量合成数据生成管线!

    881+2近 7 天星标变化
  • bonito@BatsResearch

    一个无需 GPT 即可为您的数据生成合成指令微调数据集的轻量级库。

    829+0近 7 天星标变化
  • verbalized-sampling@CHATS-lab

    言语化采样 (Verbalized Sampling) 是一种免训练的提示策略,通过要求附带概率的响应来缓解 LLM 中的模式崩溃。在维持质量的同时实现 2-3 倍的多样性提升。具备 CLI/API 的模型无关框架,适用于创意写作、合成数据生成与对话模拟。

    803+1近 7 天星标变化
  • mostlyai@mostly-ai

    合成数据 SDK ✨

    798+5近 7 天星标变化
  • mamma@cuevhv

    MAMMA 的官方代码:无标记精确多人动作捕获。

    797+10近 7 天星标变化
  • pygraft@nicolas-hbt

    随手可得的合成架构与知识图谱可配置生成工具

    715+1近 7 天星标变化
  • synthcity@vanderschaarlab

    用于生成与评估合成表格数据以确保隐私、公平性及进行数据增强的库。

    681+4近 7 天星标变化
  • Copulas@sdv-dev

    使用 Copula 模型化多变量资料的函式库

    652+0近 7 天星标变化
← 返回主题列表