主题 · synthetic-data
synthetic-data
标记 synthetic-data 主题、收录中的开源项目,按星标数排序。
项目数
35
总星标数
84,901
平均星标数
2,426
占比
0.00%
相关主题
常跟 synthetic-data 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 synthetic-data 主题的项目。
近 90 天内还没有新项目标记这个主题。
- #1
机器学习交易代码,第 3 版——从数据获取到实时执行
★ 20,762+43近 7 天星标变化 - #2
为基础模型提供数据处理!🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷
★ 6,975+26近 7 天星标变化 - #3★ 5,042+5近 7 天星标变化
- #4★ 4,839+0近 7 天星标变化
- #5
用于生成逼真训练图像的 Blender 程序流程管线
★ 3,693+5近 7 天星标变化 - #6★ 3,551+0近 7 天星标变化
- #7
Distilabel 是一个基于已验证研究论文的合成数据与 AI 反馈框架,专为需要快速、可靠且具扩展性流水线的工程师设计。
★ 3,384+3近 7 天星标变化 - #8★ 3,323+2近 7 天星标变化
- #9★ 3,322+5近 7 天星标变化
- #10
SDG 是一个专门设计用于生成高质量结构化表格数据的框架。
★ 2,436+1近 7 天星标变化 - #11★ 2,209+0近 7 天星标变化
- #12
🎨 NeMo Data Designer:从头开始或从种子数据生成高质量的合成数据。
★ 2,197+7近 7 天星标变化 - #13★ 1,757+4近 7 天星标变化
- #14★ 1,722+2近 7 天星标变化
- #15
用于表格与时间序列数据的合成数据生成器
★ 1,654+0近 7 天星标变化 - #16★ 1,641-1近 7 天星标变化
- #17★ 1,565+3近 7 天星标变化
- #18★ 1,484+0近 7 天星标变化
- #19
使用模拟、逼真合成互动来全面诊断与优化 agent 的框架
★ 1,257+0近 7 天星标变化 - #20
DataDreamer:提示、生成合成数据、训练与对齐模型。
★ 1,117+0近 7 天星标变化 - #21
Synthadoc:一个开源的 LLM 知识编译引擎,可将原始文件转换为结构化的本地优先 Wiki。这是传统 RAG 的透明且人类可读的替代方案,无需使用任何工具即可进行自我管理与自我改进。
★ 1,116+2近 7 天星标变化 - #22
在单一管线中生成高质量合成数据、训练、测量与评估
★ 885+3近 7 天星标变化 - #23★ 881+2近 7 天星标变化
- #24★ 829+0近 7 天星标变化
- #25
言语化采样 (Verbalized Sampling) 是一种免训练的提示策略,通过要求附带概率的响应来缓解 LLM 中的模式崩溃。在维持质量的同时实现 2-3 倍的多样性提升。具备 CLI/API 的模型无关框架,适用于创意写作、合成数据生成与对话模拟。
★ 803+1近 7 天星标变化 - #26★ 798+5近 7 天星标变化
- #27★ 797+10近 7 天星标变化
- #28★ 715+1近 7 天星标变化
- #29★ 681+4近 7 天星标变化
- #30★ 652+0近 7 天星标变化