跳到主要内容
buildradar
Sign in
主题 · post-training

post-training

标记 post-training 主题、收录中的开源项目,按星标数排序。

项目数
13
总星标数
14,796
平均星标数
1,138
占比
0.00%

常跟 post-training 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 post-training 主题的项目。

  • agent-apprenticeship@ray-r-ren

    一个充满活力的生态系统,在此系统中 AI agent 通过工作流程循环完成任务、藉由迭代执行来改进、通过导师 agent 或人工介入进行评估,并将已完成的工作转化为可重复使用的工作经验与数据,以提升未来的 agent。

    1,334
  • FastVideo@hao-ai-lab

    一个统一的推理与后训练框架,用于加速影片生成

    4,300+150近 7 天星标变化
  • 强大推理能力 LLM 的教学、调查与指南资源集合

    2,533+6近 7 天星标变化
  • EmoLLM@SmartFlowAI

    心理健康大模型 (LLM x Mental Health), Pre & Post-training & Dataset & Evaluation & Depoly & RAG, 搭配 InternLM / Qwen / Baichuan / DeepSeek / Mixtral / LLama / GLM 系列模型

    1,781+1近 7 天星标变化
  • agent-apprenticeship@ray-r-ren

    一个充满活力的生态系统,在此系统中 AI agent 通过工作流程循环完成任务、藉由迭代执行来改进、通过导师 agent 或人工介入进行评估,并将已完成的工作转化为可重复使用的工作经验与数据,以提升未来的 agent。

    1,334+0近 7 天星标变化
  • 大语言模型策略内蒸馏(OPD)的精选论文、技术报告、框架与工具集合

    803+34近 7 天星标变化
  • RandOpt@sunrainyg

    “Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights”(ICML 2026 Spotlight)官方代码库。

    644+3近 7 天星标变化
  • VisualThinker-R1-Zero@turningpoint-ai

    探索 2B 模型上的多模态“Aha 时刻”

    623+0近 7 天星标变化
  • LightReasoner@HKUDS

    [ACL 2026 Oral] LightReasoner:小型语言模型能教导大型语言模型推理吗?

    610+2近 7 天星标变化
  • Relax@redai-studio

    用于大规模全模态后训练的异步强化学习引擎。

    597+12近 7 天星标变化
  • PostTrainBench@aisa-group

    评估 Claude Code 或 Codex CLI 等 CLI 代理在 10 小时内于单张 H100 GPU 上对基础 LLM 进行后训练的成效

    548+11近 7 天星标变化
  • ReasonFlux@Gen-Verse

    [NeurIPS 2025 Spotlight] LLM 后训练套件 — 包含 ReasonFlux、ReasonFlux-PRM 与 ReasonFlux-Coder

    542+0近 7 天星标变化
  • Human3R@fanegg

    [ICLR 2026] 用于 4D 人体与场景重建的统一模型

    533+0近 7 天星标变化
  • WorldEngine@OpenDriveLab

    WorldEngine: Towards the Era of Post-Training for Autonomous Driving

    503近 7 天星标变化
← 返回主题列表