跳到主要內容
buildradar
Sign in
主題 · post-training

post-training

標記 post-training 主題、收錄中的開源專案,依星數排序。

專案數
13
總星數
14,796
平均星數
1,138
佔比
0.00%

常跟 post-training 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 post-training 主題的專案。

  • agent-apprenticeship@ray-r-ren

    一個充滿活力的生態系統,在此系統中 AI agent 透過工作流程迴圈完成任務、藉由迭代執行來改進、透過導師 agent 或人工介入進行評估,並將已完成的工作轉化為可重複使用的工作經驗與資料,以提升未來的 agent。

    1,334
  • FastVideo@hao-ai-lab

    一個統一的推理與後訓練框架,用於加速影片生成

    4,300+150近 7 天星數變化
  • 強大推理能力 LLM 的教學、調查與指南資源集合

    2,533+6近 7 天星數變化
  • EmoLLM@SmartFlowAI

    心理健康大模型 (LLM x Mental Health), Pre & Post-training & Dataset & Evaluation & Depoly & RAG, 搭配 InternLM / Qwen / Baichuan / DeepSeek / Mixtral / LLama / GLM 系列模型

    1,781+1近 7 天星數變化
  • agent-apprenticeship@ray-r-ren

    一個充滿活力的生態系統,在此系統中 AI agent 透過工作流程迴圈完成任務、藉由迭代執行來改進、透過導師 agent 或人工介入進行評估,並將已完成的工作轉化為可重複使用的工作經驗與資料,以提升未來的 agent。

    1,334+0近 7 天星數變化
  • 大型語言模型策略內蒸餾(OPD)的精選論文、技術報告、框架與工具集合

    794+34近 7 天星數變化
  • RandOpt@sunrainyg

    「Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights」(ICML 2026 Spotlight)官方程式碼庫。

    643+3近 7 天星數變化
  • VisualThinker-R1-Zero@turningpoint-ai

    探索 2B 模型上的多模態「Aha 時刻」

    623+0近 7 天星數變化
  • LightReasoner@HKUDS

    [ACL 2026 Oral] LightReasoner:小型語言模型能教導大型語言模型推理嗎?

    610+2近 7 天星數變化
  • Relax@redai-studio

    用於大規模全模態後訓練的非同步強化學習引擎。

    592+12近 7 天星數變化
  • PostTrainBench@aisa-group

    評估 Claude Code 或 Codex CLI 等 CLI 代理在 10 小時內於單張 H100 GPU 上對基礎 LLM 進行後訓練的成效

    548+11近 7 天星數變化
  • ReasonFlux@Gen-Verse

    [NeurIPS 2025 Spotlight] LLM 後訓練套件 — 包含 ReasonFlux、ReasonFlux-PRM 與 ReasonFlux-Coder

    542+0近 7 天星數變化
  • Human3R@fanegg

    [ICLR 2026] 用於 4D 人體與場景重建的統一模型

    533+0近 7 天星數變化
  • WorldEngine@OpenDriveLab

    WorldEngine: Towards the Era of Post-Training for Autonomous Driving

    503近 7 天星數變化
← 返回主題列表