跳到主要内容
buildradar
登录

mbzuai-oryx/Awesome-LLM-Post-training

@mbzuai-oryx

强大推理能力 LLM 的教学、调查与指南资源集合

星数
2,533
Fork 数
169
语言
Python
许可
最后推送
2个月前
Pythonlarge-language-modelsreinforcement-learningpost-trainingreasoningscalingfine

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。