sft
标记 sft 主题、收录中的开源项目,按星标数排序。
相关主题
常跟 sft 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 sft 主题的项目。
近 90 天内还没有新项目标记这个主题。
- #1
使用 PEFT 或 Full-parameter 对 600+ LLM(Qwen3.6、DeepSeek-V4、GLM-5.1、InternLM3、Llama4、...)和 300+ MLLM(Qwen3-VL、Qwen3-Omni、InternVL3.5、Ovis2.5、GLM4.5v、Gemma4、Llava、Phi4、...)进行 CPT/SFT/DPO/GRPO(AAAI 2025)
★ 15,488+88近 7 天星标变化 - #2
BISHENG 是一个开源 LLM DevOps 平台,支持下一代企业 AI 应用。功能包括:GenAI 工作流、RAG、Agent、统一模型管理、评估、SFT、数据集管理、企业级系统管理、可观测性等。
★ 11,922+5近 7 天星标变化 - #3★ 9,383+3近 7 天星标变化
- #4
https://adongwanai.github.io/AgentGuide | AI Agent 开发指南 | LangGraph 实战 | 高级 RAG | 转行大模型 | 大模型面试 | 算法工程师 | 面试题库 | 强化学习|数据合成
★ 9,116+169近 7 天星标变化 - #5★ 4,929+1,365近 7 天星标变化
- #6
🚀 一个开源、实作导向的课程,弥合基础 RL 概念与 LLM 对齐、RLVR 及进阶代理系统之间的差距
★ 4,199+54近 7 天星标变化 - #7★ 2,410+3近 7 天星标变化
- #8
chatglm 6b 微调与 alpaca 微调
★ 1,526+0近 7 天星标变化 - #9
🎓 系统性大语言模型构建课程|🛠️ 涵盖预训练数据工程、Tokenizer、Transformer、MoE、GPU 编程 (CUDA/Triton)、分布式训练、Scaling Laws、推理优化及对齐 (SFT/RLHF/GRPO)|🚀 6 个渐进式作业 + 代码驱动,建立 LLM 全栈认知体系
★ 1,276+19近 7 天星标变化 - #10★ 1,216+2近 7 天星标变化
- #11★ 813+0近 7 天星标变化
- #12
DeepSeek-V3/R1 671B 全参数微调的开源解决方案,包含从训练到推理的完整代码和脚本,以及实践中积累的一些经验和结论。
★ 812+0近 7 天星标变化 - #13
“Character-LLM: A Trainable Agent for Role-Playing”的代码与数据集
★ 647+2近 7 天星标变化 - #14
使用 TensorFlow 整理从文本预处理到 Topic Models、BERT、GPT、LLM 等最新模型下游任务的深度学习 NLP 存储库。
★ 581+0近 7 天星标变化 - #15
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+15近 7 天星标变化