sft
標記 sft 主題、收錄中的開源專案,依星數排序。
相關主題
常跟 sft 一起出現在同一個專案上的主題。
近期新秀
近 90 天內建立、標記 sft 主題的專案。
近 90 天內還沒有新專案標記這個主題。
- #1
使用 PEFT 或 Full-parameter 於 600+ LLM(Qwen3.6、DeepSeek-V4、GLM-5.1、InternLM3、Llama4、...)與 300+ MLLM(Qwen3-VL、Qwen3-Omni、InternVL3.5、Ovis2.5、GLM4.5v、Gemma4、Llava、Phi4、...)進行 CPT/SFT/DPO/GRPO(AAAI 2025)
★ 15,488+88近 7 天星數變化 - #2
BISHENG 是一個開源 LLM DevOps 平台,支援下一代企業 AI 應用。功能包括:GenAI 工作流、RAG、Agent、統一模型管理、評估、SFT、資料集管理、企業級系統管理、可觀測性等。
★ 11,922+5近 7 天星數變化 - #3★ 9,383+3近 7 天星數變化
- #4
https://adongwanai.github.io/AgentGuide | AI Agent 開發指南 | LangGraph 實戰 | 高階 RAG | 轉職大模型 | 大模型面試 | 演算法工程師 | 面試題庫 | 強化學習|資料合成
★ 9,116+169近 7 天星數變化 - #5★ 4,929+1,365近 7 天星數變化
- #6
🚀 一個開源、實作導向的課程,彌合基礎 RL 概念與 LLM 對齊、RLVR 及進階代理系統之間的差距
★ 4,199+54近 7 天星數變化 - #7★ 2,410+3近 7 天星數變化
- #8
chatglm 6b 微調與 alpaca 微調
★ 1,526+0近 7 天星數變化 - #9
🎓 系統性大語言模型建構課程|🛠️ 涵蓋預訓練資料工程、Tokenizer、Transformer、MoE、GPU 編程 (CUDA/Triton)、分散式訓練、Scaling Laws、推理最佳化及對齊 (SFT/RLHF/GRPO)|🚀 6 個漸進式作業 + 程式碼驅動,建立 LLM 全端認知體系
★ 1,276+19近 7 天星數變化 - #10★ 1,216+2近 7 天星數變化
- #11★ 813+0近 7 天星數變化
- #12
DeepSeek-V3/R1 671B 全參數微調的開源解決方案,包含從訓練到推理的完整程式碼與腳本,以及實踐中累積的一些經驗和結論。
★ 812+0近 7 天星數變化 - #13
「Character-LLM: A Trainable Agent for Role-Playing」的程式碼與資料集
★ 647+2近 7 天星數變化 - #14
使用 TensorFlow 整理從文字預處理到 Topic Models、BERT、GPT、LLM 等最新模型下游任務的深度學習 NLP 儲存庫。
★ 581+0近 7 天星數變化 - #15
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+15近 7 天星數變化