跳到主要內容
buildradar
Sign in
主題 · sft

sft

標記 sft 主題、收錄中的開源專案,依星數排序。

專案數
15
總星數
64,861
平均星數
4,324
佔比
0.00%

常跟 sft 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 sft 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • ms-swift@modelscope

    使用 PEFT 或 Full-parameter 於 600+ LLM(Qwen3.6、DeepSeek-V4、GLM-5.1、InternLM3、Llama4、...)與 300+ MLLM(Qwen3-VL、Qwen3-Omni、InternVL3.5、Ovis2.5、GLM4.5v、Gemma4、Llava、Phi4、...)進行 CPT/SFT/DPO/GRPO(AAAI 2025)

    15,488+88近 7 天星數變化
  • bisheng@dataelement

    BISHENG 是一個開源 LLM DevOps 平台,支援下一代企業 AI 應用。功能包括:GenAI 工作流、RAG、Agent、統一模型管理、評估、SFT、資料集管理、企業級系統管理、可觀測性等。

    11,922+5近 7 天星數變化
  • oumi@oumi-ai

    輕鬆微調、評估與部署 Qwen、Gemma 或任何開放權重的 LLM!

    9,383+3近 7 天星數變化
  • AgentGuide@adongwanai

    https://adongwanai.github.io/AgentGuide | AI Agent 開發指南 | LangGraph 實戰 | 高階 RAG | 轉職大模型 | 大模型面試 | 演算法工程師 | 面試題庫 | 強化學習|資料合成

    9,116+169近 7 天星數變化
  • Soup@MakazhanAlpamys

    透過單一 YAML 微調 LLM。層串流訓練可在 4 GB 筆電 GPU 上執行 8B 模型。

    4,929+1,365近 7 天星數變化
  • hands-on-modern-rl@walkinglabs

    🚀 一個開源、實作導向的課程,彌合基礎 RL 概念與 LLM 對齊、RLVR 及進階代理系統之間的差距

    4,199+54近 7 天星數變化
  • maxtext@AI-Hypercomputer

    一個簡單、高效能且可擴充的 Jax LLM!

    2,410+3近 7 天星數變化
  • chatglm_finetuning@ssbuild

    chatglm 6b 微調與 alpaca 微調

    1,526+0近 7 天星數變化
  • diy-llm@datawhalechina

    🎓 系統性大語言模型建構課程|🛠️ 涵蓋預訓練資料工程、Tokenizer、Transformer、MoE、GPU 編程 (CUDA/Triton)、分散式訓練、Scaling Laws、推理最佳化及對齊 (SFT/RLHF/GRPO)|🚀 6 個漸進式作業 + 程式碼驅動,建立 LLM 全端認知體系

    1,276+19近 7 天星數變化
  • GraphGen@InternScience

    GraphGen:透過知識驅動的合成資料生成增強大型語言模型的監督微調

    1,216+2近 7 天星數變化
  • surogate@invergent-ai

    以極速進行訓練/微調

    813+0近 7 天星數變化
  • DeepSeek-671B-SFT-Guide@ScienceOne-AI

    DeepSeek-V3/R1 671B 全參數微調的開源解決方案,包含從訓練到推理的完整程式碼與腳本,以及實踐中累積的一些經驗和結論。

    812+0近 7 天星數變化
  • trainable-agents@choosewhatulike

    「Character-LLM: A Trainable Agent for Role-Playing」的程式碼與資料集

    647+2近 7 天星數變化
  • tensorflow-nlp-tutorial@ukairia777

    使用 TensorFlow 整理從文字預處理到 Topic Models、BERT、GPT、LLM 等最新模型下游任務的深度學習 NLP 儲存庫。

    581+0近 7 天星數變化
  • LoongForge@baidu-baige

    A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.

    549+15近 7 天星數變化
← 返回主題列表