sft
Erfasste Open-Source-Repos mit dem Tag sft, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit sft am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit sft getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Verwenden Sie PEFT oder Vollparameter für CPT/SFT/DPO/GRPO von über 600 LLMs und über 300 MLLMs (AAAI 2025).
★ 15.400+76Sterne-Änderung der letzten 7 Tage - #2
BISHENG ist eine offene LLM-DevOps-Plattform für Enterprise-KI-Anwendungen der nächsten Generation. Leistungsstarke und umfassende Funktionen umfassen: GenAI-Workflow, RAG, Agent, einheitliches Modellmanagement, Evaluierung, SFT, Datensatzverwaltung, Systemverwaltung auf Unternehmensniveau, Observability und mehr.
★ 11.917+14Sterne-Änderung der letzten 7 Tage - #3
Einfaches Fine-Tuning, Evaluierung und Deployment von Qwen, Gemma oder anderen Open-Weight-LLMs!
★ 9.380+3Sterne-Änderung der letzten 7 Tage - #4
https://adongwanai.github.io/AgentGuide | AI-Agent-Entwicklungsleitfaden | LangGraph-Praxis | Fortgeschrittene RAG | Einstieg in Large Language Models | LLM-Vorstellungsgespräche | Algorithmus-Ingenieur | Fragenkatalog für Vorstellungsgespräche | Reinforcement Learning | Datensynthese
★ 8.947+308Sterne-Änderung der letzten 7 Tage - #5
🚀 Ein Open-Source-Praxislehrplan, der die Lücke von grundlegenden RL-Konzepten bis hin zu LLM-Alignment, RLVR und fortgeschrittenen Agentensystemen schließt.
★ 4.145+94Sterne-Änderung der letzten 7 Tage - #6
LLMs aus einer einzigen YAML-Datei fine-tunen. Layer-Streaming trainiert ein 8B-Modell auf einer 4-GB-Laptop-GPU.
★ 3.564+883Sterne-Änderung der letzten 7 Tage - #7★ 2.407+6Sterne-Änderung der letzten 7 Tage
- #8
Fine-Tuning für chatglm 6b und alpaca
★ 1.526+0Sterne-Änderung der letzten 7 Tage - #9
🎓 Systematischer Kurs zum Aufbau von Large Language Models | 🛠️ Abdeckung von Vortraining-Data-Engineering, Tokenizer, Transformer, MoE, GPU-Programmierung (CUDA/Triton),分布式训练 (verteiltes Training), Scaling Laws, Inferenzoptimierung und Alignment (SFT/RLHF/GRPO) | 🚀 6 progressive Aufgaben + codegetrieben, Aufbau eines Full-Stack-LLM-Wissensstands
★ 1.260+22Sterne-Änderung der letzten 7 Tage - #10
GraphGen: Verbesserung des Supervised Fine-Tuning für LLMs durch wissensbasierte synthetische Datengenerierung
★ 1.214+5Sterne-Änderung der letzten 7 Tage - #11★ 813+3Sterne-Änderung der letzten 7 Tage
- #12
Eine Open-Source-Lösung für das vollständige Parameter-Fine-Tuning von DeepSeek-V3/R1 671B, einschließlich vollständigem Code und Skripten vom Training bis zur Inferenz sowie einigen praktischen Erfahrungen und Schlussfolgerungen.
★ 812+0Sterne-Änderung der letzten 7 Tage - #13
Code und Datensätze für „Character-LLM: A Trainable Agent for Role-Playing“
★ 645+1Sterne-Änderung der letzten 7 Tage - #14
Ein Deep-Learning-NLP-Repository mit TensorFlow, das von der Textvorverarbeitung bis hin zu Downstream-Tasks moderner Modelle wie Topic Models, BERT, GPT und LLMs reicht.
★ 581+0Sterne-Änderung der letzten 7 Tage - #15
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 538—Sterne-Änderung der letzten 7 Tage