datawhalechina/diy-llm
@datawhalechina🎓 Systematischer Kurs zum Aufbau von Large Language Models | 🛠️ Abdeckung von Vortraining-Data-Engineering, Tokenizer, Transformer, MoE, GPU-Programmierung (CUDA/Triton),分布式训练 (verteiltes Training), Scaling Laws, Inferenzoptimierung und Alignment (SFT/RLHF/GRPO) | 🚀 6 progressive Aufgaben + codegetrieben, Aufbau eines Full-Stack-LLM-Wissensstands
Sterne
1.338
Forks
135
Sprache
Jupyter Notebook
Lizenz
—
Letzter Push
vor 1 Tag
Verwandte Intel (0)
Noch keine verwandte Intel
Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.