Zum Hauptinhalt springen
buildradar
Anmelden

datawhalechina/diy-llm

@datawhalechina

🎓 Systematischer Kurs zum Aufbau von Large Language Models | 🛠️ Abdeckung von Vortraining-Data-Engineering, Tokenizer, Transformer, MoE, GPU-Programmierung (CUDA/Triton),分布式训练 (verteiltes Training), Scaling Laws, Inferenzoptimierung und Alignment (SFT/RLHF/GRPO) | 🚀 6 progressive Aufgaben + codegetrieben, Aufbau eines Full-Stack-LLM-Wissensstands

Sterne
1.338
Forks
135
Sprache
Jupyter Notebook
Lizenz
Letzter Push
vor 1 Tag
Jupyter Notebookllmrltransformernlpgpu-programminggrposftdatawhale

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.