datawhalechina/diy-llm
@datawhalechina🎓 Kursus pembangunan Large Language Model yang sistematis | 🛠️ Mencakup teknik data pre-training, Tokenizer, Transformer, MoE, pemrograman GPU (CUDA/Triton), pelatihan terdistribusi, Scaling Laws, optimasi inferensi, dan alignment (SFT/RLHF/GRPO) | 🚀 6 tugas progresif + berbasis kode, membangun pemahaman tumpukan penuh LLM
Bintang
1.338
Fork
135
Bahasa
Jupyter Notebook
Lisensi
—
Push terakhir
1 hari yang lalu
Intel terkait (0)
Belum ada intel terkait
Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.