datawhalechina/diy-llm
@datawhalechina🎓 व्यवस्थित बड़े भाषा मॉडल निर्माण पाठ्यक्रम|🛠️ प्री-ट्रेनिंग डेटा इंजीनियरिंग, Tokenizer, Transformer, MoE, GPU प्रोग्रामिंग (CUDA/Triton), वितरित प्रशिक्षण, स्केलिंग नियम, अनुमान अनुकूलन और संरेखण (SFT/RLHF/GRPO) को कवर करता है|🚀 6 प्रगतिशील असाइनमेंट + कोड-संचालित, LLM फुल-स्टैक कॉग्निशन सिस्टम स्थापित करता है
स्टार
1,338
फ़ोर्क
135
भाषा
Jupyter Notebook
लाइसेंस
—
आख़िरी push
1 दिन पहले
संबंधित intel (0)
अभी कोई संबंधित intel नहीं
यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।