datawhalechina/diy-llm
@datawhalechina🎓 Khóa học xây dựng Large Language Model có hệ thống |🛠️ Bao gồm kỹ thuật dữ liệu tiền huấn luyện, Tokenizer, Transformer, MoE, lập trình GPU (CUDA/Triton), huấn luyện phân tán, Scaling Laws, tối ưu hóa suy luận và căn chỉnh (SFT/RLHF/GRPO) |🚀 6 bài tập lũy tiến + hướng dẫn bằng mã nguồn, xây dựng hệ thống nhận thức toàn diện về LLM
Sao
1.338
Fork
135
Ngôn ngữ
Jupyter Notebook
Giấy phép
—
Push gần nhất
2 ngày trước
Intel liên quan (0)
Chưa có intel liên quan
Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.