Saltar al contenido principal
buildradar
Iniciar sesión

datawhalechina/diy-llm

@datawhalechina

🎓 Curso sistemático de construcción de modelos de lenguaje extensos | 🛠️ Cubre ingeniería de datos de preentrenamiento, Tokenizer, Transformer, MoE, programación de GPU (CUDA/Triton), entrenamiento distribuido, leyes de escala, optimización de inferencia y alineación (SFT/RLHF/GRPO) | 🚀 6 tareas progresivas + impulsadas por código para establecer un sistema de conocimiento full-stack de LLM

Estrellas
1338
Bifurcaciones
135
Lenguaje
Jupyter Notebook
Licencia
Último push
hace 1 día
Jupyter Notebookllmrltransformernlpgpu-programminggrposftdatawhale

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.