Pular para o conteúdo principal
buildradar
Entrar

datawhalechina/diy-llm

@datawhalechina

Curso sistemático de construção de Large Language Models | Abrange engenharia de dados de pré-treinamento, Tokenizer, Transformer, MoE, programação GPU (CUDA/Triton), treinamento distribuído, Scaling Laws, otimização de inferência e alinhamento (SFT/RLHF/GRPO) | 6 exercícios progressivos orientados a código para estabelecer uma visão full-stack de LLMs

Estrelas
1.338
Bifurcações
135
Linguagem
Jupyter Notebook
Licença
Último push
há 1 dia
Jupyter Notebookllmrltransformernlpgpu-programminggrposftdatawhale

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.