sft
Repositórios de código aberto acompanhados marcados com sft, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de sft no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com sft.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Use PEFT ou Full-parameter para CPT/SFT/DPO/GRPO em mais de 600 LLMs (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) e mais de 300 MLLMs (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) (AAAI 2025).
★ 15.488+88Variação de estrelas nos últimos 7 dias - #2
BISHENG é uma plataforma de DevOps para LLMs aberta voltada para a próxima geração de aplicações de IA corporativa. Recursos poderosos e abrangentes incluem: fluxo de trabalho GenAI, RAG, Agent, gerenciamento unificado de modelos, avaliação, SFT, gerenciamento de conjuntos de dados, gerenciamento de sistemas de nível empresarial, observabilidade e muito mais.
★ 11.922+5Variação de estrelas nos últimos 7 dias - #3
Faça o ajuste fino, avalie e implante facilmente Qwen, Gemma ou qualquer LLM de pesos abertos!
★ 9.383+3Variação de estrelas nos últimos 7 dias - #4
https://adongwanai.github.io/AgentGuide | Guia de desenvolvimento de agentes de IA | Prática de LangGraph | RAG avançado | Transição para LLMs | Entrevistas de LLM | Engenheiro de algoritmos | Banco de questões de entrevista | Aprendizado por reforço | Síntese de dados.
★ 9.116+169Variação de estrelas nos últimos 7 dias - #5
Ajuste fino de LLMs a partir de um único YAML. O streaming de camadas treina um modelo de 8B em uma GPU de laptop de 4 GB.
★ 4.929+1.365Variação de estrelas nos últimos 7 dias - #6
Um currículo prático de código aberto que preenche a lacuna entre conceitos básicos de RL e alinhamento de LLM, RLVR e sistemas de agentes avançados.
★ 4.199+54Variação de estrelas nos últimos 7 dias - #7★ 2.410+3Variação de estrelas nos últimos 7 dias
- #8
Fine-tuning do chatglm 6b e fine-tuning do alpaca
★ 1.526+0Variação de estrelas nos últimos 7 dias - #9
Curso sistemático de construção de Large Language Models | Abrange engenharia de dados de pré-treinamento, Tokenizer, Transformer, MoE, programação GPU (CUDA/Triton), treinamento distribuído, Scaling Laws, otimização de inferência e alinhamento (SFT/RLHF/GRPO) | 6 exercícios progressivos orientados a código para estabelecer uma visão full-stack de LLMs
★ 1.276+19Variação de estrelas nos últimos 7 dias - #10
GraphGen: Aprimorando o ajuste fino supervisionado para LLMs com geração de dados sintéticos orientada por conhecimento
★ 1.216+2Variação de estrelas nos últimos 7 dias - #11★ 813+0Variação de estrelas nos últimos 7 dias
- #12
Uma solução de código aberto para o ajuste fino de parâmetros completos do DeepSeek-V3/R1 671B, incluindo código completo e scripts do treinamento à inferência, bem como algumas experiências práticas e conclusões.
★ 812+0Variação de estrelas nos últimos 7 dias - #13
Código e conjuntos de dados para "Character-LLM: A Trainable Agent for Role-Playing"
★ 647+1Variação de estrelas nos últimos 7 dias - #14
Este é um repositório de NLP de Deep Learning que organiza desde o pré-processamento de texto usando TensorFlow até tarefas downstream de modelos modernos como Topic Models, BERT, GPT e LLM.
★ 581+0Variação de estrelas nos últimos 7 dias - #15
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+15Variação de estrelas nos últimos 7 dias