Pular para o conteúdo principal
buildradar
Sign in
Tópico · sft

sft

Repositórios de código aberto acompanhados marcados com sft, ordenados por estrelas.

Repositórios
15
Total de estrelas
64.861
Média de estrelas
4.324
Participação
0,00%

Tópicos que aparecem com frequência ao lado de sft no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com sft.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • ms-swift@modelscope

    Use PEFT ou Full-parameter para CPT/SFT/DPO/GRPO em mais de 600 LLMs (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) e mais de 300 MLLMs (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) (AAAI 2025).

    15.488+88Variação de estrelas nos últimos 7 dias
  • bisheng@dataelement

    BISHENG é uma plataforma de DevOps para LLMs aberta voltada para a próxima geração de aplicações de IA corporativa. Recursos poderosos e abrangentes incluem: fluxo de trabalho GenAI, RAG, Agent, gerenciamento unificado de modelos, avaliação, SFT, gerenciamento de conjuntos de dados, gerenciamento de sistemas de nível empresarial, observabilidade e muito mais.

    11.922+5Variação de estrelas nos últimos 7 dias
  • oumi@oumi-ai

    Faça o ajuste fino, avalie e implante facilmente Qwen, Gemma ou qualquer LLM de pesos abertos!

    9.383+3Variação de estrelas nos últimos 7 dias
  • AgentGuide@adongwanai

    https://adongwanai.github.io/AgentGuide | Guia de desenvolvimento de agentes de IA | Prática de LangGraph | RAG avançado | Transição para LLMs | Entrevistas de LLM | Engenheiro de algoritmos | Banco de questões de entrevista | Aprendizado por reforço | Síntese de dados.

    9.116+169Variação de estrelas nos últimos 7 dias
  • Soup@MakazhanAlpamys

    Ajuste fino de LLMs a partir de um único YAML. O streaming de camadas treina um modelo de 8B em uma GPU de laptop de 4 GB.

    4.929+1.365Variação de estrelas nos últimos 7 dias
  • hands-on-modern-rl@walkinglabs

    Um currículo prático de código aberto que preenche a lacuna entre conceitos básicos de RL e alinhamento de LLM, RLVR e sistemas de agentes avançados.

    4.199+54Variação de estrelas nos últimos 7 dias
  • maxtext@AI-Hypercomputer

    Um LLM Jax simples, performático e escalável!

    2.410+3Variação de estrelas nos últimos 7 dias
  • chatglm_finetuning@ssbuild

    Fine-tuning do chatglm 6b e fine-tuning do alpaca

    1.526+0Variação de estrelas nos últimos 7 dias
  • diy-llm@datawhalechina

    Curso sistemático de construção de Large Language Models | Abrange engenharia de dados de pré-treinamento, Tokenizer, Transformer, MoE, programação GPU (CUDA/Triton), treinamento distribuído, Scaling Laws, otimização de inferência e alinhamento (SFT/RLHF/GRPO) | 6 exercícios progressivos orientados a código para estabelecer uma visão full-stack de LLMs

    1.276+19Variação de estrelas nos últimos 7 dias
  • GraphGen@InternScience

    GraphGen: Aprimorando o ajuste fino supervisionado para LLMs com geração de dados sintéticos orientada por conhecimento

    1.216+2Variação de estrelas nos últimos 7 dias
  • surogate@invergent-ai

    Treinamento e ajuste fino na velocidade da luz

    813+0Variação de estrelas nos últimos 7 dias
  • DeepSeek-671B-SFT-Guide@ScienceOne-AI

    Uma solução de código aberto para o ajuste fino de parâmetros completos do DeepSeek-V3/R1 671B, incluindo código completo e scripts do treinamento à inferência, bem como algumas experiências práticas e conclusões.

    812+0Variação de estrelas nos últimos 7 dias
  • trainable-agents@choosewhatulike

    Código e conjuntos de dados para "Character-LLM: A Trainable Agent for Role-Playing"

    647+1Variação de estrelas nos últimos 7 dias
  • tensorflow-nlp-tutorial@ukairia777

    Este é um repositório de NLP de Deep Learning que organiza desde o pré-processamento de texto usando TensorFlow até tarefas downstream de modelos modernos como Topic Models, BERT, GPT e LLM.

    581+0Variação de estrelas nos últimos 7 dias
  • LoongForge@baidu-baige

    A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.

    549+15Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos