Pular para o conteúdo principal
buildradar
Sign in
Tópico · post-training

post-training

Repositórios de código aberto acompanhados marcados com post-training, ordenados por estrelas.

Repositórios
12
Total de estrelas
14.614
Média de estrelas
1.218
Participação
0,00%

Tópicos que aparecem com frequência ao lado de post-training no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com post-training.

  • agent-apprenticeship@ray-r-ren

    Um ecossistema vivo onde agentes de IA completam tarefas através de loops de fluxo de trabalho, melhoram por meio de execução iterativa, são avaliados por agentes mentores ou humanos, e transformam o trabalho concluído em experiência e dados reutilizáveis para aprimorar futuros agentes.

    1.333
  • FastVideo@hao-ai-lab

    Uma estrutura unificada de inferência e pós-treinamento para geração de vídeo acelerada.

    4.150+128Variação de estrelas nos últimos 7 dias
  • Tutorial, levantamento e guia sobre LLMs de raciocínio

    2.527+4Variação de estrelas nos últimos 7 dias
  • EmoLLM@SmartFlowAI

    LLM para saúde mental, incluindo pré e pós-treinamento, conjunto de dados, avaliação, implantação e RAG, com modelos das séries InternLM, Qwen, Baichuan, DeepSeek, Mixtral, LLama e GLM

    1.781+3Variação de estrelas nos últimos 7 dias
  • agent-apprenticeship@ray-r-ren

    Um ecossistema vivo onde agentes de IA completam tarefas através de loops de fluxo de trabalho, melhoram por meio de execução iterativa, são avaliados por agentes mentores ou humanos, e transformam o trabalho concluído em experiência e dados reutilizáveis para aprimorar futuros agentes.

    1.333-3Variação de estrelas nos últimos 7 dias
  • Uma coleção curada de artigos, relatórios técnicos, frameworks e ferramentas para destilação on-policy (OPD) de grandes modelos de linguagem

    766+29Variação de estrelas nos últimos 7 dias
  • RandOpt@sunrainyg

    Código-base oficial para "Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 Spotlight)

    640+0Variação de estrelas nos últimos 7 dias
  • VisualThinker-R1-Zero@turningpoint-ai

    Explore o "Momento Aha" Multimodal em um modelo de 2B

    623+0Variação de estrelas nos últimos 7 dias
  • LightReasoner@HKUDS

    [ACL 2026 Oral] "LightReasoner: Modelos de Linguagem Pequenos Podem Ensinar Raciocínio a Modelos de Linguagem Grandes?"

    608+1Variação de estrelas nos últimos 7 dias
  • Relax@redai-studio

    Um Motor de Aprendizado por Reforço Assíncrono para Pós-Treinamento Omni-Modal em Escala

    582+2Variação de estrelas nos últimos 7 dias
  • ReasonFlux@Gen-Verse

    [Destaque do NeurIPS 2025] Suite de pós-treinamento de LLM — apresentando ReasonFlux, ReasonFlux-PRM e ReasonFlux-Coder.

    542-1Variação de estrelas nos últimos 7 dias
  • PostTrainBench@aisa-group

    Mede quão bem agentes de CLI como Claude Code ou Codex CLI conseguem pós-treinar LLMs base em uma única GPU H100 em 10 horas

    541+14Variação de estrelas nos últimos 7 dias
  • Human3R@fanegg

    [ICLR 2026] Um modelo unificado para reconstrução 4D de humanos e cenas

    533+2Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos