Saltar al contenido principal
buildradar
Sign in
Tema · post-training

post-training

Repositorios de código abierto monitorizados etiquetados con post-training, ordenados por estrellas.

Repositorios
12
Estrellas totales
14.614
Estrellas de media
1218
Proporción
0,00%

Temas que aparecen con frecuencia junto a post-training en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con post-training.

  • agent-apprenticeship@ray-r-ren

    Ecosistema vivo donde los agentes de IA completan tareas a través de bucles de flujo de trabajo, mejoran mediante ejecución iterativa, son evaluados por agentes mentores o humanos, y convierten el trabajo completado en experiencia laboral reutilizable y datos para mejorar futuros agentes.

    1333
  • FastVideo@hao-ai-lab

    Un framework unificado de inferencia y post-entrenamiento para la generación acelerada de video.

    4150+128Variación de estrellas de los últimos 7 días
  • Tutorial, encuesta y guía impresionante sobre LLM de razonamiento

    2527+4Variación de estrellas de los últimos 7 días
  • EmoLLM@SmartFlowAI

    Modelo de lenguaje grande (LLM) para salud mental, incluyendo pre y post-entrenamiento, conjuntos de datos, evaluación, despliegue y RAG, con modelos de las series InternLM, Qwen, Baichuan, DeepSeek, Mixtral, LLama y GLM.

    1781+3Variación de estrellas de los últimos 7 días
  • agent-apprenticeship@ray-r-ren

    Ecosistema vivo donde los agentes de IA completan tareas a través de bucles de flujo de trabajo, mejoran mediante ejecución iterativa, son evaluados por agentes mentores o humanos, y convierten el trabajo completado en experiencia laboral reutilizable y datos para mejorar futuros agentes.

    1333-3Variación de estrellas de los últimos 7 días
  • Una colección curada de artículos, informes técnicos, marcos de trabajo y herramientas para la destilación on-policy (OPD) de modelos de lenguaje de gran tamaño.

    766+29Variación de estrellas de los últimos 7 días
  • RandOpt@sunrainyg

    Repositorio oficial para "Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 Spotlight)

    640+0Variación de estrellas de los últimos 7 días
  • VisualThinker-R1-Zero@turningpoint-ai

    Explora el momento "Aha" multimodal en un modelo de 2B.

    623+0Variación de estrellas de los últimos 7 días
  • LightReasoner@HKUDS

    [ACL 2026 Oral] "LightReasoner: ¿Pueden los modelos de lenguaje pequeños enseñar razonamiento a los modelos de lenguaje grandes?"

    608+1Variación de estrellas de los últimos 7 días
  • Relax@redai-studio

    Un motor de aprendizaje por refuerzo asíncrono para el post-entrenamiento omnimodal a gran escala.

    582+2Variación de estrellas de los últimos 7 días
  • ReasonFlux@Gen-Verse

    [NeurIPS 2025 Spotlight] Suite de post-entrenamiento para LLM, que incluye ReasonFlux, ReasonFlux-PRM y ReasonFlux-Coder.

    542-1Variación de estrellas de los últimos 7 días
  • PostTrainBench@aisa-group

    Medición de la capacidad de agentes CLI como Claude Code o Codex CLI para realizar post-entrenamiento de LLMs base en una sola GPU H100 en 10 horas

    541+14Variación de estrellas de los últimos 7 días
  • Human3R@fanegg

    [ICLR 2026] Un modelo unificado para la reconstrucción 4D de humanos y escenas

    533+2Variación de estrellas de los últimos 7 días
← Volver a temas