post-training
Repositorios de código abierto monitorizados etiquetados con post-training, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a post-training en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con post-training.
- #1
Ecosistema vivo donde los agentes de IA completan tareas a través de bucles de flujo de trabajo, mejoran mediante ejecución iterativa, son evaluados por agentes mentores o humanos, y convierten el trabajo completado en experiencia laboral reutilizable y datos para mejorar futuros agentes.
★ 1333
- #1
Un framework unificado de inferencia y post-entrenamiento para la generación acelerada de video.
★ 4150+128Variación de estrellas de los últimos 7 días - #2
Tutorial, encuesta y guía impresionante sobre LLM de razonamiento
★ 2527+4Variación de estrellas de los últimos 7 días - #3
Modelo de lenguaje grande (LLM) para salud mental, incluyendo pre y post-entrenamiento, conjuntos de datos, evaluación, despliegue y RAG, con modelos de las series InternLM, Qwen, Baichuan, DeepSeek, Mixtral, LLama y GLM.
★ 1781+3Variación de estrellas de los últimos 7 días - #4
Ecosistema vivo donde los agentes de IA completan tareas a través de bucles de flujo de trabajo, mejoran mediante ejecución iterativa, son evaluados por agentes mentores o humanos, y convierten el trabajo completado en experiencia laboral reutilizable y datos para mejorar futuros agentes.
★ 1333-3Variación de estrellas de los últimos 7 días - #5
Una colección curada de artículos, informes técnicos, marcos de trabajo y herramientas para la destilación on-policy (OPD) de modelos de lenguaje de gran tamaño.
★ 766+29Variación de estrellas de los últimos 7 días - #6
Repositorio oficial para "Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 Spotlight)
★ 640+0Variación de estrellas de los últimos 7 días - #7
Explora el momento "Aha" multimodal en un modelo de 2B.
★ 623+0Variación de estrellas de los últimos 7 días - #8
[ACL 2026 Oral] "LightReasoner: ¿Pueden los modelos de lenguaje pequeños enseñar razonamiento a los modelos de lenguaje grandes?"
★ 608+1Variación de estrellas de los últimos 7 días - #9
Un motor de aprendizaje por refuerzo asíncrono para el post-entrenamiento omnimodal a gran escala.
★ 582+2Variación de estrellas de los últimos 7 días - #10
[NeurIPS 2025 Spotlight] Suite de post-entrenamiento para LLM, que incluye ReasonFlux, ReasonFlux-PRM y ReasonFlux-Coder.
★ 542-1Variación de estrellas de los últimos 7 días - #11
Medición de la capacidad de agentes CLI como Claude Code o Codex CLI para realizar post-entrenamiento de LLMs base en una sola GPU H100 en 10 horas
★ 541+14Variación de estrellas de los últimos 7 días - #12★ 533+2Variación de estrellas de los últimos 7 días