video-generation
Repositorios de código abierto monitorizados etiquetados con video-generation, ordenados por estrellas.
- #91
Encadenamiento de clips para MiniMax H3 en ComfyUI: el movimiento y el audio continúan genuinamente a través de las uniones
★ 914+139Variación de estrellas de los últimos 7 días - #92
[AAAI 2025] Follow-Your-Click: Este repositorio es la implementación oficial de "Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts".
★ 908-1Variación de estrellas de los últimos 7 días - #93★ 896+1Variación de estrellas de los últimos 7 días
- #94
[ACM MM 2025] Ditto: Difusión en el espacio de movimiento para la síntesis controlable de cabezas parlantes en tiempo real
★ 878+6Variación de estrellas de los últimos 7 días - #95
[ICLR2026] SeedVR2: Restauración de video en un solo paso mediante post-entrenamiento adversario de difusión.
★ 865+9Variación de estrellas de los últimos 7 días - #96
[CVPR 2025 Highlight] Generación de video a partir de texto con preservación de identidad mediante descomposición de frecuencia.
★ 857+1Variación de estrellas de los últimos 7 días - #97
UniAnimate-DiT: Animación de imágenes humanas con Video Diffusion Transformer a gran escala.
★ 850-2Variación de estrellas de los últimos 7 días - #98
[SIGGRAPH 2025] Diffusion como shader: difusión de video con consciencia 3D para un control versátil de generación de video
★ 833+1Variación de estrellas de los últimos 7 días - #99
Implementación oficial de "RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers" (ICML 2025), UltraViCo (ICLR 2026) y UltraImage.
★ 827+2Variación de estrellas de los últimos 7 días - #100
CLI de generación de medios Flatkey para imágenes, videos, audio, texto, créditos y descubrimiento de modelos
★ 825+176Variación de estrellas de los últimos 7 días - #101
Un motor de entrenamiento multimodal simple y unificado. Ligero, flexible y diseñado para hackear a gran escala.
★ 824+0Variación de estrellas de los últimos 7 días - #102
Generar video a partir de texto usando IA
★ 821+6Variación de estrellas de los últimos 7 días - #103
Kandinsky 5.0: Una familia de modelos de difusión para la generación de video e imagen.
★ 820+3Variación de estrellas de los últimos 7 días - #104
Genera escenas 3D explorables a gran escala con videos panorámicos de alta calidad a partir de una sola imagen o prompt de texto.
★ 816+11Variación de estrellas de los últimos 7 días - #105
[TMLR 2025🔥] Un estudio sobre modelos autorregresivos en visión artificial.
★ 808+1Variación de estrellas de los últimos 7 días - #106
Open-WebUI Tools es un kit de herramientas modular diseñado para extender y enriquecer su instancia de Open WebUI, convirtiéndola en una potente estación de trabajo de IA. Con un conjunto de más de 15 herramientas especializadas, tuberías de funciones y filtros, este proyecto admite investigación académica, autonomía de agentes, creatividad multimodal, flujos de trabajo y más.
★ 806+4Variación de estrellas de los últimos 7 días - #107
[CVPR 2024 Highlight] GenAD: Modelo predictivo generalizado para conducción autónoma
★ 805+0Variación de estrellas de los últimos 7 días - #108
rCM y Causal-rCM: Algoritmos e infraestructuras unificadas y líderes para la destilación de difusión de video bidireccional/autorregresiva a gran escala
★ 800+6Variación de estrellas de los últimos 7 días - #109
[NeurIPS 2025 Oral] Infinity⭐️: Modelado autorregresivo espacio-temporal unificado para generación visual.
★ 784+4Variación de estrellas de los últimos 7 días - #110
Una colección de estudios impresionantes sobre generación de video.
★ 782+0Variación de estrellas de los últimos 7 días - #111
[ICML 2024] MagicPose (también conocido como MagicDance): reorientación realista de poses humanas y expresiones faciales con difusión consciente de la identidad.
★ 776+0Variación de estrellas de los últimos 7 días - #112
Entorno de ejecución y estudio de generación visual local-first para personas y agentes de codificación, con flujos de trabajo de imagen y video reproducibles en múltiples proveedores.
★ 749+27Variación de estrellas de los últimos 7 días - #113
Un estudio sobre la generación/síntesis de texto a video.
★ 744+2Variación de estrellas de los últimos 7 días - #114
Cosmos-Transfer2.5, construido sobre Cosmos-Predict2.5, genera simulaciones del mundo de alta calidad condicionadas a múltiples entradas de control espacial.
★ 735+4Variación de estrellas de los últimos 7 días - #115
[ICCV 2025] Implementación oficial del artículo “MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control”
★ 729+1Variación de estrellas de los últimos 7 días - #116
Plano de control local y nativo para agentes de ComfyUI: servidor MCP + agente de barra lateral que genera imágenes, video y audio, crea y ejecuta flujos de trabajo, y edita tu gráfico en tiempo real mediante lenguaje natural con cualquier LLM (Claude, ChatGPT, Gemini, Ollama offline o cualquier modelo alojado). Incluye 178 herramientas, 36 habilidades de IA y 55 paquetes de instalación. Funciona en local, LAN, VPS o Comfy Cloud.
★ 729+33Variación de estrellas de los últimos 7 días - #117
Un repositorio minimalista y completo para avanzar en la ciencia de los modelos mundiales
★ 729+6Variación de estrellas de los últimos 7 días - #118
[ICML 2025] Implementación oficial en PyTorch de "History-Guided Video Diffusion".
★ 709+1Variación de estrellas de los últimos 7 días - #119
[ICLR 2026] ChronoEdit: Hacia el razonamiento temporal para la edición de imágenes y la simulación de mundos
★ 706+1Variación de estrellas de los últimos 7 días - #120
[ECCV 2026] SparkVSR: Superresolución de video interactiva mediante propagación de fotogramas clave dispersos
★ 702+3Variación de estrellas de los últimos 7 días