Saltar al contenido principal
buildradar
Sign in
Tema · video-generation

video-generation

Repositorios de código abierto monitorizados etiquetados con video-generation, ordenados por estrellas.

153 repositorios
  • Encadenamiento de clips para MiniMax H3 en ComfyUI: el movimiento y el audio continúan genuinamente a través de las uniones

    914+139Variación de estrellas de los últimos 7 días
  • FollowYourClick@mayuelala

    [AAAI 2025] Follow-Your-Click: Este repositorio es la implementación oficial de "Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts".

    908-1Variación de estrellas de los últimos 7 días
  • Vista@OpenDriveLab

    [NeurIPS 2024] Un modelo de mundo generalizable para la conducción autónoma.

    896+1Variación de estrellas de los últimos 7 días
  • ditto-talkinghead@antgroup

    [ACM MM 2025] Ditto: Difusión en el espacio de movimiento para la síntesis controlable de cabezas parlantes en tiempo real

    878+6Variación de estrellas de los últimos 7 días
  • SeedVR2@IceClear

    [ICLR2026] SeedVR2: Restauración de video en un solo paso mediante post-entrenamiento adversario de difusión.

    865+9Variación de estrellas de los últimos 7 días
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight] Generación de video a partir de texto con preservación de identidad mediante descomposición de frecuencia.

    857+1Variación de estrellas de los últimos 7 días
  • UniAnimate-DiT@ali-vilab

    UniAnimate-DiT: Animación de imágenes humanas con Video Diffusion Transformer a gran escala.

    850-2Variación de estrellas de los últimos 7 días
  • DiffusionAsShader@IGL-HKUST

    [SIGGRAPH 2025] Diffusion como shader: difusión de video con consciencia 3D para un control versátil de generación de video

    833+1Variación de estrellas de los últimos 7 días
  • Implementación oficial de "RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers" (ICML 2025), UltraViCo (ICLR 2026) y UltraImage.

    827+2Variación de estrellas de los últimos 7 días
  • flatkey-cli@flatkey-ai

    CLI de generación de medios Flatkey para imágenes, videos, audio, texto, créditos y descubrimiento de modelos

    825+176Variación de estrellas de los últimos 7 días
  • lmms-engine@EvolvingLMMs-Lab

    Un motor de entrenamiento multimodal simple y unificado. Ligero, flexible y diseñado para hackear a gran escala.

    824+0Variación de estrellas de los últimos 7 días
  • Text-To-Video-AI@SamurAIGPT

    Generar video a partir de texto usando IA

    821+6Variación de estrellas de los últimos 7 días
  • kandinsky-5@kandinskylab

    Kandinsky 5.0: Una familia de modelos de difusión para la generación de video e imagen.

    820+3Variación de estrellas de los últimos 7 días
  • Matrix-3D@SkyworkAI

    Genera escenas 3D explorables a gran escala con videos panorámicos de alta calidad a partir de una sola imagen o prompt de texto.

    816+11Variación de estrellas de los últimos 7 días
  • [TMLR 2025🔥] Un estudio sobre modelos autorregresivos en visión artificial.

    808+1Variación de estrellas de los últimos 7 días
  • open-webui-tools@Haervwe

    Open-WebUI Tools es un kit de herramientas modular diseñado para extender y enriquecer su instancia de Open WebUI, convirtiéndola en una potente estación de trabajo de IA. Con un conjunto de más de 15 herramientas especializadas, tuberías de funciones y filtros, este proyecto admite investigación académica, autonomía de agentes, creatividad multimodal, flujos de trabajo y más.

    806+4Variación de estrellas de los últimos 7 días
  • DriveAGI@OpenDriveLab

    [CVPR 2024 Highlight] GenAD: Modelo predictivo generalizado para conducción autónoma

    805+0Variación de estrellas de los últimos 7 días
  • rcm@NVlabs

    rCM y Causal-rCM: Algoritmos e infraestructuras unificadas y líderes para la destilación de difusión de video bidireccional/autorregresiva a gran escala

    800+6Variación de estrellas de los últimos 7 días
  • InfinityStar@FoundationVision

    [NeurIPS 2025 Oral] Infinity⭐️: Modelado autorregresivo espacio-temporal unificado para generación visual.

    784+4Variación de estrellas de los últimos 7 días
  • Una colección de estudios impresionantes sobre generación de video.

    782+0Variación de estrellas de los últimos 7 días
  • MagicDance@Boese0601

    [ICML 2024] MagicPose (también conocido como MagicDance): reorientación realista de poses humanas y expresiones faciales con difusión consciente de la identidad.

    776+0Variación de estrellas de los últimos 7 días
  • ima2-gen@lidge-jun

    Entorno de ejecución y estudio de generación visual local-first para personas y agentes de codificación, con flujos de trabajo de imagen y video reproducibles en múltiples proveedores.

    749+27Variación de estrellas de los últimos 7 días
  • Un estudio sobre la generación/síntesis de texto a video.

    744+2Variación de estrellas de los últimos 7 días
  • cosmos-transfer2.5@nvidia-cosmos

    Cosmos-Transfer2.5, construido sobre Cosmos-Predict2.5, genera simulaciones del mundo de alta calidad condicionadas a múltiples entradas de control espacial.

    735+4Variación de estrellas de los últimos 7 días
  • MagicDrive-V2@flymin

    [ICCV 2025] Implementación oficial del artículo “MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control”

    729+1Variación de estrellas de los últimos 7 días
  • comfyui-mcp@artokun

    Plano de control local y nativo para agentes de ComfyUI: servidor MCP + agente de barra lateral que genera imágenes, video y audio, crea y ejecuta flujos de trabajo, y edita tu gráfico en tiempo real mediante lenguaje natural con cualquier LLM (Claude, ChatGPT, Gemini, Ollama offline o cualquier modelo alojado). Incluye 178 herramientas, 36 habilidades de IA y 55 paquetes de instalación. Funciona en local, LAN, VPS o Comfy Cloud.

    729+33Variación de estrellas de los últimos 7 días
  • nano-world-model@simchowitzlabpublic

    Un repositorio minimalista y completo para avanzar en la ciencia de los modelos mundiales

    729+6Variación de estrellas de los últimos 7 días
  • [ICML 2025] Implementación oficial en PyTorch de "History-Guided Video Diffusion".

    709+1Variación de estrellas de los últimos 7 días
  • ChronoEdit@nv-tlabs

    [ICLR 2026] ChronoEdit: Hacia el razonamiento temporal para la edición de imágenes y la simulación de mundos

    706+1Variación de estrellas de los últimos 7 días
  • SparkVSR@taco-group

    [ECCV 2026] SparkVSR: Superresolución de video interactiva mediante propagación de fotogramas clave dispersos

    702+3Variación de estrellas de los últimos 7 días
← Volver a temas