video-generation
Repositorios de código abierto monitorizados etiquetados con video-generation, ordenados por estrellas.
- #61
[TPAMI 2025🔥] MagicTime: Modelos de generación de video time-lapse como simuladores metamórficos.
★ 1337-1Variación de estrellas de los últimos 7 días - #62
Un modelo multimodal unificado nativo con 3B de parámetros activos para la comprensión, generación y edición de imágenes y videos.
★ 1334+3Variación de estrellas de los últimos 7 días - #63
Crea videos cortos para TikTok, Instagram Reels y YouTube Shorts utilizando el Model Context Protocol (MCP) y una API REST.
★ 1327+9Variación de estrellas de los últimos 7 días - #64
Bernini es un framework unificado para la generación y edición de video que combina un planificador semántico basado en MLLM con un renderizador basado en DiT.
★ 1300+10Variación de estrellas de los últimos 7 días - #65
Código para el artículo sobre representaciones de movimiento para animación articulada.
★ 1277+0Variación de estrellas de los últimos 7 días - #66★ 1260+11Variación de estrellas de los últimos 7 días
- #67
Presentamos StableAvatar, el primer transformer de difusión de video de extremo a extremo, que sintetiza videos de avatares de alta calidad y duración infinita impulsados por audio sin necesidad de posprocesamiento, condicionado a una imagen de referencia y audio.
★ 1258-1Variación de estrellas de los últimos 7 días - #68
Skill de generación de B-roll con collage de papel semitono: aprobación de tres puertas, ensamblaje de animación de fotogramas inicial y final con Gemini Omni Flash.
★ 1238+19Variación de estrellas de los últimos 7 días - #69
[SIGGRAPH Asia 2026] 4DAnyone: Create Anyone in 4D from a Casual Monocular Video
★ 1237+296Variación de estrellas de los últimos 7 días - #70
HunyuanCustom: Una arquitectura impulsada por multimodalidad para la generación de video personalizada.
★ 1228-1Variación de estrellas de los últimos 7 días - #71
Free open-source project designed for turning youtube-viedos into viral short videos. Highlight detection, subtitles, translation, voiceover, all in one for your content.
★ 1219—Variación de estrellas de los últimos 7 días - #72
Código para el artículo de SCIS-2025 "UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation".
★ 1189-1Variación de estrellas de los últimos 7 días - #73
Wunjo CE: Intercambio de rostros, sincronización labial, eliminación de objetos, texto y fondos, reestilización, separador de audio, clonación de voz y generación de video. De código abierto, local y gratuito.
★ 1170+1Variación de estrellas de los últimos 7 días - #74
[ICLR24] Implementación oficial del artículo “MagicDrive: Street View Generation with Diverse 3D Geometry Control”
★ 1167+1Variación de estrellas de los últimos 7 días - #75
Servidor de inferencia LLM nativo para Apple Silicon. Compatible con la API de OpenAI y Anthropic. Sin Python. Incluye la aplicación MLX Core para macOS con chat, modo agente y llamada a herramientas.
★ 1115+245Variación de estrellas de los últimos 7 días - #76★ 1110+5Variación de estrellas de los últimos 7 días
- #77
[ECCV 2024 Oral] MotionDirector: personalización de movimiento para modelos de difusión de texto a video.
★ 1054+2Variación de estrellas de los últimos 7 días - #78
SCAIL: Hacia una animación de personajes de calidad de estudio mediante el aprendizaje en contexto de representaciones de pose consistentes en 3D (CVPR 2026 Findings).
★ 1049+4Variación de estrellas de los últimos 7 días - #79
[ICML2025] SpargeAttention: una atención dispersa sin entrenamiento que acelera la inferencia de cualquier modelo.
★ 1046+3Variación de estrellas de los últimos 7 días - #80
[AAAI 2026] EchoMimicV3: 1.3B de parámetros es todo lo que necesitas para la animación humana multimodal y multitarea unificada
★ 1040+10Variación de estrellas de los últimos 7 días - #81
Una lista curada de recursos, herramientas, habilidades, tutoriales y artículos sobre OpenClaw. OpenClaw (anteriormente Moltbot / Clawdbot) es un agente de IA de código abierto autohospedado para WhatsApp, Telegram, Discord y más de 50 integraciones.
★ 1005+8Variación de estrellas de los últimos 7 días - #82
Provider-neutral Codex Skill for producing verified AI presenter videos from a script and an authorized presenter image.
★ 997+25Variación de estrellas de los últimos 7 días - #83
[TPAMI 2026] Modelado del mundo 3D y 4D: Un estudio
★ 982+9Variación de estrellas de los últimos 7 días - #84
Una lista de artículos sobre trabajos recientes de Visión Artificial (CV)
★ 973+1Variación de estrellas de los últimos 7 días - #85
Animación de imágenes de dominio abierto de grano fino con guía de movimiento.
★ 971-1Variación de estrellas de los últimos 7 días - #86
[ICLR 2024] SEINE: Modelo de difusión de video de corto a largo plazo para transición y predicción generativa
★ 967+0Variación de estrellas de los últimos 7 días - #87
Un sistema de bots que recopila clips automáticamente mediante filtros personalizados, permite navegar fácilmente por ellos y los compila en un video listo para subir a cualquier plataforma de redes sociales. Incluye soporte completo para VPS y un sistema de cuentas para múltiples usuarios. El bot se divide en tres programas: el servidor, el cliente y el...
★ 959+2Variación de estrellas de los últimos 7 días - #88
[ICML 2026] Repositorio oficial para "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" y Causal Forcing++
★ 953+12Variación de estrellas de los últimos 7 días - #89
Escalado de preentrenamiento de video Mixture-of-Experts para inteligencia incorporada
★ 947+8Variación de estrellas de los últimos 7 días - #90
Generación de video a partir de texto e imagen, primera generación
★ 919-2Variación de estrellas de los últimos 7 días