text-to-video
Repositorios de código abierto monitorizados etiquetados con text-to-video, ordenados por estrellas.
- #31
Hotshot-XL: modelo de IA de texto a GIF de última generación entrenado para funcionar junto con Stable Diffusion XL.
★ 1110-1Variación de estrellas de los últimos 7 días - #32
[NeurIPS 2024] Implementación oficial de "ShareGPT4Video: Mejorando la comprensión y generación de video con mejores subtítulos"
★ 1094+1Variación de estrellas de los últimos 7 días - #33
HunyuanVideo-Foley: Difusión multimodal con alineación de representación para la generación de audio Foley de alta fidelidad.
★ 1057+3Variación de estrellas de los últimos 7 días - #34
[ECCV 2024 Oral] MotionDirector: personalización de movimiento para modelos de difusión de texto a video.
★ 1054+1Variación de estrellas de los últimos 7 días - #35
Una lista curada de recursos, herramientas, habilidades, tutoriales y artículos sobre OpenClaw. OpenClaw (anteriormente Moltbot / Clawdbot) es un agente de IA de código abierto autohospedado para WhatsApp, Telegram, Discord y más de 50 integraciones.
★ 1005+8Variación de estrellas de los últimos 7 días - #36
Generador de texto a video en formato brainrot. Aprende sobre cualquier tema de tus personalidades favoritas 😼.
★ 960+0Variación de estrellas de los últimos 7 días - #37
[ICML 2026] Repositorio oficial para "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" y Causal Forcing++
★ 953+9Variación de estrellas de los últimos 7 días - #38
Generación de video a partir de texto e imagen, primera generación
★ 918-2Variación de estrellas de los últimos 7 días - #39
[CVPR 2025 Highlight] Generación de video a partir de texto con preservación de identidad mediante descomposición de frecuencia.
★ 857+1Variación de estrellas de los últimos 7 días - #40
Kandinsky 5.0: Una familia de modelos de difusión para la generación de video e imagen.
★ 823+5Variación de estrellas de los últimos 7 días - #41
Generar video a partir de texto usando IA
★ 821+4Variación de estrellas de los últimos 7 días - #42
Genera escenas 3D explorables a gran escala con videos panorámicos de alta calidad a partir de una sola imagen o prompt de texto.
★ 816+1Variación de estrellas de los últimos 7 días - #43
CLIP + FFT/DWT/RGB = texto a imagen/video
★ 789+0Variación de estrellas de los últimos 7 días - #44
Implementación en PyTorch de Phenaki Video, que utiliza Mask GIT para producir videos guiados por texto de hasta 2 minutos de duración.
★ 789+0Variación de estrellas de los últimos 7 días - #45
ClipForge: Herramienta de código abierto de IA para generar videos cortos de comercio electrónico. Sube una imagen de producto y la IA extrae puntos de venta, escribe guiones, mantiene la imagen original sin deformaciones y añade imágenes, voz y subtítulos. Generación masiva de videos sin costo, sin marcas de agua y con despliegue local.
★ 748+67Variación de estrellas de los últimos 7 días - #46
Un estudio sobre la generación/síntesis de texto a video.
★ 744+3Variación de estrellas de los últimos 7 días - #47
Paddle Multimodal Integration and eXploration, que soporta tareas multimodales convencionales, incluyendo modelos de preentrenamiento multimodal a gran escala de extremo a extremo y un conjunto de herramientas de modelos de difusión. Equipado con alto rendimiento y flexibilidad.
★ 723-1Variación de estrellas de los últimos 7 días - #48
Topic in, narrated explainer video out. A Claude Code / Codex skill that turns any topic into a black-canvas motion-graphics explainer video with TTS voiceover, subtitles and a chapter progress bar. Chinese or English; every frame drawn in code with Remotion.
★ 697—Variación de estrellas de los últimos 7 días - #49★ 685+0Variación de estrellas de los últimos 7 días
- #50
GPT Image 2 to Seedance 2.5 Early Access workflow guide.
★ 589+2Variación de estrellas de los últimos 7 días - #51
Código oficial de VEnhancer: mejora espacio-temporal generativa para la generación de video.
★ 579+0Variación de estrellas de los últimos 7 días - #52★ 553+0Variación de estrellas de los últimos 7 días
- #53
🔥🔥🔥 Una lista seleccionada de artículos sobre generación multimodal basada en LLMs (imagen, video, 3D y audio).
★ 552+0Variación de estrellas de los últimos 7 días - #54
[ECCV 2024] FreeInit: Cerrando la brecha de inicialización en modelos de difusión de video
★ 543+0Variación de estrellas de los últimos 7 días - #55
Generación de cine con IA en paralelo impulsada por DAG multimodelo: la aceleración paralela escala con la independencia de la escena; genera escenas de cine simultáneamente en lugar de una por una; motor de generación cinematográfica que modela la narrativa de escenas como un DAG y utiliza el algoritmo CPM para la programación paralela.
★ 537+2Variación de estrellas de los últimos 7 días - #56
Convierte tu agente de programación en un estudio de video: describe un video en lenguaje sencillo y tu agente escribirá la línea de tiempo y producirá el archivo.
★ 525+0Variación de estrellas de los últimos 7 días - #57
An all-in-one, 100% local AI video, image, and music studio. Director mode plans full music videos and short films from a single prompt. Built on the WanGP pipeline. Install via Pinokio.
★ 524—Variación de estrellas de los últimos 7 días - #58
Una colección de notebooks de Google Colab para diversos proyectos
★ 521+1Variación de estrellas de los últimos 7 días - #59
Open-source AI video workbench. Bring any model or your local ComfyUI, and let Claude Code / Codex / Cursor direct it over MCP — storyboard, references, generation, editable first cut on a real timeline. Local-first: projects, prompts, and keys stay on your machine. No account, no telemetry.
★ 505—Variación de estrellas de los últimos 7 días