text-to-video
Repositórios de código aberto acompanhados marcados com text-to-video, ordenados por estrelas.
- #31
✨ Hotshot-XL: Modelo de IA de texto para GIF de última geração treinado para funcionar junto com o Stable Diffusion XL
★ 1.110-1Variação de estrelas nos últimos 7 dias - #32
[NeurIPS 2024] Uma implementação oficial de "ShareGPT4Video: Improving Video Understanding and Generation with Better Captions"
★ 1.094+1Variação de estrelas nos últimos 7 dias - #33
HunyuanVideo-Foley: Difusão multimodal com alinhamento de representação para geração de áudio Foley de alta fidelidade.
★ 1.057+3Variação de estrelas nos últimos 7 dias - #34
[ECCV 2024 Oral] MotionDirector: Personalização de movimento para modelos de difusão de texto para vídeo.
★ 1.054+1Variação de estrelas nos últimos 7 dias - #35
Uma lista curada de recursos, ferramentas, habilidades, tutoriais e artigos sobre OpenClaw. OpenClaw (anteriormente Moltbot / Clawdbot) — agente de IA open-source auto-hospedado para WhatsApp, Telegram, Discord e mais de 50 integrações.
★ 1.005+8Variação de estrelas nos últimos 7 dias - #36
Gerador de texto para vídeo no formato brainrot. Aprenda sobre qualquer tópico com suas personalidades favoritas 😼.
★ 960+0Variação de estrelas nos últimos 7 dias - #37
[ICML 2026] Base de código oficial para "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" & Causal Forcing++
★ 953+9Variação de estrelas nos últimos 7 dias - #38
Geração de vídeo a partir de texto e imagem, 1ª geração
★ 918-2Variação de estrelas nos últimos 7 dias - #39
[Destaque CVPR 2025] Geração de vídeo a partir de texto com preservação de identidade via decomposição de frequência
★ 857+1Variação de estrelas nos últimos 7 dias - #40
Kandinsky 5.0: Uma família de modelos de difusão para geração de vídeo e imagem
★ 823+5Variação de estrelas nos últimos 7 dias - #41
Gere vídeos a partir de texto usando IA
★ 821+4Variação de estrelas nos últimos 7 dias - #42
Gere cenas 3D exploráveis em larga escala com vídeos panorâmicos de alta qualidade a partir de uma única imagem ou comando de texto.
★ 816+1Variação de estrelas nos últimos 7 dias - #43
CLIP + FFT/DWT/RGB = texto para imagem/vídeo
★ 789+0Variação de estrelas nos últimos 7 dias - #44
Implementação do Phenaki Video em PyTorch, que usa MaskGIT para gerar vídeos guiados por texto de até 2 minutos de duração.
★ 789+0Variação de estrelas nos últimos 7 dias - #45
ClipForge (anteriormente 'daihuo-jianshou'): Ferramenta de código aberto de IA para vídeos curtos de comércio eletrônico — envie a imagem de um produto e a IA extrai automaticamente os pontos de venda, escreve roteiros, mantém a imagem original do produto sem distorção e adiciona visuais, narração e legendas. Produza vídeos de vendas em lote com custo zero, código aberto sem marca d'água e implantação local. Também suporta a criação de vídeos a partir de um tema em uma frase. Gerador de vídeos curtos de e-commerce/UGC com IA de código aberto.
★ 748+67Variação de estrelas nos últimos 7 dias - #46
Um Levantamento sobre Geração/Síntese de Texto para Vídeo.
★ 744+3Variação de estrelas nos últimos 7 dias - #47
Integração e Exploração Multimodal do Paddle, dando suporte a tarefas multimodais principais, incluindo modelos de pré-treinamento multimodal em larga escala de ponta a ponta e caixa de ferramentas de modelos de difusão. Equipado com alto desempenho e flexibilidade.
★ 723-1Variação de estrelas nos últimos 7 dias - #48
Topic in, narrated explainer video out. A Claude Code / Codex skill that turns any topic into a black-canvas motion-graphics explainer video with TTS voiceover, subtitles and a chapter progress bar. Chinese or English; every frame drawn in code with Remotion.
★ 697—Variação de estrelas nos últimos 7 dias - #49★ 685+0Variação de estrelas nos últimos 7 dias
- #50
GPT Image 2 to Seedance 2.5 Early Access workflow guide.
★ 589+2Variação de estrelas nos últimos 7 dias - #51
Códigos oficiais do VEnhancer: Generative Space-Time Enhancement for Video Generation
★ 579+0Variação de estrelas nos últimos 7 dias - #52★ 553+0Variação de estrelas nos últimos 7 dias
- #53
🔥🔥🔥 Uma lista selecionada de artigos sobre geração multimodal baseada em LLMs (imagem, vídeo, 3D e áudio).
★ 552+0Variação de estrelas nos últimos 7 dias - #54
[ECCV 2024] FreeInit: Preenchendo a lacuna de inicialização em modelos de difusão de vídeo
★ 543+0Variação de estrelas nos últimos 7 dias - #55
Geração de filmes com IA paralela orientada por DAG multi-modelo — aceleração paralela escalável com a independência das cenas; gera cenas de filme simultaneamente em vez de uma a uma; motor de geração de filmes que modela dependências narrativas como um DAG e utiliza o algoritmo CPM para agendamento paralelo
★ 537+2Variação de estrelas nos últimos 7 dias - #56
Transforme seu agente de codificação em um estúdio de vídeo: descreva um vídeo em linguagem simples, e seu agente escreve a linha do tempo e produz o arquivo.
★ 525+0Variação de estrelas nos últimos 7 dias - #57
An all-in-one, 100% local AI video, image, and music studio. Director mode plans full music videos and short films from a single prompt. Built on the WanGP pipeline. Install via Pinokio.
★ 524—Variação de estrelas nos últimos 7 dias - #58
A Collection of Google Colab Notebooks for various projects
★ 521+1Variação de estrelas nos últimos 7 dias - #59
Open-source AI video workbench. Bring any model or your local ComfyUI, and let Claude Code / Codex / Cursor direct it over MCP — storyboard, references, generation, editable first cut on a real timeline. Local-first: projects, prompts, and keys stay on your machine. No account, no telemetry.
★ 505—Variação de estrelas nos últimos 7 dias