video-generation
Repositórios de código aberto acompanhados marcados com video-generation, ordenados por estrelas.
- #61
[TPAMI 2025🔥] MagicTime: Modelos de geração de vídeo time-lapse como simuladores metamórficos.
★ 1.337-1Variação de estrelas nos últimos 7 dias - #62
Um modelo multimodal nativo unificado com 3B de parâmetros ativos para compreensão, geração e edição de imagens e vídeos.
★ 1.334+3Variação de estrelas nos últimos 7 dias - #63
Cria vídeos curtos para TikTok, Instagram Reels e YouTube Shorts usando o Model Context Protocol (MCP) e uma API REST.
★ 1.327+9Variação de estrelas nos últimos 7 dias - #64
Bernini é um framework unificado para geração e edição de vídeo que combina um planejador semântico baseado em MLLM com um renderizador baseado em DiT.
★ 1.300+10Variação de estrelas nos últimos 7 dias - #65
Código para o artigo Motion Representations for Articulated Animation
★ 1.277+0Variação de estrelas nos últimos 7 dias - #66★ 1.260+11Variação de estrelas nos últimos 7 dias
- #67
Apresentamos o StableAvatar, o primeiro transformador de difusão de vídeo de ponta a ponta, que sintetiza vídeos de avatar guiados por áudio de alta qualidade e duração infinita, sem qualquer pós-processamento, condicionados a uma imagem de referência e áudio.
★ 1.258-1Variação de estrelas nos últimos 7 dias - #68
Skill de geração de B-roll com colagem de papel em meio-tom: aprovação de três estágios, montagem de animação de quadros iniciais e finais com Gemini Omni Flash
★ 1.238+19Variação de estrelas nos últimos 7 dias - #69
[SIGGRAPH Asia 2026] 4DAnyone: Create Anyone in 4D from a Casual Monocular Video
★ 1.229+296Variação de estrelas nos últimos 7 dias - #70
HunyuanCustom: Uma arquitetura multimodal para geração de vídeo personalizada.
★ 1.228-1Variação de estrelas nos últimos 7 dias - #71
Código para o artigo do SCIS-2025 "UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation".
★ 1.189-1Variação de estrelas nos últimos 7 dias - #72
Free open-source project designed for turning youtube-viedos into viral short videos. Highlight detection, subtitles, translation, voiceover, all in one for your content.
★ 1.178—Variação de estrelas nos últimos 7 dias - #73
Wunjo CE: Troca de rosto, sincronia labial, remoção de objetos, texto e fundo, reestilização, separador de áudio, clonagem de voz, geração de vídeo. Código aberto, local e gratuito.
★ 1.170+1Variação de estrelas nos últimos 7 dias - #74
[ICLR24] Implementação oficial do artigo “MagicDrive: Street View Generation with Diverse 3D Geometry Control”
★ 1.167+1Variação de estrelas nos últimos 7 dias - #75
Servidor de inferência LLM nativo para Apple Silicon. Compatível com a API da OpenAI e Anthropic. Sem Python. Inclui o aplicativo MLX Core para macOS com chat, modo agente e chamada de ferramentas.
★ 1.115+245Variação de estrelas nos últimos 7 dias - #76★ 1.110+5Variação de estrelas nos últimos 7 dias
- #77
[ECCV 2024 Oral] MotionDirector: Personalização de movimento para modelos de difusão de texto para vídeo.
★ 1.053+2Variação de estrelas nos últimos 7 dias - #78
SCAIL: Rumo à animação de personagens de nível de estúdio via aprendizado em contexto de representações de pose 3D consistentes (CVPR 2026 Findings).
★ 1.049+4Variação de estrelas nos últimos 7 dias - #79
[ICML2025] SpargeAttention: Uma atenção esparsa livre de treinamento que acelera a inferência de qualquer modelo.
★ 1.045+3Variação de estrelas nos últimos 7 dias - #80
[AAAI 2026] EchoMimicV3: 1.3B Parâmetros são Tudo o que Você Precisa para Animação Humana Multimodal e Multitarefa Unificada
★ 1.040+10Variação de estrelas nos últimos 7 dias - #81
Uma lista curada de recursos, ferramentas, habilidades, tutoriais e artigos sobre OpenClaw. OpenClaw (anteriormente Moltbot / Clawdbot) — agente de IA open-source auto-hospedado para WhatsApp, Telegram, Discord e mais de 50 integrações.
★ 1.005+8Variação de estrelas nos últimos 7 dias - #82
Provider-neutral Codex Skill for producing verified AI presenter videos from a script and an authorized presenter image.
★ 997+25Variação de estrelas nos últimos 7 dias - #83
[TPAMI 2026] Modelagem de Mundo 3D e 4D: Uma Pesquisa
★ 982+9Variação de estrelas nos últimos 7 dias - #84
Lista de artigos de trabalhos recentes em Visão Computacional (CV)
★ 973+1Variação de estrelas nos últimos 7 dias - #85
Animação de imagem de domínio aberto de granulação fina com orientação de movimento
★ 971-1Variação de estrelas nos últimos 7 dias - #86
[ICLR 2024] SEINE: Modelo de Difusão de Vídeo de Curto para Longo Prazo para Transição e Predição Generativa
★ 967+0Variação de estrelas nos últimos 7 dias - #87
Um sistema de bots que coleta clipes automaticamente por meio de filtros personalizados, permite navegar facilmente por esses clipes e os reúne em um vídeo de compilação pronto para ser enviado diretamente para qualquer plataforma de mídia social. Suporte completo a VPS é fornecido, juntamente com um sistema de contas para que vários usuários possam usar o bot ao mesmo tempo. Este bot é dividido em três programas separados: o servidor, o cliente e o
★ 958+2Variação de estrelas nos últimos 7 dias - #88
[ICML 2026] Base de código oficial para "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" & Causal Forcing++
★ 950+12Variação de estrelas nos últimos 7 dias - #89
Escalonamento de pré-treinamento de vídeo Mixture-of-Experts para Inteligência Embodied
★ 946+8Variação de estrelas nos últimos 7 dias - #90
Geração de vídeo a partir de texto e imagem, 1ª geração
★ 919-2Variação de estrelas nos últimos 7 dias