Pular para o conteúdo principal
buildradar
Sign in
Tópico · video-generation

video-generation

Repositórios de código aberto acompanhados marcados com video-generation, ordenados por estrelas.

153 repositórios
  • Encadeamento de Clip para MiniMax H3 no ComfyUI - movimento e áudio continuam genuinamente através das junções

    914+139Variação de estrelas nos últimos 7 dias
  • FollowYourClick@mayuelala

    [AAAI 2025] Follow-Your-Click: Este repositório é a implementação oficial de "Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts"

    908-1Variação de estrelas nos últimos 7 dias
  • Vista@OpenDriveLab

    [NeurIPS 2024] Um Modelo de Mundo Generalizável para Direção Autônoma

    896+1Variação de estrelas nos últimos 7 dias
  • ditto-talkinghead@antgroup

    [ACM MM 2025] Ditto: Difusão no Espaço de Movimento para Síntese Controlável de Talking Head em Tempo Real

    878+6Variação de estrelas nos últimos 7 dias
  • SeedVR2@IceClear

    [ICLR2026] SeedVR2: Restauração de vídeo em passo único via pós-treinamento adversarial por difusão

    865+9Variação de estrelas nos últimos 7 dias
  • ConsisID@PKU-YuanGroup

    [Destaque CVPR 2025] Geração de vídeo a partir de texto com preservação de identidade via decomposição de frequência

    857+1Variação de estrelas nos últimos 7 dias
  • UniAnimate-DiT@ali-vilab

    UniAnimate-DiT: Animação de imagem humana com Transformer de difusão de vídeo em larga escala

    850-2Variação de estrelas nos últimos 7 dias
  • DiffusionAsShader@IGL-HKUST

    [SIGGRAPH 2025] Diffusion as Shader: Difusão de vídeo 3D-aware para controle versátil de geração de vídeo

    833+1Variação de estrelas nos últimos 7 dias
  • Implementação oficial para "RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers" (ICML 2025), UltraViCo (ICLR 2026) e UltraImage

    827+2Variação de estrelas nos últimos 7 dias
  • flatkey-cli@flatkey-ai

    CLI de geração de mídia Flatkey para imagens, vídeos, áudio, texto, créditos e descoberta de modelos.

    825+176Variação de estrelas nos últimos 7 dias
  • lmms-engine@EvolvingLMMs-Lab

    Um mecanismo de treinamento de modelos multimodais simples e unificado. Enxuto, flexível e criado para hacking em escala.

    824+0Variação de estrelas nos últimos 7 dias
  • Text-To-Video-AI@SamurAIGPT

    Gere vídeos a partir de texto usando IA

    821+6Variação de estrelas nos últimos 7 dias
  • kandinsky-5@kandinskylab

    Kandinsky 5.0: Uma família de modelos de difusão para geração de vídeo e imagem

    820+3Variação de estrelas nos últimos 7 dias
  • Matrix-3D@SkyworkAI

    Gere cenas 3D exploráveis em larga escala com vídeos panorâmicos de alta qualidade a partir de uma única imagem ou comando de texto.

    816+11Variação de estrelas nos últimos 7 dias
  • [TMLR 2025🔥] Uma pesquisa sobre modelos autorregressivos em visão.

    808+1Variação de estrelas nos últimos 7 dias
  • open-webui-tools@Haervwe

    Open‑WebUI Tools é um kit de ferramentas modular projetado para estender e enriquecer sua instância do Open WebUI, transformando-a em uma poderosa estação de trabalho de IA. Com um conjunto de mais de 15 ferramentas especializadas, pipelines de funções e filtros, este projeto oferece suporte a pesquisa acadêmica, autonomia de agentes, criatividade multimodal, fluxos de trabalho e muito mais.

    806+4Variação de estrelas nos últimos 7 dias
  • DriveAGI@OpenDriveLab

    [CVPR 2024 Highlight] GenAD: Modelo Preditivo Generalizado para Direção Autônoma

    805+0Variação de estrelas nos últimos 7 dias
  • rcm@NVlabs

    rCM & Causal-rCM: Algoritmos e infraestruturas líderes e unificados para destilação de difusão de vídeo bidirecional/autorregressiva em larga escala

    800+6Variação de estrelas nos últimos 7 dias
  • InfinityStar@FoundationVision

    [NeurIPS 2025 Oral] Infinity⭐️: Modelagem Auto-Regressiva Espaço-Temporal Unificada para Geração Visual

    784+4Variação de estrelas nos últimos 7 dias
  • Uma coleção de estudos incríveis sobre geração de vídeo.

    782+0Variação de estrelas nos últimos 7 dias
  • MagicDance@Boese0601

    [ICML 2024] MagicPose (também conhecido como MagicDance): Retargeting realista de poses humanas e expressões faciais com difusão consciente de identidade.

    776+0Variação de estrelas nos últimos 7 dias
  • ima2-gen@lidge-jun

    Runtime e estúdio de geração visual local-first para pessoas e agentes de codificação, com fluxos de trabalho de imagem e vídeo reproduzíveis em múltiplos provedores.

    749+27Variação de estrelas nos últimos 7 dias
  • Um Levantamento sobre Geração/Síntese de Texto para Vídeo.

    744+2Variação de estrelas nos últimos 7 dias
  • cosmos-transfer2.5@nvidia-cosmos

    Cosmos-Transfer2.5, construído sobre o Cosmos-Predict2.5, produz simulações de mundo de alta qualidade condicionadas a múltiplas entradas de controle espacial.

    735+4Variação de estrelas nos últimos 7 dias
  • MagicDrive-V2@flymin

    [ICCV 2025] Implementação oficial do artigo "MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control"

    729+1Variação de estrelas nos últimos 7 dias
  • comfyui-mcp@artokun

    Plano de controle local e nativo para agentes para o ComfyUI — servidor MCP + agente de barra lateral que gera imagens, vídeo e áudio, cria e executa fluxos de trabalho e edita seu gráfico em tempo real usando linguagem natural com QUALQUER LLM (Claude, ChatGPT, Gemini, Ollama offline ou qualquer modelo hospedado). 178 ferramentas, 36 habilidades de IA, 55 pacotes de instalador. Local, LAN, VPS ou Comfy Cloud.

    729+33Variação de estrelas nos últimos 7 dias
  • nano-world-model@simchowitzlabpublic

    Um repositório minimalista e completo para o avanço da ciência de Modelos de Mundo.

    729+6Variação de estrelas nos últimos 7 dias
  • [ICML 2025] Implementação oficial em PyTorch de 'History-Guided Video Diffusion'.

    709+1Variação de estrelas nos últimos 7 dias
  • ChronoEdit@nv-tlabs

    [ICLR 2026] ChronoEdit: Rumo ao raciocínio temporal para edição de imagens e simulação de mundos

    706+1Variação de estrelas nos últimos 7 dias
  • SparkVSR@taco-group

    [ECCV 2026] SparkVSR: Super-resolução de vídeo interativa via propagação de keyframes esparsos

    702+3Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos