diffusion-models
Repositórios de código aberto acompanhados marcados com diffusion-models, ordenados por estrelas.
- #61
Treinamento escalável e otimizado em memória de modelos de difusão.
★ 1.359+1Variação de estrelas nos últimos 7 dias - #62
[ICASSP 2024] 🍵 Matcha-TTS: Uma arquitetura de TTS rápida com conditional flow matching
★ 1.353+4Variação de estrelas nos últimos 7 dias - #63
[ICLR 2023 Oral] Restauração de imagem Zero-Shot usando Denoising Diffusion Null-Space Model.
★ 1.351+2Variação de estrelas nos últimos 7 dias - #64
FireRed-Image-Edit é um poderoso modelo base de edição de imagem que alcança desempenho de ponta de código aberto com seguimento preciso de instruções, geração de alta fidelidade, consistência de identidade superior e fusão perfeita de múltiplos elementos.
★ 1.350+6Variação de estrelas nos últimos 7 dias - #65
[AAAI 2025] 👔IMAGDressing👔: Geração Modular e Interativa de Vestuário para Provador Virtual. Permite a geração de imagens humanas personalizáveis com controle flexível de roupas, poses e cenas, garantindo alta fidelidade e consistência das peças para provadores virtuais.
★ 1.343+0Variação de estrelas nos últimos 7 dias - #66
[TPAMI 2025🔥] MagicTime: Modelos de geração de vídeo time-lapse como simuladores metamórficos.
★ 1.337-1Variação de estrelas nos últimos 7 dias - #67
Pacote portátil para executar o Hunyuan3D 2.0/2.1 no Windows.
★ 1.326+5Variação de estrelas nos últimos 7 dias - #68
Pruna é um framework de otimização de modelos criado para desenvolvedores, permitindo entregar modelos mais rápidos e eficientes com o mínimo de sobrecarga.
★ 1.274+2Variação de estrelas nos últimos 7 dias - #69
[CVPR 2025 Oral & Finalista de Melhor Artigo] Difix3D+: Melhorando reconstruções 3D com modelos de difusão de passo único.
★ 1.267+0Variação de estrelas nos últimos 7 dias - #70
[CVPR2024, Highlight] Código oficial para o DragDiffusion
★ 1.259+0Variação de estrelas nos últimos 7 dias - #71★ 1.238-1Variação de estrelas nos últimos 7 dias
- #72
Um modelo de conversão de texto em fala baseado em Flow Matching com controle de estilo via emoji
★ 1.228+8Variação de estrelas nos últimos 7 dias - #73
HunyuanCustom: Uma arquitetura multimodal para geração de vídeo personalizada.
★ 1.228+1Variação de estrelas nos últimos 7 dias - #74
Implementação em PyTorch de MeanFlow e iMF (modelagem generativa de passo único).
★ 1.196+0Variação de estrelas nos últimos 7 dias - #75
Wunjo CE: Troca de rosto, sincronia labial, remoção de objetos, texto e fundo, reestilização, separador de áudio, clonagem de voz, geração de vídeo. Código aberto, local e gratuito.
★ 1.170+1Variação de estrelas nos últimos 7 dias - #76
[ICLR24] Implementação oficial do artigo “MagicDrive: Street View Generation with Diverse 3D Geometry Control”
★ 1.167+1Variação de estrelas nos últimos 7 dias - #77
Uma coleção de recursos sobre geração controlável com modelos de difusão text-to-image.
★ 1.110+0Variação de estrelas nos últimos 7 dias - #78★ 1.108+4Variação de estrelas nos últimos 7 dias
- #79
Stable Diffusion implementado do zero em PyTorch
★ 1.078-1Variação de estrelas nos últimos 7 dias - #80
[Destaque ICLR'24] Séries de Modelos Grandes Multimodais em Chinês e Inglês (Chat e Paint) | Baseado no modelo base CPM, série de grandes modelos multimodais bilíngues em chinês e inglês
★ 1.061+0Variação de estrelas nos últimos 7 dias - #81
[ECCV 2024 Oral] MotionDirector: Personalização de movimento para modelos de difusão de texto para vídeo.
★ 1.053+3Variação de estrelas nos últimos 7 dias - #82
[ICLR 2025 Oral] A implementação oficial de "Diffusion-Based Planning for Autonomous Driving with Flexible Guidance".
★ 1.050+5Variação de estrelas nos últimos 7 dias - #83
[CVPR 2025 Highlight] 3DTopia-XL: Geração de ativos PBR 3D de alta qualidade via Primitive Diffusion
★ 1.046+1Variação de estrelas nos últimos 7 dias - #84
[ICLR 2024 Spotlight] SyncDreamer: Geração de imagens consistentes de múltiplas vistas a partir de uma imagem de vista única
★ 1.044+0Variação de estrelas nos últimos 7 dias - #85
Implementação oficial do artigo: "FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models"
★ 1.013-1Variação de estrelas nos últimos 7 dias - #86★ 986+24Variação de estrelas nos últimos 7 dias
- #87
[CVPR 2024] PIA, seu animador de imagens personalizado. Anime suas imagens por meio de comandos de texto, combinando com Dreambooth, alcançando vídeos impressionantes.
★ 975+0Variação de estrelas nos últimos 7 dias - #88★ 970+0Variação de estrelas nos últimos 7 dias
- #89★ 969+0Variação de estrelas nos últimos 7 dias
- #90
[ICLR 2026] Framework iterativo sem treinamento para visualização de histórias longas
★ 959+1Variação de estrelas nos últimos 7 dias