diffusion-models
Repositórios de código aberto acompanhados marcados com diffusion-models, ordenados por estrelas.
- #31
Coleção de artigos sobre modelos de difusão categorizados por subáreas.
★ 2.224+0Variação de estrelas nos últimos 7 dias - #32
Implementação em PyTorch para Score-Based Generative Modeling através de Equações Diferenciais Estocásticas (ICLR 2021, Oral)
★ 2.130+0Variação de estrelas nos últimos 7 dias - #33★ 2.129+52Variação de estrelas nos últimos 7 dias
- #34
Modelos de difusão em imagens médicas (publicado no periódico Medical Image Analysis).
★ 2.110+1Variação de estrelas nos últimos 7 dias - #35
[NeurIPS 2025] A edição de imagem vale um único LoRA! 0,1% de dados de treinamento para uma edição de imagem fantástica! Supera o GPT-4o na persistência de ID~ MoE ckpt lançado! Apenas 4GB de VRAM são suficientes para executar!
★ 2.104+2Variação de estrelas nos últimos 7 dias - #36
DIAMOND (DIffusion As a Model Of eNvironment Dreams) é um agente de aprendizado por reforço treinado em um modelo de mundo de difusão. NeurIPS 2024 Spotlight.
★ 2.100+3Variação de estrelas nos últimos 7 dias - #37
Repositório de código para Zero123++: um modelo base de difusão de imagem única para múltiplas vistas consistentes.
★ 2.096+0Variação de estrelas nos últimos 7 dias - #38
Uma lista de leitura sobre segurança, proteção e privacidade de grandes modelos (incluindo Awesome LLM Security, Safety, etc.).
★ 2.070+3Variação de estrelas nos últimos 7 dias - #39
Custom Diffusion: Personalização de múltiplos conceitos em modelos de difusão texto-para-imagem (CVPR 2023)
★ 1.977-1Variação de estrelas nos últimos 7 dias - #40
[ICLR & NeurIPS 2025] Repositório para a série Show-o, um único Transformer para unificar a compreensão e geração multimodal.
★ 1.975+2Variação de estrelas nos últimos 7 dias - #41
Modelo autorregressivo supera difusão: 🦙 Llama para geração de imagens escalável
★ 1.966+0Variação de estrelas nos últimos 7 dias - #42★ 1.964+0Variação de estrelas nos últimos 7 dias
- #43
[ICCV 2023] Make-It-3D: Criação 3D de alta fidelidade a partir de uma única imagem com Diffusion Prior
★ 1.891+0Variação de estrelas nos últimos 7 dias - #44
Código oficial para "DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps" (Neurips 2022 Oral).
★ 1.852+0Variação de estrelas nos últimos 7 dias - #45
HunyuanVideo-I2V: Um modelo personalizável de imagem para vídeo baseado no HunyuanVideo
★ 1.840+0Variação de estrelas nos últimos 7 dias - #46
[ICLR 2025] CatVTON é um modelo de difusão de prova virtual simples e eficiente com 1) Rede leve (899,06M de parâmetros no total), 2) Treinamento eficiente em parâmetros (49,57M de parâmetros treináveis) e 3) Inferência simplificada (< 8G VRAM para resolução 1024X768).
★ 1.831+7Variação de estrelas nos últimos 7 dias - #47
[CVPR 2026] Rumo à super-resolução de vídeo em streaming baseada em difusão em tempo real — Um framework de difusão de passo único eficiente para VSR em streaming com atenção esparsa restrita por localidade e um pequeno decodificador condicional.
★ 1.815+16Variação de estrelas nos últimos 7 dias - #48
Coleta de artigos sobre RAG para AIGC. Propomos uma taxonomia de fundamentos, aprimoramentos e aplicações de RAG no artigo "Retrieval-Augmented Generation for AI-Generated Content: A Survey".
★ 1.789+0Variação de estrelas nos últimos 7 dias - #49
[ECCV 2024] Implementação oficial do artigo "BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion"
★ 1.744-1Variação de estrelas nos últimos 7 dias - #50
[ICLR'25 Oral] Alinhamento de Representação para Geração: Treinar Diffusion Transformers é mais fácil do que você pensa.
★ 1.706+6Variação de estrelas nos últimos 7 dias - #51
[NeurIPS 2023] ImageReward: Aprendendo e avaliando preferências humanas para geração de texto para imagem
★ 1.703+1Variação de estrelas nos últimos 7 dias - #52
MMaDA - Modelos de Linguagem de Difusão Multimodal de código aberto (dLLMs com difusão em bloco, CoT misto, RL unificado)
★ 1.671+3Variação de estrelas nos últimos 7 dias - #53
Uma lista curada de recursos sobre modelos de difusão em RL (atualizada continuamente).
★ 1.635+3Variação de estrelas nos últimos 7 dias - #54
[ACM MM 2025] FantasyTalking: Geração realista de retratos falantes via síntese de movimento coerente.
★ 1.628+0Variação de estrelas nos últimos 7 dias - #55
[ICLR'24] Implementação oficial em PyTorch do Magic123: Geração de Objetos 3D de Alta Qualidade a partir de Uma Imagem Usando Priors de Difusão 2D e 3D
★ 1.622-1Variação de estrelas nos últimos 7 dias - #56
Implementação oficial de "MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling"
★ 1.579+1Variação de estrelas nos últimos 7 dias - #57
Implementação do DiffDock: Passos de difusão, torções e voltas para acoplamento molecular
★ 1.570+1Variação de estrelas nos últimos 7 dias - #58
O repositório oficial de código para a segunda edição do livro da O'Reilly: Generative Deep Learning: Teaching Machines to Paint, Write, Compose and Play.
★ 1.553+7Variação de estrelas nos últimos 7 dias - #59
Inpainting de alta qualidade sem necessidade de treinamento para qualquer modelo de Stable Diffusion. Suporta ComfyUI.
★ 1.372+9Variação de estrelas nos últimos 7 dias - #60
Timestep Embedding Tells: É hora de fazer cache para o modelo de difusão de vídeo
★ 1.371+2Variação de estrelas nos últimos 7 dias