Pular para o conteúdo principal
buildradar
Sign in
Tópico · diffusion-models

diffusion-models

Repositórios de código aberto acompanhados marcados com diffusion-models, ordenados por estrelas.

163 repositórios
  • Coleção de artigos sobre modelos de difusão categorizados por subáreas.

    2.224+0Variação de estrelas nos últimos 7 dias
  • score_sde_pytorch@yang-song

    Implementação em PyTorch para Score-Based Generative Modeling através de Equações Diferenciais Estocásticas (ICLR 2021, Oral)

    2.130+0Variação de estrelas nos últimos 7 dias
  • Helios@PKU-YuanGroup

    Helios: Modelo de geração de vídeo longo em tempo real real.

    2.129+52Variação de estrelas nos últimos 7 dias
  • Modelos de difusão em imagens médicas (publicado no periódico Medical Image Analysis).

    2.110+1Variação de estrelas nos últimos 7 dias
  • ICEdit@River-Zhang

    [NeurIPS 2025] A edição de imagem vale um único LoRA! 0,1% de dados de treinamento para uma edição de imagem fantástica! Supera o GPT-4o na persistência de ID~ MoE ckpt lançado! Apenas 4GB de VRAM são suficientes para executar!

    2.104+2Variação de estrelas nos últimos 7 dias
  • diamond@eloialonso

    DIAMOND (DIffusion As a Model Of eNvironment Dreams) é um agente de aprendizado por reforço treinado em um modelo de mundo de difusão. NeurIPS 2024 Spotlight.

    2.100+3Variação de estrelas nos últimos 7 dias
  • zero123plus@SUDO-AI-3D

    Repositório de código para Zero123++: um modelo base de difusão de imagem única para múltiplas vistas consistentes.

    2.096+0Variação de estrelas nos últimos 7 dias
  • Awesome-LM-SSP@CryptoAILab

    Uma lista de leitura sobre segurança, proteção e privacidade de grandes modelos (incluindo Awesome LLM Security, Safety, etc.).

    2.070+3Variação de estrelas nos últimos 7 dias
  • custom-diffusion@adobe-research

    Custom Diffusion: Personalização de múltiplos conceitos em modelos de difusão texto-para-imagem (CVPR 2023)

    1.977-1Variação de estrelas nos últimos 7 dias
  • Show-o@showlab

    [ICLR & NeurIPS 2025] Repositório para a série Show-o, um único Transformer para unificar a compreensão e geração multimodal.

    1.975+2Variação de estrelas nos últimos 7 dias
  • LlamaGen@FoundationVision

    Modelo autorregressivo supera difusão: 🦙 Llama para geração de imagens escalável

    1.966+0Variação de estrelas nos últimos 7 dias
  • onediff@siliconflow

    OneDiff: Uma biblioteca de aceleração pronta para uso para modelos de difusão.

    1.964+0Variação de estrelas nos últimos 7 dias
  • Make-It-3D@junshutang

    [ICCV 2023] Make-It-3D: Criação 3D de alta fidelidade a partir de uma única imagem com Diffusion Prior

    1.891+0Variação de estrelas nos últimos 7 dias
  • dpm-solver@LuChengTHU

    Código oficial para "DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps" (Neurips 2022 Oral).

    1.852+0Variação de estrelas nos últimos 7 dias
  • HunyuanVideo-I2V@Tencent-Hunyuan

    HunyuanVideo-I2V: Um modelo personalizável de imagem para vídeo baseado no HunyuanVideo

    1.840+0Variação de estrelas nos últimos 7 dias
  • CatVTON@Zheng-Chong

    [ICLR 2025] CatVTON é um modelo de difusão de prova virtual simples e eficiente com 1) Rede leve (899,06M de parâmetros no total), 2) Treinamento eficiente em parâmetros (49,57M de parâmetros treináveis) e 3) Inferência simplificada (< 8G VRAM para resolução 1024X768).

    1.831+7Variação de estrelas nos últimos 7 dias
  • FlashVSR@OpenImagingLab

    [CVPR 2026] Rumo à super-resolução de vídeo em streaming baseada em difusão em tempo real — Um framework de difusão de passo único eficiente para VSR em streaming com atenção esparsa restrita por localidade e um pequeno decodificador condicional.

    1.815+16Variação de estrelas nos últimos 7 dias
  • RAG-Survey@hymie122

    Coleta de artigos sobre RAG para AIGC. Propomos uma taxonomia de fundamentos, aprimoramentos e aplicações de RAG no artigo "Retrieval-Augmented Generation for AI-Generated Content: A Survey".

    1.789+0Variação de estrelas nos últimos 7 dias
  • BrushNet@TencentARC

    [ECCV 2024] Implementação oficial do artigo "BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion"

    1.744-1Variação de estrelas nos últimos 7 dias
  • REPA@sihyun-yu

    [ICLR'25 Oral] Alinhamento de Representação para Geração: Treinar Diffusion Transformers é mais fácil do que você pensa.

    1.706+6Variação de estrelas nos últimos 7 dias
  • ImageReward@zai-org

    [NeurIPS 2023] ImageReward: Aprendendo e avaliando preferências humanas para geração de texto para imagem

    1.703+1Variação de estrelas nos últimos 7 dias
  • MMaDA@Gen-Verse

    MMaDA - Modelos de Linguagem de Difusão Multimodal de código aberto (dLLMs com difusão em bloco, CoT misto, RL unificado)

    1.671+3Variação de estrelas nos últimos 7 dias
  • Uma lista curada de recursos sobre modelos de difusão em RL (atualizada continuamente).

    1.635+3Variação de estrelas nos últimos 7 dias
  • fantasy-talking@Fantasy-AMAP

    [ACM MM 2025] FantasyTalking: Geração realista de retratos falantes via síntese de movimento coerente.

    1.628+0Variação de estrelas nos últimos 7 dias
  • Magic123@guochengqian

    [ICLR'24] Implementação oficial em PyTorch do Magic123: Geração de Objetos 3D de Alta Qualidade a partir de Uma Imagem Usando Priors de Difusão 2D e 3D

    1.622-1Variação de estrelas nos últimos 7 dias
  • MIMO@menyifang

    Implementação oficial de "MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling"

    1.579+1Variação de estrelas nos últimos 7 dias
  • DiffDock@gcorso

    Implementação do DiffDock: Passos de difusão, torções e voltas para acoplamento molecular

    1.570+1Variação de estrelas nos últimos 7 dias
  • Generative_Deep_Learning_2nd_Edition@davidADSP

    O repositório oficial de código para a segunda edição do livro da O'Reilly: Generative Deep Learning: Teaching Machines to Paint, Write, Compose and Play.

    1.553+7Variação de estrelas nos últimos 7 dias
  • LanPaint@scraed

    Inpainting de alta qualidade sem necessidade de treinamento para qualquer modelo de Stable Diffusion. Suporta ComfyUI.

    1.372+9Variação de estrelas nos últimos 7 dias
  • TeaCache@ali-vilab

    Timestep Embedding Tells: É hora de fazer cache para o modelo de difusão de vídeo

    1.371+2Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos