Pular para o conteúdo principal
buildradar
Sign in
Tópico · diffusion-models

diffusion-models

Repositórios de código aberto acompanhados marcados com diffusion-models, ordenados por estrelas.

163 repositórios
  • finetrainers@huggingface

    Treinamento escalável e otimizado em memória de modelos de difusão.

    1.359+1Variação de estrelas nos últimos 7 dias
  • Matcha-TTS@shivammehta25

    [ICASSP 2024] 🍵 Matcha-TTS: Uma arquitetura de TTS rápida com conditional flow matching

    1.353+4Variação de estrelas nos últimos 7 dias
  • DDNM@wyhuai

    [ICLR 2023 Oral] Restauração de imagem Zero-Shot usando Denoising Diffusion Null-Space Model.

    1.351+2Variação de estrelas nos últimos 7 dias
  • FireRed-Image-Edit@FireRedTeam

    FireRed-Image-Edit é um poderoso modelo base de edição de imagem que alcança desempenho de ponta de código aberto com seguimento preciso de instruções, geração de alta fidelidade, consistência de identidade superior e fusão perfeita de múltiplos elementos.

    1.350+6Variação de estrelas nos últimos 7 dias
  • IMAGDressing@muzishen

    [AAAI 2025] 👔IMAGDressing👔: Geração Modular e Interativa de Vestuário para Provador Virtual. Permite a geração de imagens humanas personalizáveis com controle flexível de roupas, poses e cenas, garantindo alta fidelidade e consistência das peças para provadores virtuais.

    1.343+0Variação de estrelas nos últimos 7 dias
  • MagicTime@PKU-YuanGroup

    [TPAMI 2025🔥] MagicTime: Modelos de geração de vídeo time-lapse como simuladores metamórficos.

    1.337-1Variação de estrelas nos últimos 7 dias
  • Hunyuan3D-2-WinPortable@YanWenKun

    Pacote portátil para executar o Hunyuan3D 2.0/2.1 no Windows.

    1.326+5Variação de estrelas nos últimos 7 dias
  • pruna@PrunaAI

    Pruna é um framework de otimização de modelos criado para desenvolvedores, permitindo entregar modelos mais rápidos e eficientes com o mínimo de sobrecarga.

    1.274+2Variação de estrelas nos últimos 7 dias
  • Difix3D@nv-tlabs

    [CVPR 2025 Oral & Finalista de Melhor Artigo] Difix3D+: Melhorando reconstruções 3D com modelos de difusão de passo único.

    1.267+0Variação de estrelas nos últimos 7 dias
  • DragDiffusion@Yujun-Shi

    [CVPR2024, Highlight] Código oficial para o DragDiffusion

    1.259+0Variação de estrelas nos últimos 7 dias
  • tango@declare-lab

    Uma família de modelos de difusão para geração de texto para áudio.

    1.238-1Variação de estrelas nos últimos 7 dias
  • Irodori-TTS@Aratako

    Um modelo de conversão de texto em fala baseado em Flow Matching com controle de estilo via emoji

    1.228+8Variação de estrelas nos últimos 7 dias
  • HunyuanCustom@Tencent-Hunyuan

    HunyuanCustom: Uma arquitetura multimodal para geração de vídeo personalizada.

    1.228+1Variação de estrelas nos últimos 7 dias
  • MeanFlow@haidog-yaqub

    Implementação em PyTorch de MeanFlow e iMF (modelagem generativa de passo único).

    1.196+0Variação de estrelas nos últimos 7 dias
  • wunjo.wladradchenko.ru@wladradchenko

    Wunjo CE: Troca de rosto, sincronia labial, remoção de objetos, texto e fundo, reestilização, separador de áudio, clonagem de voz, geração de vídeo. Código aberto, local e gratuito.

    1.170+1Variação de estrelas nos últimos 7 dias
  • MagicDrive@cure-lab

    [ICLR24] Implementação oficial do artigo “MagicDrive: Street View Generation with Diverse 3D Geometry Control”

    1.167+1Variação de estrelas nos últimos 7 dias
  • Uma coleção de recursos sobre geração controlável com modelos de difusão text-to-image.

    1.110+0Variação de estrelas nos últimos 7 dias
  • MOVA@OpenMOSS

    MOVA: rumo à geração de vídeo e áudio escalável e sincronizada.

    1.108+4Variação de estrelas nos últimos 7 dias
  • pytorch-stable-diffusion@hkproj

    Stable Diffusion implementado do zero em PyTorch

    1.078-1Variação de estrelas nos últimos 7 dias
  • VisCPM@OpenBMB

    [Destaque ICLR'24] Séries de Modelos Grandes Multimodais em Chinês e Inglês (Chat e Paint) | Baseado no modelo base CPM, série de grandes modelos multimodais bilíngues em chinês e inglês

    1.061+0Variação de estrelas nos últimos 7 dias
  • MotionDirector@showlab

    [ECCV 2024 Oral] MotionDirector: Personalização de movimento para modelos de difusão de texto para vídeo.

    1.053+3Variação de estrelas nos últimos 7 dias
  • Diffusion-Planner@ZhengYinan-AIR

    [ICLR 2025 Oral] A implementação oficial de "Diffusion-Based Planning for Autonomous Driving with Flexible Guidance".

    1.050+5Variação de estrelas nos últimos 7 dias
  • 3DTopia-XL@3DTopia

    [CVPR 2025 Highlight] 3DTopia-XL: Geração de ativos PBR 3D de alta qualidade via Primitive Diffusion

    1.046+1Variação de estrelas nos últimos 7 dias
  • SyncDreamer@liuyuan-pal

    [ICLR 2024 Spotlight] SyncDreamer: Geração de imagens consistentes de múltiplas vistas a partir de uma imagem de vista única

    1.044+0Variação de estrelas nos últimos 7 dias
  • FlowEdit@fallenshock

    Implementação oficial do artigo: "FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models"

    1.013-1Variação de estrelas nos últimos 7 dias
  • FastGen@NVlabs

    NVIDIA FastGen: Geração rápida a partir de modelos de difusão

    986+24Variação de estrelas nos últimos 7 dias
  • PIA@open-mmlab

    [CVPR 2024] PIA, seu animador de imagens personalizado. Anime suas imagens por meio de comandos de texto, combinando com Dreambooth, alcançando vídeos impressionantes.

    975+0Variação de estrelas nos últimos 7 dias
  • DeepCache@horseee

    [CVPR 2024] DeepCache: Acelerando Modelos de Difusão Gratuitamente

    970+0Variação de estrelas nos últimos 7 dias
  • diffae@konpatp

    Implementação oficial de Diffusion Autoencoders

    969+0Variação de estrelas nos últimos 7 dias
  • story-iter@UCSC-VLAA

    [ICLR 2026] Framework iterativo sem treinamento para visualização de histórias longas

    959+1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos