Pular para o conteúdo principal
buildradar
Sign in
Tópico · diffusion-models

diffusion-models

Repositórios de código aberto acompanhados marcados com diffusion-models, ordenados por estrelas.

163 repositórios
  • verl-omni@verl-project

    Framework de treinamento de RL multimodal para modelos de difusão e omni

    955+56Variação de estrelas nos últimos 7 dias
  • Um resumo sobre processamento de imagem baseado em difusão, incluindo restauração, aprimoramento, codificação e avaliação de qualidade.

    954-1Variação de estrelas nos últimos 7 dias
  • Skyfall-GS@jayin92

    [ECCV 2026] Skyfall-GS: Síntese de cenas urbanas 3D imersivas a partir de imagens de satélite

    953+4Variação de estrelas nos últimos 7 dias
  • Causal-Forcing@thu-ml

    [ICML 2026] Base de código oficial para "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" & Causal Forcing++

    948+9Variação de estrelas nos últimos 7 dias
  • ODISE@NVlabs

    Implementação oficial em PyTorch do ODISE: Open-Vocabulary Panoptic Segmentation with Text-to-Image Diffusion Models [Destaque CVPR 2023]

    943+0Variação de estrelas nos últimos 7 dias
  • Resumo de artigos e blogs essenciais sobre modelos de difusão para aprender sobre o tema. Lista detalhada de todos os artigos publicados sobre robótica de difusão.

    920+1Variação de estrelas nos últimos 7 dias
  • MindAct@candle-org

    MindSpore + 🤗Huggingface: Execute qualquer modelo Transformers/Diffusers no MindSpore com compatibilidade perfeita e aceleração.

    920+0Variação de estrelas nos últimos 7 dias
  • Aplicativo que demonstra múltiplos pipelines de modelos de difusão em tempo real com Diffusers.

    916+0Variação de estrelas nos últimos 7 dias
  • UniPic@SkyworkAI

    Modelo de edição de múltiplas imagens SOTA de código aberto

    874+1Variação de estrelas nos últimos 7 dias
  • MiniGPT-5@UCSB-AI

    Implementação oficial do artigo "MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens"

    869+0Variação de estrelas nos últimos 7 dias
  • OpenWorldLib@OpenDCAI

    Base de código unificada para Modelos de Mundo Avançados.

    866+1Variação de estrelas nos últimos 7 dias
  • Open-DiffusionGS@caiyuanhao1998

    Incorporando Gaussian Splatting no Diffusion Denoiser para geração e reconstrução de imagem para 3D em estágio único rápida e escalável (ICCV 2025)

    861-2Variação de estrelas nos últimos 7 dias
  • ConsisID@PKU-YuanGroup

    [Destaque CVPR 2025] Geração de vídeo a partir de texto com preservação de identidade via decomposição de frequência

    856+1Variação de estrelas nos últimos 7 dias
  • instruct-nerf2nerf@ayaanzhaque

    Instruct-NeRF2NeRF: Edição de cenas 3D com instruções (ICCV 2023)

    852+0Variação de estrelas nos últimos 7 dias
  • Lista de artigos relacionados à quantização de redes neurais em conferências e periódicos recentes de IA.

    851+5Variação de estrelas nos últimos 7 dias
  • DiffuSeq@Shark-NLP

    [ICLR'23] DiffuSeq: Geração de texto de sequência para sequência com modelos de difusão

    838+0Variação de estrelas nos últimos 7 dias
  • MeshDiffusion@lzzcd001

    Implementação oficial de "MeshDiffusion: Score-based Generative 3D Mesh Modeling" (ICLR 2023 Spotlight)

    832+0Variação de estrelas nos últimos 7 dias
  • GaussianDreamer@hustvl

    [CVPR 2024] GaussianDreamer: Geração rápida de texto para 3D Gaussians conectando modelos de difusão 2D e 3D

    829-1Variação de estrelas nos últimos 7 dias
  • Implementação oficial para "RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers" (ICML 2025), UltraViCo (ICLR 2026) e UltraImage

    827+0Variação de estrelas nos últimos 7 dias
  • Uma lista com curadoria de artigos de visão 3D relacionados ao domínio de robótica na era de grandes modelos, como LLMs/VLMs, inspirada no awesome-computer-vision, incluindo artigos, códigos e sites relacionados

    820+1Variação de estrelas nos últimos 7 dias
  • daclip-uir@Algolzw

    [ICLR 2024] Controlling Vision-Language Models for Universal Image Restoration. 5th place in the NTIRE 2024 Restore Any Image Model in the Wild Challenge.

    817+1Variação de estrelas nos últimos 7 dias
  • Paint3D@OpenTexture

    [CVPR 2024] Paint3D: Pinte qualquer coisa em 3D com modelos de difusão de textura sem iluminação, um modelo generativo de textura sem iluminação embutida

    808-1Variação de estrelas nos últimos 7 dias
  • deepinv@deepinv

    DeepInverse: uma biblioteca PyTorch para resolver problemas inversos de imagem usando deep learning

    802+5Variação de estrelas nos últimos 7 dias
  • audio-diffusion@teticio

    Aplique modelos de difusão usando o novo pacote diffusers do Hugging Face para sintetizar música em vez de imagens.

    795+1Variação de estrelas nos últimos 7 dias
  • smalldiffusion@yuanchenyang

    Código simples e legível para treinamento e amostragem de modelos de difusão

    785+0Variação de estrelas nos últimos 7 dias
  • Uma coleção de estudos incríveis sobre geração de vídeo.

    782+0Variação de estrelas nos últimos 7 dias
  • Fusão de Modelos em LLMs, MLLMs e Além: Métodos, Teorias, Aplicações e Oportunidades. ACM Computing Surveys, 2026.

    779+2Variação de estrelas nos últimos 7 dias
  • MagicDance@Boese0601

    [ICML 2024] MagicPose (também conhecido como MagicDance): Retargeting realista de poses humanas e expressões faciais com difusão consciente de identidade.

    776+0Variação de estrelas nos últimos 7 dias
  • dift@Tsingularity

    [NeurIPS'23] Correspondência emergente a partir de difusão de imagem

    775+0Variação de estrelas nos últimos 7 dias
  • Attend-and-Excite@yuval-alaluf

    Implementação oficial de "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)

    770+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos