Saltar al contenido principal
buildradar
Sign in
Tema · diffusion-models

diffusion-models

Repositorios de código abierto monitorizados etiquetados con diffusion-models, ordenados por estrellas.

163 repositorios
  • Colección de artículos sobre modelos de difusión categorizados por sus subáreas

    2224+0Variación de estrellas de los últimos 7 días
  • score_sde_pytorch@yang-song

    Implementación en PyTorch para modelado generativo basado en puntuación mediante ecuaciones diferenciales estocásticas (ICLR 2021, Oral)

    2130+0Variación de estrellas de los últimos 7 días
  • Helios@PKU-YuanGroup

    Helios: Modelo de generación de video largo en tiempo real real

    2129+52Variación de estrellas de los últimos 7 días
  • Modelos de difusión en imágenes médicas (Publicado en la revista Medical Image Analysis)

    2110+1Variación de estrellas de los últimos 7 días
  • ICEdit@River-Zhang

    [NeurIPS 2025] ¡La edición de imágenes solo requiere un único LoRA! ¡0.1% de datos de entrenamiento para una edición de imágenes fantástica! Supera a GPT-4o en persistencia de ID~ ¡ckpt de MoE publicado! ¡Solo se necesitan 4GB de VRAM para ejecutar!

    2104+2Variación de estrellas de los últimos 7 días
  • diamond@eloialonso

    DIAMOND (DIffusion As a Model Of eNvironment Dreams) es un agente de aprendizaje por refuerzo entrenado en un modelo de mundo de difusión. NeurIPS 2024 Spotlight.

    2100+3Variación de estrellas de los últimos 7 días
  • zero123plus@SUDO-AI-3D

    Repositorio de código para Zero123++: un modelo base de difusión de una sola imagen a múltiples vistas coherentes.

    2096+0Variación de estrellas de los últimos 7 días
  • Awesome-LM-SSP@CryptoAILab

    Una lista de lectura sobre seguridad, protección y privacidad de modelos grandes (incluyendo Awesome LLM Security, Safety, etc.).

    2070+3Variación de estrellas de los últimos 7 días
  • custom-diffusion@adobe-research

    Custom Diffusion: Personalización multiconcepto de difusión de texto a imagen (CVPR 2023)

    1977-1Variación de estrellas de los últimos 7 días
  • Show-o@showlab

    [ICLR & NeurIPS 2025] Repositorio para la serie Show-o, un único Transformer para unificar la comprensión y generación multimodal.

    1975+2Variación de estrellas de los últimos 7 días
  • LlamaGen@FoundationVision

    El modelo autorregresivo supera a la difusión: 🦙 Llama para la generación escalable de imágenes

    1966+0Variación de estrellas de los últimos 7 días
  • onediff@siliconflow

    OneDiff: Una biblioteca de aceleración lista para usar para modelos de difusión.

    1964+0Variación de estrellas de los últimos 7 días
  • Make-It-3D@junshutang

    [ICCV 2023] Make-It-3D: Creación 3D de alta fidelidad a partir de una sola imagen con un prior de difusión

    1891+0Variación de estrellas de los últimos 7 días
  • dpm-solver@LuChengTHU

    Código oficial para "DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps" (Neurips 2022 Oral)

    1852+0Variación de estrellas de los últimos 7 días
  • HunyuanVideo-I2V@Tencent-Hunyuan

    HunyuanVideo-I2V: Un modelo personalizable de imagen a video basado en HunyuanVideo

    1840+0Variación de estrellas de los últimos 7 días
  • CatVTON@Zheng-Chong

    [ICLR 2025] CatVTON es un modelo de difusión de prueba virtual simple y eficiente con 1) red ligera (899,06 M de parámetros en total), 2) entrenamiento eficiente en parámetros (49,57 M de parámetros entrenables) y 3) inferencia simplificada (< 8 GB de VRAM para resolución de 1024x768).

    1831+7Variación de estrellas de los últimos 7 días
  • FlashVSR@OpenImagingLab

    [CVPR 2026] Hacia la superresolución de video en streaming basada en difusión en tiempo real: un framework de difusión eficiente de un solo paso para VSR en streaming con atención dispersa restringida por localidad y un decodificador condicional ligero.

    1815+16Variación de estrellas de los últimos 7 días
  • RAG-Survey@hymie122

    Recopilación de artículos destacados sobre RAG para AIGC. Proponemos una taxonomía de fundamentos, mejoras y aplicaciones de RAG en el artículo "Retrieval-Augmented Generation for AI-Generated Content: A Survey".

    1789+0Variación de estrellas de los últimos 7 días
  • BrushNet@TencentARC

    [ECCV 2024] Implementación oficial del artículo "BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion"

    1744-1Variación de estrellas de los últimos 7 días
  • REPA@sihyun-yu

    [ICLR'25 Oral] Alineación de representación para la generación: entrenar Diffusion Transformers es más fácil de lo que piensas.

    1706+6Variación de estrellas de los últimos 7 días
  • ImageReward@zai-org

    [NeurIPS 2023] ImageReward: Aprendizaje y evaluación de preferencias humanas para la generación de texto a imagen.

    1703+1Variación de estrellas de los últimos 7 días
  • MMaDA@Gen-Verse

    MMaDA: Modelos de lenguaje de difusión multimodal de código abierto (dLLMs con difusión por bloques, CoT mixto y RL unificado)

    1671+3Variación de estrellas de los últimos 7 días
  • Una lista curada de recursos sobre modelos de difusión en aprendizaje por refuerzo (actualizada continuamente).

    1635+3Variación de estrellas de los últimos 7 días
  • fantasy-talking@Fantasy-AMAP

    [ACM MM 2025] FantasyTalking: Generación de retratos parlantes realistas mediante síntesis de movimiento coherente

    1628+0Variación de estrellas de los últimos 7 días
  • Magic123@guochengqian

    [ICLR'24] Implementación oficial en PyTorch de Magic123: Generación de objetos 3D de alta calidad a partir de una imagen utilizando prioridades de difusión 2D y 3D.

    1622-1Variación de estrellas de los últimos 7 días
  • MIMO@menyifang

    Implementación oficial de "MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling"

    1579+1Variación de estrellas de los últimos 7 días
  • DiffDock@gcorso

    Implementación de DiffDock: pasos de difusión, giros y vueltas para el acoplamiento molecular

    1570+1Variación de estrellas de los últimos 7 días
  • Generative_Deep_Learning_2nd_Edition@davidADSP

    El repositorio de código oficial de la segunda edición del libro de O'Reilly Generative Deep Learning: Teaching Machines to Paint, Write, Compose and Play.

    1553+7Variación de estrellas de los últimos 7 días
  • LanPaint@scraed

    Inpainting de alta calidad sin entrenamiento para cualquier modelo de Stable Diffusion. Compatible con ComfyUI

    1372+9Variación de estrellas de los últimos 7 días
  • TeaCache@ali-vilab

    Timestep Embedding Tells: Es hora de implementar caché para modelos de difusión de video.

    1371+2Variación de estrellas de los últimos 7 días
← Volver a temas