diffusion-models
Repositorios de código abierto monitorizados etiquetados con diffusion-models, ordenados por estrellas.
- #31
Colección de artículos sobre modelos de difusión categorizados por sus subáreas
★ 2224+0Variación de estrellas de los últimos 7 días - #32
Implementación en PyTorch para modelado generativo basado en puntuación mediante ecuaciones diferenciales estocásticas (ICLR 2021, Oral)
★ 2130+0Variación de estrellas de los últimos 7 días - #33★ 2129+52Variación de estrellas de los últimos 7 días
- #34
Modelos de difusión en imágenes médicas (Publicado en la revista Medical Image Analysis)
★ 2110+1Variación de estrellas de los últimos 7 días - #35
[NeurIPS 2025] ¡La edición de imágenes solo requiere un único LoRA! ¡0.1% de datos de entrenamiento para una edición de imágenes fantástica! Supera a GPT-4o en persistencia de ID~ ¡ckpt de MoE publicado! ¡Solo se necesitan 4GB de VRAM para ejecutar!
★ 2104+2Variación de estrellas de los últimos 7 días - #36
DIAMOND (DIffusion As a Model Of eNvironment Dreams) es un agente de aprendizaje por refuerzo entrenado en un modelo de mundo de difusión. NeurIPS 2024 Spotlight.
★ 2100+3Variación de estrellas de los últimos 7 días - #37
Repositorio de código para Zero123++: un modelo base de difusión de una sola imagen a múltiples vistas coherentes.
★ 2096+0Variación de estrellas de los últimos 7 días - #38
Una lista de lectura sobre seguridad, protección y privacidad de modelos grandes (incluyendo Awesome LLM Security, Safety, etc.).
★ 2070+3Variación de estrellas de los últimos 7 días - #39
Custom Diffusion: Personalización multiconcepto de difusión de texto a imagen (CVPR 2023)
★ 1977-1Variación de estrellas de los últimos 7 días - #40
[ICLR & NeurIPS 2025] Repositorio para la serie Show-o, un único Transformer para unificar la comprensión y generación multimodal.
★ 1975+2Variación de estrellas de los últimos 7 días - #41
El modelo autorregresivo supera a la difusión: 🦙 Llama para la generación escalable de imágenes
★ 1966+0Variación de estrellas de los últimos 7 días - #42
OneDiff: Una biblioteca de aceleración lista para usar para modelos de difusión.
★ 1964+0Variación de estrellas de los últimos 7 días - #43
[ICCV 2023] Make-It-3D: Creación 3D de alta fidelidad a partir de una sola imagen con un prior de difusión
★ 1891+0Variación de estrellas de los últimos 7 días - #44
Código oficial para "DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps" (Neurips 2022 Oral)
★ 1852+0Variación de estrellas de los últimos 7 días - #45
HunyuanVideo-I2V: Un modelo personalizable de imagen a video basado en HunyuanVideo
★ 1840+0Variación de estrellas de los últimos 7 días - #46
[ICLR 2025] CatVTON es un modelo de difusión de prueba virtual simple y eficiente con 1) red ligera (899,06 M de parámetros en total), 2) entrenamiento eficiente en parámetros (49,57 M de parámetros entrenables) y 3) inferencia simplificada (< 8 GB de VRAM para resolución de 1024x768).
★ 1831+7Variación de estrellas de los últimos 7 días - #47
[CVPR 2026] Hacia la superresolución de video en streaming basada en difusión en tiempo real: un framework de difusión eficiente de un solo paso para VSR en streaming con atención dispersa restringida por localidad y un decodificador condicional ligero.
★ 1815+16Variación de estrellas de los últimos 7 días - #48
Recopilación de artículos destacados sobre RAG para AIGC. Proponemos una taxonomía de fundamentos, mejoras y aplicaciones de RAG en el artículo "Retrieval-Augmented Generation for AI-Generated Content: A Survey".
★ 1789+0Variación de estrellas de los últimos 7 días - #49
[ECCV 2024] Implementación oficial del artículo "BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion"
★ 1744-1Variación de estrellas de los últimos 7 días - #50
[ICLR'25 Oral] Alineación de representación para la generación: entrenar Diffusion Transformers es más fácil de lo que piensas.
★ 1706+6Variación de estrellas de los últimos 7 días - #51
[NeurIPS 2023] ImageReward: Aprendizaje y evaluación de preferencias humanas para la generación de texto a imagen.
★ 1703+1Variación de estrellas de los últimos 7 días - #52
MMaDA: Modelos de lenguaje de difusión multimodal de código abierto (dLLMs con difusión por bloques, CoT mixto y RL unificado)
★ 1671+3Variación de estrellas de los últimos 7 días - #53
Una lista curada de recursos sobre modelos de difusión en aprendizaje por refuerzo (actualizada continuamente).
★ 1635+3Variación de estrellas de los últimos 7 días - #54
[ACM MM 2025] FantasyTalking: Generación de retratos parlantes realistas mediante síntesis de movimiento coherente
★ 1628+0Variación de estrellas de los últimos 7 días - #55
[ICLR'24] Implementación oficial en PyTorch de Magic123: Generación de objetos 3D de alta calidad a partir de una imagen utilizando prioridades de difusión 2D y 3D.
★ 1622-1Variación de estrellas de los últimos 7 días - #56
Implementación oficial de "MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling"
★ 1579+1Variación de estrellas de los últimos 7 días - #57
Implementación de DiffDock: pasos de difusión, giros y vueltas para el acoplamiento molecular
★ 1570+1Variación de estrellas de los últimos 7 días - #58
El repositorio de código oficial de la segunda edición del libro de O'Reilly Generative Deep Learning: Teaching Machines to Paint, Write, Compose and Play.
★ 1553+7Variación de estrellas de los últimos 7 días - #59
Inpainting de alta calidad sin entrenamiento para cualquier modelo de Stable Diffusion. Compatible con ComfyUI
★ 1372+9Variación de estrellas de los últimos 7 días - #60
Timestep Embedding Tells: Es hora de implementar caché para modelos de difusión de video.
★ 1371+2Variación de estrellas de los últimos 7 días