diffusion-models
Repositorios de código abierto monitorizados etiquetados con diffusion-models, ordenados por estrellas.
- #91
Framework de entrenamiento de aprendizaje por refuerzo multimodal para modelos de difusión y omnimodales
★ 955+56Variación de estrellas de los últimos 7 días - #92
Resumen del procesamiento de imágenes basado en difusión, incluyendo restauración, mejora, codificación y evaluación de calidad
★ 954-1Variación de estrellas de los últimos 7 días - #93
[ECCV 2026] Skyfall-GS: Síntesis de escenas urbanas 3D inmersivas a partir de imágenes satelitales.
★ 953+4Variación de estrellas de los últimos 7 días - #94
[ICML 2026] Repositorio oficial para "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" y Causal Forcing++
★ 948+9Variación de estrellas de los últimos 7 días - #95
Implementación oficial en PyTorch de ODISE: Segmentación panóptica de vocabulario abierto con modelos de difusión de texto a imagen [CVPR 2023 Highlight]
★ 943+0Variación de estrellas de los últimos 7 días - #96
Resumen de artículos y blogs clave sobre modelos de difusión para aprender sobre el tema. Lista detallada de todos los artículos publicados sobre robótica de difusión.
★ 920+1Variación de estrellas de los últimos 7 días - #97
MindSpore + 🤗Huggingface: Ejecute cualquier modelo de Transformers/Diffusers en MindSpore con compatibilidad y aceleración perfectas.
★ 920+0Variación de estrellas de los últimos 7 días - #98
Aplicación que muestra múltiples pipelines de modelos de difusión en tiempo real con Diffusers.
★ 916+0Variación de estrellas de los últimos 7 días - #99★ 874+1Variación de estrellas de los últimos 7 días
- #100
Implementación oficial del artículo "MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens"
★ 869+0Variación de estrellas de los últimos 7 días - #101
Base de código unificada para modelos de mundo avanzados.
★ 866+1Variación de estrellas de los últimos 7 días - #102
Integración de Gaussian Splatting en un eliminador de ruido de difusión para la generación y reconstrucción de imágenes a 3D de una sola etapa, rápida y escalable (ICCV 2025)
★ 861-2Variación de estrellas de los últimos 7 días - #103
[CVPR 2025 Highlight] Generación de video a partir de texto con preservación de identidad mediante descomposición de frecuencia.
★ 856+1Variación de estrellas de los últimos 7 días - #104
Instruct-NeRF2NeRF: Edición de escenas 3D con instrucciones (ICCV 2023)
★ 852+0Variación de estrellas de los últimos 7 días - #105
Lista de artículos relacionados con la cuantización de redes neuronales en conferencias y revistas de IA recientes.
★ 851+5Variación de estrellas de los últimos 7 días - #106
[ICLR'23] DiffuSeq: Generación de texto secuencia a secuencia con modelos de difusión.
★ 838+0Variación de estrellas de los últimos 7 días - #107
Implementación oficial de "MeshDiffusion: Score-based Generative 3D Mesh Modeling" (ICLR 2023 Spotlight).
★ 832+0Variación de estrellas de los últimos 7 días - #108
[CVPR 2024] GaussianDreamer: Generación rápida de texto a 3D Gaussians mediante la conexión de modelos de difusión 2D y 3D.
★ 829-1Variación de estrellas de los últimos 7 días - #109
Implementación oficial de "RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers" (ICML 2025), UltraViCo (ICLR 2026) y UltraImage.
★ 827+0Variación de estrellas de los últimos 7 días - #110
Una lista curada de artículos de visión 3D relacionados con el dominio de la robótica en la era de los grandes modelos, es decir, LLMs/VLMs, inspirada en awesome-computer-vision, que incluye artículos, códigos y sitios web relacionados
★ 820+1Variación de estrellas de los últimos 7 días - #111
[ICLR 2024] Control de modelos de lenguaje visual para la restauración universal de imágenes. Quinto lugar en el desafío NTIRE 2024 Restore Any Image Model in the Wild.
★ 817+1Variación de estrellas de los últimos 7 días - #112
[CVPR 2024] Paint3D: Paint Anything 3D with Lighting-Less Texture Diffusion Models, un modelo generativo de texturas sin iluminación integrada.
★ 808-1Variación de estrellas de los últimos 7 días - #113
DeepInverse: una biblioteca de PyTorch para resolver problemas inversos de imágenes mediante aprendizaje profundo
★ 802+5Variación de estrellas de los últimos 7 días - #114
Aplica modelos de difusión usando el nuevo paquete diffusers de Hugging Face para sintetizar música en lugar de imágenes.
★ 795+1Variación de estrellas de los últimos 7 días - #115
Código simple y legible para entrenar y realizar muestreos a partir de modelos de difusión
★ 785+0Variación de estrellas de los últimos 7 días - #116
Una colección de estudios impresionantes sobre generación de video.
★ 782+0Variación de estrellas de los últimos 7 días - #117
Fusión de modelos en LLMs, MLLMs y más allá: métodos, teorías, aplicaciones y oportunidades. ACM Computing Surveys, 2026.
★ 779+2Variación de estrellas de los últimos 7 días - #118
[ICML 2024] MagicPose (también conocido como MagicDance): reorientación realista de poses humanas y expresiones faciales con difusión consciente de la identidad.
★ 776+0Variación de estrellas de los últimos 7 días - #119★ 775+0Variación de estrellas de los últimos 7 días
- #120
Implementación oficial de "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)
★ 770+0Variación de estrellas de los últimos 7 días