diffusion-models
Repositorios de código abierto monitorizados etiquetados con diffusion-models, ordenados por estrellas.
- #121
[ECCV 2024] MOFA-Video: Animación de imágenes controlable mediante adaptaciones de campos de movimiento generativos en modelos de difusión de imagen a video congelados.
★ 766+0Variación de estrellas de los últimos 7 días - #122
Una colección de estudios asombrosos sobre la generación de texto a imagen.
★ 765+0Variación de estrellas de los últimos 7 días - #123
[ICLR 2025] Implementación oficial de Posterior-Mean Rectified Flow: Hacia una restauración de imágenes fotorrealistas con MSE mínimo
★ 754+0Variación de estrellas de los últimos 7 días - #124
Un repositorio minimalista y completo para avanzar en la ciencia de los modelos mundiales
★ 729+10Variación de estrellas de los últimos 7 días - #125
[ICCV 2025] Implementación oficial del artículo “MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control”
★ 729+1Variación de estrellas de los últimos 7 días - #126
[CVPR 2024 Highlight] DistriFusion: Inferencia paralela distribuida para modelos de difusión de alta resolución.
★ 728+0Variación de estrellas de los últimos 7 días - #127
Notebooks de Colab que cubren herramientas de aprendizaje profundo para la predicción y el diseño de estructuras biomoleculares
★ 724+1Variación de estrellas de los últimos 7 días - #128
Restauración de imágenes con ecuaciones diferenciales estocásticas de reversión a la media, ICML 2023. Solución ganadora del desafío NTIRE 2023 de eliminación de sombras en imágenes.
★ 722+0Variación de estrellas de los últimos 7 días - #129★ 711+2Variación de estrellas de los últimos 7 días
- #130
[ICML 2025] Implementación oficial en PyTorch de "History-Guided Video Diffusion".
★ 709+1Variación de estrellas de los últimos 7 días - #131
Una lista seleccionada de increíbles modelos mundiales de video con difusión AR: abarca algoritmos, aplicaciones e infraestructura, con el objetivo de servir como un recurso integral para investigadores, profesionales y entusiastas.
★ 701+5Variación de estrellas de los últimos 7 días - #132
[ECCV 2024] De una sola imagen a una malla 3D texturizada en 10 segundos con un modelo de reconstrucción convolucional.
★ 696+0Variación de estrellas de los últimos 7 días - #133
Un marco unificado para el aprendizaje por refuerzo sencillo en modelos de Flow-Matching
★ 690+7Variación de estrellas de los últimos 7 días - #134
Colección de artículos y códigos para CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024 AIGC.
★ 677+1Variación de estrellas de los últimos 7 días - #135
HunyuanImage-2.1: Un modelo de difusión eficiente para generación de texto a imagen en alta resolución (2K)
★ 675+0Variación de estrellas de los últimos 7 días - #136
Implementación en PyTorch de Make-An-Audio (ICML'23) con un modelo generativo de texto a audio.
★ 668+0Variación de estrellas de los últimos 7 días - #137
Implementación oficial del artículo OneDiffusion (CVPR 2025).
★ 665+0Variación de estrellas de los últimos 7 días - #138
[IJCV 2026] FoleyCrafter: Da vida a videos mudos con sonidos realistas y sincronizados.
★ 663+0Variación de estrellas de los últimos 7 días - #139
Flash Diffusion: aceleración de modelos de difusión condicional (AAAI 2025 Oral).
★ 663+1Variación de estrellas de los últimos 7 días - #140★ 660-1Variación de estrellas de los últimos 7 días
- #141
DFloat11 [NeurIPS '25]: Compresión sin pérdida de LLMs y DiTs para una inferencia eficiente en GPU.
★ 654-1Variación de estrellas de los últimos 7 días - #142
Modelo de lenguaje de difusión abierto para generación de código: incluye preentrenamiento, evaluación, inferencia y puntos de control.
★ 652+3Variación de estrellas de los últimos 7 días - #143
Implementación oficial de "Blended Latent Diffusion" [SIGGRAPH 2023]
★ 632+0Variación de estrellas de los últimos 7 días - #144★ 631+1Variación de estrellas de los últimos 7 días
- #145
[CVPR'26 Highlight] Ditto: Escalado de edición de video basada en instrucciones con un conjunto de datos sintéticos de alta calidad
★ 628+4Variación de estrellas de los últimos 7 días - #146
[NeurIPS 2025] Radial Attention: Atención dispersa O(nlogn) con decaimiento de energía para la generación de videos largos.
★ 607-1Variación de estrellas de los últimos 7 días - #147
[TPAMI] Implementación oficial del artículo "BrushEdit: All-In-One Image Inpainting and Editing"
★ 590+0Variación de estrellas de los últimos 7 días - #148
Código oficial para el artículo de CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models".
★ 588-1Variación de estrellas de los últimos 7 días - #149
Código oficial de VEnhancer: mejora espacio-temporal generativa para la generación de video.
★ 579+0Variación de estrellas de los últimos 7 días - #150★ 577+2Variación de estrellas de los últimos 7 días