diffusion-models
Repositorios de código abierto monitorizados etiquetados con diffusion-models, ordenados por estrellas.
- #61
Entrenamiento escalable y optimizado en memoria de modelos de difusión
★ 1359+1Variación de estrellas de los últimos 7 días - #62
[ICASSP 2024] 🍵 Matcha-TTS: Una arquitectura de TTS rápida con conditional flow matching.
★ 1353+4Variación de estrellas de los últimos 7 días - #63
[ICLR 2023 Oral] Restauración de imágenes zero-shot utilizando el modelo de espacio nulo de difusión por reducción de ruido
★ 1351+2Variación de estrellas de los últimos 7 días - #64
FireRed-Image-Edit es un modelo base de edición de imágenes potente que logra un rendimiento de vanguardia de código abierto con seguimiento preciso de instrucciones, generación de alta fidelidad, consistencia de identidad superior y fusión fluida de múltiples elementos.
★ 1350+6Variación de estrellas de los últimos 7 días - #65
[AAAI 2025]👔IMAGDressing👔: Generación modular interactiva de prendas para vestimenta virtual. Permite la generación de imágenes humanas personalizables con control flexible de prendas, poses y escenas, garantizando alta fidelidad y consistencia de las prendas para el vestuario virtual.
★ 1343+0Variación de estrellas de los últimos 7 días - #66
[TPAMI 2025🔥] MagicTime: Modelos de generación de video time-lapse como simuladores metamórficos.
★ 1337-1Variación de estrellas de los últimos 7 días - #67
Paquete portátil para ejecutar Hunyuan3D 2.0/2.1 en Windows.
★ 1326+5Variación de estrellas de los últimos 7 días - #68
Pruna es un framework de optimización de modelos diseñado para desarrolladores, que permite entregar modelos más rápidos y eficientes con una sobrecarga mínima.
★ 1274+2Variación de estrellas de los últimos 7 días - #69
[CVPR 2025 Oral y finalista al mejor artículo] Difix3D+: Mejora de reconstrucciones 3D con modelos de difusión de un solo paso
★ 1267+0Variación de estrellas de los últimos 7 días - #70
[CVPR2024, Highlight] Código oficial para DragDiffusion
★ 1259+0Variación de estrellas de los últimos 7 días - #71★ 1238-1Variación de estrellas de los últimos 7 días
- #72
HunyuanCustom: Una arquitectura impulsada por multimodalidad para la generación de video personalizada.
★ 1228+1Variación de estrellas de los últimos 7 días - #73
Modelo de texto a voz basado en Flow Matching con control de estilo mediante emojis.
★ 1228+8Variación de estrellas de los últimos 7 días - #74
Implementación en PyTorch de MeanFlow e iMF (modelado generativo de un solo paso).
★ 1196+0Variación de estrellas de los últimos 7 días - #75
Wunjo CE: Intercambio de rostros, sincronización labial, eliminación de objetos, texto y fondos, reestilización, separador de audio, clonación de voz y generación de video. De código abierto, local y gratuito.
★ 1170+1Variación de estrellas de los últimos 7 días - #76
[ICLR24] Implementación oficial del artículo “MagicDrive: Street View Generation with Diverse 3D Geometry Control”
★ 1167+1Variación de estrellas de los últimos 7 días - #77
Una colección de recursos sobre generación controlable con modelos de difusión de texto a imagen.
★ 1110+0Variación de estrellas de los últimos 7 días - #78★ 1108+4Variación de estrellas de los últimos 7 días
- #79
Stable Diffusion implementado desde cero en PyTorch
★ 1077-1Variación de estrellas de los últimos 7 días - #80
[ICLR'24 spotlight] Serie de modelos multimodales grandes en chino e inglés (Chat y Paint) | Basado en la serie de modelos multimodales grandes bilingües chino-inglés CPM
★ 1061+0Variación de estrellas de los últimos 7 días - #81
[ECCV 2024 Oral] MotionDirector: personalización de movimiento para modelos de difusión de texto a video.
★ 1053+3Variación de estrellas de los últimos 7 días - #82
[ICLR 2025 Oral] La implementación oficial de "Diffusion-Based Planning for Autonomous Driving with Flexible Guidance"
★ 1050+5Variación de estrellas de los últimos 7 días - #83
[CVPR 2025 Highlight] 3DTopia-XL: Generación de activos 3D PBR de alta calidad mediante difusión primitiva.
★ 1046+1Variación de estrellas de los últimos 7 días - #84
[ICLR 2024 Spotlight] SyncDreamer: Generación de imágenes consistentes multivista a partir de una sola imagen.
★ 1044+0Variación de estrellas de los últimos 7 días - #85
Implementación oficial del artículo: "FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models"
★ 1013-1Variación de estrellas de los últimos 7 días - #86★ 986+24Variación de estrellas de los últimos 7 días
- #87
[CVPR 2024] PIA, tu animador de imágenes personalizado. Anima tus imágenes mediante prompts de texto, combinando con Dreambooth para lograr videos sorprendentes.
★ 975+0Variación de estrellas de los últimos 7 días - #88★ 970+0Variación de estrellas de los últimos 7 días
- #89★ 969+0Variación de estrellas de los últimos 7 días
- #90
[ICLR 2026] Un marco iterativo sin entrenamiento para la visualización de historias largas.
★ 959+1Variación de estrellas de los últimos 7 días