diffusion
Repositorios de código abierto monitorizados etiquetados con diffusion, ordenados por estrellas.
- #61
Un framework de TTS / SVS / SVC fácil de entender.
★ 759+1Variación de estrellas de los últimos 7 días - #62
HY-SOAR: Autocorrección para la alineación y el refinamiento óptimos en modelos de difusión
★ 744+1Variación de estrellas de los últimos 7 días - #63★ 720+117Variación de estrellas de los últimos 7 días
- #64
[ICML2025, NeurIPS2025 Spotlight] Sparse VideoGen 1 & 2: Aceleración de transformadores de difusión de video con atención dispersa
★ 709+1Variación de estrellas de los últimos 7 días - #65
Un marco unificado para el aprendizaje por refuerzo sencillo en modelos de Flow-Matching
★ 690+7Variación de estrellas de los últimos 7 días - #66
Implementación oficial de "Blended Latent Diffusion" [SIGGRAPH 2023]
★ 632+0Variación de estrellas de los últimos 7 días - #67
[ECCV 2026] Marco basado en difusión para OCR de documentos que reemplaza la decodificación autorregresiva con decodificación de difusión paralela a nivel de bloque.
★ 615+0Variación de estrellas de los últimos 7 días - #68
[CVPR 2025] RollingDepth: Profundidad de video sin modelos de video
★ 612+0Variación de estrellas de los últimos 7 días - #69
[TIP2026] Códigos oficiales de CCSRv2 y CCSRv1: Mejora de la estabilidad y eficiencia de los modelos de difusión para la superresolución con consistencia de contenido.
★ 609+1Variación de estrellas de los últimos 7 días - #70
Otra implementación en PyTorch de Stable Diffusion (probablemente fácil de leer)
★ 594+0Variación de estrellas de los últimos 7 días - #71
Lista curada de artículos destacados sobre inferencia de difusión con código: muestreo, caché, cuantización, paralelismo, etc.
★ 590+0Variación de estrellas de los últimos 7 días - #72
Implementación oficial de "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022]
★ 589+0Variación de estrellas de los últimos 7 días - #73
Un framework de IA para generar y modificar beatmaps de osu! para todos los modos de juego a partir de entradas de espectrogramas.
★ 581+6Variación de estrellas de los últimos 7 días - #74
[AAAI2024] FontDiffuser: Generación de fuentes one-shot mediante difusión de eliminación de ruido con agregación de contenido a multiescala y aprendizaje contrastivo de estilo
★ 559+6Variación de estrellas de los últimos 7 días - #75
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+15Variación de estrellas de los últimos 7 días - #76
[WACV'25 Oral] El ajuste fino de modelos de difusión condicionados por imagen es más fácil de lo que crees
★ 521+0Variación de estrellas de los últimos 7 días