diffusion
Dépôts open source suivis étiquetés diffusion, triés par étoiles.
- #61
Un framework TTS / SVS / SVC facile à comprendre.
★ 759+1Évolution des étoiles sur les 7 derniers jours - #62
HY-SOAR : Auto-correction pour l'alignement et le raffinement optimaux dans les modèles de diffusion
★ 744+1Évolution des étoiles sur les 7 derniers jours - #63★ 720+117Évolution des étoiles sur les 7 derniers jours
- #64
[ICML2025, NeurIPS2025 Spotlight] Sparse VideoGen 1 & 2 : Accélération des Video Diffusion Transformers avec une attention creuse (sparse attention)
★ 709+1Évolution des étoiles sur les 7 derniers jours - #65
Cadre unifié pour l'apprentissage par renforcement facile dans les modèles Flow-Matching
★ 690+7Évolution des étoiles sur les 7 derniers jours - #66
Implémentation officielle de "Blended Latent Diffusion" [SIGGRAPH 2023]
★ 632+0Évolution des étoiles sur les 7 derniers jours - #67
[ECCV 2026] Un cadre basé sur la diffusion pour l'OCR de documents qui remplace le décodage autorégressif par un décodage de diffusion parallèle au niveau du bloc.
★ 615+0Évolution des étoiles sur les 7 derniers jours - #68
[CVPR 2025] RollingDepth : Profondeur vidéo sans modèles vidéo.
★ 612+0Évolution des étoiles sur les 7 derniers jours - #69
[TIP2026] Codes officiels de CCSRv2 et CCSRv1 : Améliorer la stabilité et l'efficacité des modèles de diffusion pour la super-résolution conforme au contenu.
★ 609+1Évolution des étoiles sur les 7 derniers jours - #70
Une autre implémentation PyTorch de Stable Diffusion (probablement facile à lire)
★ 594+0Évolution des étoiles sur les 7 derniers jours - #71
📚 Une liste de référence d'articles exceptionnels sur l'inférence par diffusion avec code : échantillonnage, cache, quantification, parallélisme, etc. 🎉
★ 590+0Évolution des étoiles sur les 7 derniers jours - #72
Implémentation officielle de "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022]
★ 589+0Évolution des étoiles sur les 7 derniers jours - #73
Framework IA pour générer et modifier des beatmaps osu! pour tous les modes de jeu à partir d'entrées de spectrogrammes.
★ 581+6Évolution des étoiles sur les 7 derniers jours - #74
[AAAI2024] FontDiffuser : génération de polices one-shot via diffusion par débruitage avec agrégation de contenu multi-échelle et apprentissage contrastif de style
★ 559+6Évolution des étoiles sur les 7 derniers jours - #75
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+15Évolution des étoiles sur les 7 derniers jours - #76
[WACV'25 Oral] Le réglage fin (fine-tuning) des modèles de diffusion conditionnés par l'image est plus facile que vous ne le pensez.
★ 521+0Évolution des étoiles sur les 7 derniers jours