diffusion-models
Dépôts open source suivis étiquetés diffusion-models, triés par étoiles.
- #121
[ECCV 2024] MOFA-Video : Animation d'image contrôlable via des adaptations de champ de mouvement génératif dans un modèle de diffusion image-vers-vidéo figé.
★ 766+0Évolution des étoiles sur les 7 derniers jours - #122
Une collection d'études exceptionnelles sur la génération de texte vers image.
★ 765+0Évolution des étoiles sur les 7 derniers jours - #123
[ICLR 2025] Implémentation officielle de Posterior-Mean Rectified Flow : vers une restauration d'image photoréaliste à erreur quadratique moyenne minimale
★ 754+0Évolution des étoiles sur les 7 derniers jours - #124
Un dépôt minimaliste et complet pour faire progresser la science des modèles mondiaux.
★ 729+10Évolution des étoiles sur les 7 derniers jours - #125
[ICCV 2025] Implémentation officielle de l'article « MagicDrive-V2 : Génération de vidéos longues haute résolution pour la conduite autonome avec contrôle adaptatif ».
★ 729+1Évolution des étoiles sur les 7 derniers jours - #126
[CVPR 2024 Highlight] DistriFusion : Inférence parallèle distribuée pour les modèles de diffusion haute résolution
★ 728+0Évolution des étoiles sur les 7 derniers jours - #127
Notebooks Colab couvrant les outils de deep learning pour la prédiction et la conception de structures biomoléculaires.
★ 724+1Évolution des étoiles sur les 7 derniers jours - #128
Restauration d'image avec des équations différentielles stochastiques à retour à la moyenne, ICML 2023. Solution gagnante du défi NTIRE 2023 de suppression d'ombres d'images.
★ 722+0Évolution des étoiles sur les 7 derniers jours - #129★ 711+2Évolution des étoiles sur les 7 derniers jours
- #130
[ICML 2025] Implémentation officielle en PyTorch de « History-Guided Video Diffusion »
★ 709+1Évolution des étoiles sur les 7 derniers jours - #131
Une liste organisée de modèles de monde vidéo impressionnants avec diffusion AR : couvrant les algorithmes, les applications et l'infrastructure, conçue comme une ressource complète pour les chercheurs, les praticiens et les passionnés.
★ 701+5Évolution des étoiles sur les 7 derniers jours - #132
[ECCV 2024] Image unique vers maillage 3D texturé en 10 secondes avec un modèle de reconstruction convolutionnel.
★ 696+0Évolution des étoiles sur les 7 derniers jours - #133
Cadre unifié pour l'apprentissage par renforcement facile dans les modèles Flow-Matching
★ 690+7Évolution des étoiles sur les 7 derniers jours - #134
Une collection d'articles et de codes pour CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024 AIGC
★ 677+1Évolution des étoiles sur les 7 derniers jours - #135
HunyuanImage-2.1 : Un modèle de diffusion efficace pour la génération d'images texte‑à‑image haute résolution (2K)
★ 675+0Évolution des étoiles sur les 7 derniers jours - #136
Implémentation PyTorch de Make-An-Audio (ICML'23) avec un modèle génératif texte‑à‑audio
★ 668+0Évolution des étoiles sur les 7 derniers jours - #137
Implémentation officielle du papier OneDiffusion (CVPR 2025)
★ 665+0Évolution des étoiles sur les 7 derniers jours - #138
[IJCV 2026] FoleyCrafter : Donnez vie aux vidéos silencieuses avec des sons réalistes et synchronisés. AI拟音大师,给你的无声视频添加生动而且同步的音效 😝
★ 663+0Évolution des étoiles sur les 7 derniers jours - #139
Flash Diffusion — accélération des modèles de diffusion conditionnelle (AAAI 2025 Oral)
★ 663+1Évolution des étoiles sur les 7 derniers jours - #140★ 660-1Évolution des étoiles sur les 7 derniers jours
- #141
DFloat11 [NeurIPS '25] : Compression sans perte de LLM et DiT pour une inférence GPU efficace.
★ 654-1Évolution des étoiles sur les 7 derniers jours - #142
Modèle de langage de diffusion ouvert pour la génération de code — publication du pré-entraînement, de l'évaluation, de l'inférence et des points de contrôle.
★ 652+3Évolution des étoiles sur les 7 derniers jours - #143
Implémentation officielle de "Blended Latent Diffusion" [SIGGRAPH 2023]
★ 632+0Évolution des étoiles sur les 7 derniers jours - #144★ 631+1Évolution des étoiles sur les 7 derniers jours
- #145
[CVPR'26 Highlight] Ditto : Mise à l'échelle de l'édition vidéo basée sur des instructions avec un jeu de données synthétique de haute qualité
★ 628+4Évolution des étoiles sur les 7 derniers jours - #146
[NeurIPS 2025] Radial Attention : attention creuse en O(nlogn) avec décroissance d'énergie pour la génération de vidéos longues
★ 607-1Évolution des étoiles sur les 7 derniers jours - #147
[TPAMI] Implémentation officielle du papier "BrushEdit: All-In-One Image Inpainting and Editing"
★ 590+0Évolution des étoiles sur les 7 derniers jours - #148
Code officiel de l'article CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."
★ 588-1Évolution des étoiles sur les 7 derniers jours - #149
Codes officiels de VEnhancer : Amélioration spatio-temporelle générative pour la génération de vidéo
★ 579+0Évolution des étoiles sur les 7 derniers jours - #150★ 577+2Évolution des étoiles sur les 7 derniers jours