diffusion-models
Dépôts open source suivis étiquetés diffusion-models, triés par étoiles.
- #31
Collection d'articles sur les modèles de diffusion classés par sous-domaines
★ 2 224+0Évolution des étoiles sur les 7 derniers jours - #32
Implémentation PyTorch pour la modélisation générative basée sur le score via des équations différentielles stochastiques (ICLR 2021, Oral)
★ 2 130+0Évolution des étoiles sur les 7 derniers jours - #33★ 2 129+18Évolution des étoiles sur les 7 derniers jours
- #34
Modèles de diffusion en imagerie médicale (publié dans la revue Medical Image Analysis).
★ 2 110+2Évolution des étoiles sur les 7 derniers jours - #35
[NeurIPS 2025] L'édition d'images vaut bien un seul LoRA ! 0,1 % de données d'entraînement pour une édition d'image fantastique ! Surpasse GPT-4o en persistance d'identité ~ Checkpoint MoE publié ! Seulement 4 Go de VRAM suffisent pour l'exécuter !
★ 2 104+1Évolution des étoiles sur les 7 derniers jours - #36
DIAMOND (DIffusion As a Model Of eNvironment Dreams) est un agent d'apprentissage par renforcement entraîné dans un modèle de monde par diffusion. Spotlight NeurIPS 2024.
★ 2 100+1Évolution des étoiles sur les 7 derniers jours - #37
Dépôt de code pour Zero123++ : un modèle de diffusion de base pour générer des vues multiples cohérentes à partir d'une image unique.
★ 2 096+0Évolution des étoiles sur les 7 derniers jours - #38
Liste de lecture sur la sûreté, la sécurité et la confidentialité des grands modèles (incluant Awesome LLM Security, Safety, etc.).
★ 2 070+0Évolution des étoiles sur les 7 derniers jours - #39
Custom Diffusion : personnalisation multi-concepts de la diffusion texte-vers-image (CVPR 2023)
★ 1 977-1Évolution des étoiles sur les 7 derniers jours - #40
[ICLR & NeurIPS 2025] Dépôt pour la série Show-o, un transformeur unique pour unifier la compréhension et la génération multimodales.
★ 1 975+1Évolution des étoiles sur les 7 derniers jours - #41
Le modèle autorégressif surpasse la diffusion : Llama pour la génération d'images à grande échelle
★ 1 966+0Évolution des étoiles sur les 7 derniers jours - #42
OneDiff : une bibliothèque d'accélération prête à l'emploi pour les modèles de diffusion.
★ 1 964+0Évolution des étoiles sur les 7 derniers jours - #43
[ICCV 2023] Make-It-3D : Création 3D haute fidélité à partir d'une image unique avec Diffusion Prior.
★ 1 891+0Évolution des étoiles sur les 7 derniers jours - #44
Code officiel de DPM-Solver : un solveur d'ODE rapide pour l'échantillonnage de modèles de diffusion probabilistes en environ 10 étapes (Neurips 2022 Oral).
★ 1 852+0Évolution des étoiles sur les 7 derniers jours - #45
HunyuanVideo-I2V : un modèle image-vers-vidéo personnalisable basé sur HunyuanVideo.
★ 1 840+0Évolution des étoiles sur les 7 derniers jours - #46
[ICLR 2025] CatVTON est un modèle de diffusion simple et efficace pour l'essayage virtuel, doté d'un réseau léger (899,06 M de paramètres au total), d'un entraînement efficace en paramètres (49,57 M de paramètres entraînables) et d'une inférence simplifiée (< 8 Go de VRAM pour une résolution de 1024x768).
★ 1 831+2Évolution des étoiles sur les 7 derniers jours - #47
[CVPR 2026] Vers une super-résolution vidéo en streaming basée sur la diffusion en temps réel — Un framework de diffusion en une étape efficace pour le VSR en streaming avec attention éparse contrainte par la localité et un minuscule décodeur conditionnel.
★ 1 815+11Évolution des étoiles sur les 7 derniers jours - #48
Collection d'articles sur le RAG pour l'AIGC. Nous proposons une taxonomie des fondements, améliorations et applications du RAG dans l'article "Retrieval-Augmented Generation for AI-Generated Content: A Survey".
★ 1 789-1Évolution des étoiles sur les 7 derniers jours - #49
[ECCV 2024] Implémentation officielle de l'article « BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion »
★ 1 744-1Évolution des étoiles sur les 7 derniers jours - #50
[ICLR'25 Oral] Alignement de représentation pour la génération : entraîner des Diffusion Transformers est plus simple que vous ne le pensez.
★ 1 706+2Évolution des étoiles sur les 7 derniers jours - #51
[NeurIPS 2023] ImageReward : Apprentissage et évaluation des préférences humaines pour la génération texte-image.
★ 1 703+1Évolution des étoiles sur les 7 derniers jours - #52
MMaDA - Modèles de langage à diffusion multimodale à grande échelle open source (dLLM avec diffusion par blocs, mixed-CoT et RL unifié)
★ 1 671+1Évolution des étoiles sur les 7 derniers jours - #53
Une liste organisée de ressources sur les modèles de diffusion en apprentissage par renforcement (mis à jour régulièrement).
★ 1 635+2Évolution des étoiles sur les 7 derniers jours - #54
[ACM MM 2025] FantasyTalking : Génération de portraits parlants réalistes via la synthèse de mouvement cohérent
★ 1 628+0Évolution des étoiles sur les 7 derniers jours - #55
[ICLR'24] Implémentation PyTorch officielle de Magic123 : Génération d'objets 3D de haute qualité à partir d'une image utilisant des priors de diffusion 2D et 3D
★ 1 622-1Évolution des étoiles sur les 7 derniers jours - #56
Implémentation officielle de "MIMO : Synthèse vidéo de personnages contrôlables avec modélisation spatiale décomposée".
★ 1 579+1Évolution des étoiles sur les 7 derniers jours - #57
Implémentation de DiffDock : étapes de diffusion, torsions et virages pour l'amarrage moléculaire
★ 1 570-1Évolution des étoiles sur les 7 derniers jours - #58
Dépôt de code officiel pour la deuxième édition du livre O'Reilly Generative Deep Learning: Teaching Machines to Paint, Write, Compose and Play.
★ 1 553+3Évolution des étoiles sur les 7 derniers jours - #59
Inpainting de haute qualité sans entraînement pour tous les modèles stable diffusion. Supporte ComfyUI.
★ 1 372+4Évolution des étoiles sur les 7 derniers jours - #60
Timestep Embedding Tells : Il est temps de mettre en cache pour le modèle de diffusion vidéo.
★ 1 371+2Évolution des étoiles sur les 7 derniers jours