diffusion-models
Dépôts open source suivis étiquetés diffusion-models, triés par étoiles.
- #61
Entraînement évolutif et optimisé en mémoire de modèles de diffusion
★ 1 359+0Évolution des étoiles sur les 7 derniers jours - #62
[ICASSP 2024] 🍵 Matcha-TTS : Une architecture TTS rapide avec appariement de flux conditionnel
★ 1 353+3Évolution des étoiles sur les 7 derniers jours - #63
[ICLR 2023 Oral] Restauration d'images zero-shot utilisant le modèle Denoising Diffusion Null-Space
★ 1 351+2Évolution des étoiles sur les 7 derniers jours - #64
FireRed-Image-Edit est un modèle de base puissant pour l'édition d'images, atteignant des performances de pointe open-source avec un suivi précis des instructions, une génération haute fidélité, une cohérence d'identité supérieure et une fusion multi-éléments transparente.
★ 1 350+3Évolution des étoiles sur les 7 derniers jours - #65
[AAAI 2025] IMAGDressing : Génération modulaire et interactive de vêtements pour l'habillage virtuel. Permet une génération d'images humaines personnalisables avec un contrôle flexible des vêtements, des poses et des scènes, garantissant une haute fidélité et la cohérence des vêtements.
★ 1 343+0Évolution des étoiles sur les 7 derniers jours - #66
[TPAMI 2025🔥] MagicTime : Modèles de génération de vidéos en accéléré en tant que simulateurs métamorphiques.
★ 1 337-1Évolution des étoiles sur les 7 derniers jours - #67
Package portable pour exécuter Hunyuan3D 2.0/2.1 sur Windows.
★ 1 326+4Évolution des étoiles sur les 7 derniers jours - #68
Pruna est un framework d'optimisation de modèles conçu pour les développeurs, permettant de fournir des modèles plus rapides et plus efficaces avec un minimum de surcoût.
★ 1 274+1Évolution des étoiles sur les 7 derniers jours - #69
[CVPR 2025 Oral & Finaliste du meilleur article] Difix3D+ : Amélioration des reconstructions 3D avec des modèles de diffusion en une étape.
★ 1 267+1Évolution des étoiles sur les 7 derniers jours - #70
[CVPR2024, Highlight] Code officiel pour DragDiffusion.
★ 1 259+0Évolution des étoiles sur les 7 derniers jours - #71★ 1 238-1Évolution des étoiles sur les 7 derniers jours
- #72
Modèle de synthèse vocale basé sur le Flow Matching avec contrôle de style piloté par emoji
★ 1 228+4Évolution des étoiles sur les 7 derniers jours - #73
HunyuanCustom : une architecture pilotée par le multimodal pour la génération de vidéos personnalisées
★ 1 228-1Évolution des étoiles sur les 7 derniers jours - #74
Implémentation PyTorch de MeanFlow et iMF (modélisation générative en une étape).
★ 1 196-1Évolution des étoiles sur les 7 derniers jours - #75
Wunjo CE : Échange de visages, synchronisation labiale, suppression d'objets, de texte et d'arrière-plan, restylisation, séparation audio, clonage vocal et génération vidéo. Open source, local et gratuit.
★ 1 170+1Évolution des étoiles sur les 7 derniers jours - #76
[ICLR24] Implémentation officielle de l'article « MagicDrive: Street View Generation with Diverse 3D Geometry Control »
★ 1 167+1Évolution des étoiles sur les 7 derniers jours - #77
Une collection de ressources sur la génération contrôlable avec des modèles de diffusion texte-vers-image.
★ 1 110+0Évolution des étoiles sur les 7 derniers jours - #78★ 1 108+3Évolution des étoiles sur les 7 derniers jours
- #79
Stable Diffusion implémenté à partir de zéro en PyTorch.
★ 1 078+0Évolution des étoiles sur les 7 derniers jours - #80
[ICLR'24 spotlight] Série de grands modèles multimodaux chinois et anglais (Chat et Paint) basés sur le modèle CPM.
★ 1 061-1Évolution des étoiles sur les 7 derniers jours - #81
[ECCV 2024 Oral] MotionDirector : Personnalisation de mouvement pour les modèles de diffusion texte-vidéo.
★ 1 053+2Évolution des étoiles sur les 7 derniers jours - #82
[ICLR 2025 Oral] Implémentation officielle de "Diffusion-Based Planning for Autonomous Driving with Flexible Guidance".
★ 1 050+4Évolution des étoiles sur les 7 derniers jours - #83
[CVPR 2025 Highlight] 3DTopia-XL : Génération d'assets 3D PBR de haute qualité via Primitive Diffusion
★ 1 046+0Évolution des étoiles sur les 7 derniers jours - #84
[ICLR 2024 Spotlight] SyncDreamer : Génération d'images cohérentes multi-vues à partir d'une image vue unique.
★ 1 044-1Évolution des étoiles sur les 7 derniers jours - #85
Implémentation officielle de l'article : "FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models"
★ 1 013-1Évolution des étoiles sur les 7 derniers jours - #86★ 986+22Évolution des étoiles sur les 7 derniers jours
- #87
[CVPR 2024] PIA, votre animateur d'images personnalisé. Animez vos images par invite textuelle, en combinant avec Dreambooth pour obtenir des vidéos époustouflantes.
★ 975+0Évolution des étoiles sur les 7 derniers jours - #88★ 970-1Évolution des étoiles sur les 7 derniers jours
- #89★ 969+0Évolution des étoiles sur les 7 derniers jours
- #90
[ICLR 2026] Un framework itératif sans entraînement pour la visualisation d'histoires longues
★ 959+0Évolution des étoiles sur les 7 derniers jours