diffusion
Dépôts open source suivis étiquetés diffusion, triés par étoiles.
- #31★ 2 129+18Évolution des étoiles sur les 7 derniers jours
- #32
Modèles de diffusion en imagerie médicale (publié dans la revue Medical Image Analysis).
★ 2 110+2Évolution des étoiles sur les 7 derniers jours - #33
[NeurIPS 2025] L'édition d'images vaut bien un seul LoRA ! 0,1 % de données d'entraînement pour une édition d'image fantastique ! Surpasse GPT-4o en persistance d'identité ~ Checkpoint MoE publié ! Seulement 4 Go de VRAM suffisent pour l'exécuter !
★ 2 104+1Évolution des étoiles sur les 7 derniers jours - #34
Le modèle autorégressif surpasse la diffusion : Llama pour la génération d'images à grande échelle
★ 1 966+0Évolution des étoiles sur les 7 derniers jours - #35
[ECCV 2024] Implémentation officielle de l'article « BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion »
★ 1 744-1Évolution des étoiles sur les 7 derniers jours - #36
[ICLR'25 Oral] Alignement de représentation pour la génération : entraîner des Diffusion Transformers est plus simple que vous ne le pensez.
★ 1 706+2Évolution des étoiles sur les 7 derniers jours - #37
[ACM MM 2025] FantasyTalking : Génération de portraits parlants réalistes via la synthèse de mouvement cohérent
★ 1 628+0Évolution des étoiles sur les 7 derniers jours - #38
Boîte à outils de compression de modèles conçue pour une meilleure utilisabilité, exhaustivité et efficacité.
★ 1 619+58Évolution des étoiles sur les 7 derniers jours - #39
PALLAIDIUM : studio de cinéma basé sur l'IA générative, intégré à l'éditeur vidéo de Blender (VSE), permettant une production complète du script à l'écran.
★ 1 523+0Évolution des étoiles sur les 7 derniers jours - #40
[ICCV 2025] UNO : Une méthode de personnalisation universelle pour le conditionnement mono et multi-sujets
★ 1 362+0Évolution des étoiles sur les 7 derniers jours - #41
Entraînement évolutif et optimisé en mémoire de modèles de diffusion
★ 1 359+0Évolution des étoiles sur les 7 derniers jours - #42
Extension Inpaint Anything effectuant de l'inpainting stable diffusion via une interface web utilisant des masques de Segment Anything.
★ 1 298+0Évolution des étoiles sur les 7 derniers jours - #43★ 1 238-1Évolution des étoiles sur les 7 derniers jours
- #44
[ECCV 2026] MixGRPO : Libérer l'efficacité du GRPO basé sur les flux avec des ODE-SDE mixtes
★ 1 177+0Évolution des étoiles sur les 7 derniers jours - #45
Serveur d'inférence LLM natif pour Apple Silicon. Compatible avec les API OpenAI et Anthropic. Sans Python. Inclut l'application macOS MLX Core avec chat, mode agent et appel d'outils.
★ 1 115+245Évolution des étoiles sur les 7 derniers jours - #46
Implémentation officielle de l'article "Full-Order Sampling-Based MPC for Torque-Level Locomotion Control via Diffusion-Style Annealing". DIAL-MPC est un nouveau framework MPC basé sur l'échantillonnage pour le contrôle de couple complet des robots à pattes, alliant précision et agilité sans entraînement préalable.
★ 997+1Évolution des étoiles sur les 7 derniers jours - #47
Liste de conceptions moléculaires et matérielles utilisant l'IA générative et l'apprentissage profond.
★ 952+1Évolution des étoiles sur les 7 derniers jours - #48
[ICML 2026] Base de code officielle pour "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" & Causal Forcing++
★ 948+10Évolution des étoiles sur les 7 derniers jours - #49
Un système de synthèse vocale (TTS) open source basé sur des LLM.
★ 921+2Évolution des étoiles sur les 7 derniers jours - #50
UniWorld : encodeurs sémantiques haute résolution pour la compréhension et la génération visuelles unifiées
★ 890+0Évolution des étoiles sur les 7 derniers jours - #51
[CVPR 2025 Highlight] Génération de texte vers vidéo préservant l'identité par décomposition fréquentielle.
★ 856+1Évolution des étoiles sur les 7 derniers jours - #52★ 835+0Évolution des étoiles sur les 7 derniers jours
- #53
Implémentation officielle pour « RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers » (ICML 2025), UltraViCo (ICLR 2026) et UltraImage
★ 827+2Évolution des étoiles sur les 7 derniers jours - #54
Adan : Algorithme de momentum de Nesterov adaptatif pour une optimisation plus rapide des modèles profonds.
★ 822+0Évolution des étoiles sur les 7 derniers jours - #55
Kandinsky 5.0 : Une famille de modèles de diffusion pour la génération d'images et de vidéos.
★ 819+3Évolution des étoiles sur les 7 derniers jours - #56
[TMLR 2025🔥] Étude sur les modèles autorégressifs en vision.
★ 808+1Évolution des étoiles sur les 7 derniers jours - #57
Cartes d'attribution basées sur l'attention pour l'interprétation de Stable Diffusion.
★ 802+0Évolution des étoiles sur les 7 derniers jours - #58
rCM & Causal-rCM : Algorithmes et infrastructures de pointe unifiés pour la distillation de diffusion vidéo bidirectionnelle/autorégressive à grande échelle
★ 800+6Évolution des étoiles sur les 7 derniers jours - #59
Code simple et lisible pour l'entraînement et l'échantillonnage de modèles de diffusion.
★ 785+2Évolution des étoiles sur les 7 derniers jours - #60
[CVPR 2024] FRESCO : Correspondance spatio-temporelle pour la traduction vidéo zero-shot.
★ 782-1Évolution des étoiles sur les 7 derniers jours