text-to-image
Dépôts open source suivis étiquetés text-to-image, triés par étoiles.
- #31
WebAI2API : outil de conversion d'IA web en API basé sur Camoufox, prenant en charge LMArena/Gemini, avec gestion de la concurrence multi-fenêtres et isolation des comptes.
★ 1 315+0Évolution des étoiles sur les 7 derniers jours - #32
Moteur d'inférence hors ligne pour l'art, les conversations vocales en temps réel, les chatbots basés sur LLM et les flux de travail automatisés.
★ 1 314+0Évolution des étoiles sur les 7 derniers jours - #33
Une collection de ressources sur la génération contrôlable avec des modèles de diffusion texte-vers-image.
★ 1 110+0Évolution des étoiles sur les 7 derniers jours - #34★ 1 101+0Évolution des étoiles sur les 7 derniers jours
- #35
Une liste organisée de ressources, outils, compétences, tutoriels et articles sur OpenClaw. OpenClaw (anciennement Moltbot / Clawdbot) est un agent IA open-source auto-hébergé pour WhatsApp, Telegram, Discord et plus de 50 intégrations.
★ 1 005+8Évolution des étoiles sur les 7 derniers jours - #36
Implémentation de Muse : génération texte-vers-image via des transformeurs génératifs masqués, en Pytorch.
★ 918+0Évolution des étoiles sur les 7 derniers jours - #37
Corrigez vos pixel art et images vectorielles générés par IA directement dans votre navigateur
★ 916+6Évolution des étoiles sur les 7 derniers jours - #38
Le tutoriel le plus accessible pour utiliser LoRA (Low-Rank Adaptation) avec le framework diffusers pour les chercheurs en génération par IA.
★ 822+0Évolution des étoiles sur les 7 derniers jours - #39
[ICCV 2023] "TF-ICON : Diffusion-Based Training-Free Cross-Domain Image Composition" (implémentation officielle).
★ 814+0Évolution des étoiles sur les 7 derniers jours - #40
[TMLR 2025🔥] Étude sur les modèles autorégressifs en vision.
★ 808+0Évolution des étoiles sur les 7 derniers jours - #41
CLIP + FFT/DWT/RGB = texte vers image/vidéo.
★ 789+0Évolution des étoiles sur les 7 derniers jours - #42
Implémentation officielle de "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)
★ 770+0Évolution des étoiles sur les 7 derniers jours - #43
Une collection d'études exceptionnelles sur la génération de texte vers image.
★ 765+0Évolution des étoiles sur les 7 derniers jours - #44
Une étude sur la génération et la synthèse de texte vers vidéo.
★ 744+3Évolution des étoiles sur les 7 derniers jours - #45
Paddle Multimodal Integration and eXploration, prenant en charge les tâches multimodales courantes, incluant des modèles de pré-entraînement multimodaux à grande échelle et une boîte à outils de modèles de diffusion, alliant haute performance et flexibilité.
★ 723-1Évolution des étoiles sur les 7 derniers jours - #46
Application de génération et d'édition d'images Nano Banana la plus avancée. Votre hub central pour la génération et la révision d'images par IA. Interface intuitive avec images de référence, édition par masques, historique des versions, et plus encore. Propulsé par l'API d'images Gemini 2.5 Flash.
★ 710+0Évolution des étoiles sur les 7 derniers jours - #47
HunyuanImage-2.1 : Un modèle de diffusion efficace pour la génération d'images texte‑à‑image haute résolution (2K)
★ 674-1Évolution des étoiles sur les 7 derniers jours - #48
Implémentation officielle du papier OneDiffusion (CVPR 2025)
★ 665+0Évolution des étoiles sur les 7 derniers jours - #49
Flash Diffusion — accélération des modèles de diffusion conditionnelle (AAAI 2025 Oral)
★ 664+1Évolution des étoiles sur les 7 derniers jours - #50
face-to-sticker
★ 641+0Évolution des étoiles sur les 7 derniers jours - #51
(Accepté par IJCV) Liquid : Les modèles de langage sont des générateurs multimodaux évolutifs et unifiés
★ 640+0Évolution des étoiles sur les 7 derniers jours - #52
Implémentation officielle de "Blended Latent Diffusion" [SIGGRAPH 2023]
★ 632+0Évolution des étoiles sur les 7 derniers jours - #53★ 614+0Évolution des étoiles sur les 7 derniers jours
- #54
Collection sélectionnée de modèles de prompts JSON réutilisables et de références de style pour la génération d'images par IA. Mis à jour quotidiennement.
★ 592+6Évolution des étoiles sur les 7 derniers jours - #55
Implémentation officielle de "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022]
★ 588-1Évolution des étoiles sur les 7 derniers jours - #56
Code officiel de l'article CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."
★ 588+0Évolution des étoiles sur les 7 derniers jours - #57
Une liste organisée d'articles sur la génération multimodale basée sur les LLM (image, vidéo, 3D et audio).
★ 552+0Évolution des étoiles sur les 7 derniers jours - #58
AI Plugin est une extension puissante pour Payload CMS, intégrant des capacités d'IA avancées pour améliorer la création et la gestion de contenu.
★ 547-1Évolution des étoiles sur les 7 derniers jours - #59
[NeurIPS 2025 Spotlight] Un tokenizer unifié pour la génération et la compréhension visuelle.
★ 529-1Évolution des étoiles sur les 7 derniers jours - #60
Une collection de notebooks Google Colab pour divers projets
★ 519+1Évolution des étoiles sur les 7 derniers jours