Aller au contenu principal
buildradar
Sign in
Sujet · text-to-image

text-to-image

Dépôts open source suivis étiquetés text-to-image, triés par étoiles.

62 dépôts
  • WebAI2API@foxhui

    WebAI2API : outil de conversion d'IA web en API basé sur Camoufox, prenant en charge LMArena/Gemini, avec gestion de la concurrence multi-fenêtres et isolation des comptes.

    1 315+0Évolution des étoiles sur les 7 derniers jours
  • airunner@Capsize-Games

    Moteur d'inférence hors ligne pour l'art, les conversations vocales en temps réel, les chatbots basés sur LLM et les flux de travail automatisés.

    1 314+0Évolution des étoiles sur les 7 derniers jours
  • Une collection de ressources sur la génération contrôlable avec des modèles de diffusion texte-vers-image.

    1 110+0Évolution des étoiles sur les 7 derniers jours
  • CogView4@zai-org

    CogView4, CogView3-Plus et CogView3 (ECCV 2024)

    1 101+0Évolution des étoiles sur les 7 derniers jours
  • awesome-agent-apis@Anil-matcha

    Une liste organisée de ressources, outils, compétences, tutoriels et articles sur OpenClaw. OpenClaw (anciennement Moltbot / Clawdbot) est un agent IA open-source auto-hébergé pour WhatsApp, Telegram, Discord et plus de 50 intégrations.

    1 005+8Évolution des étoiles sur les 7 derniers jours
  • muse-maskgit-pytorch@lucidrains

    Implémentation de Muse : génération texte-vers-image via des transformeurs génératifs masqués, en Pytorch.

    918+0Évolution des étoiles sur les 7 derniers jours
  • unfake.js@jenissimo

    Corrigez vos pixel art et images vectorielles générés par IA directement dans votre navigateur

    916+6Évolution des étoiles sur les 7 derniers jours
  • Lora-for-Diffusers@haofanwang

    Le tutoriel le plus accessible pour utiliser LoRA (Low-Rank Adaptation) avec le framework diffusers pour les chercheurs en génération par IA.

    822+0Évolution des étoiles sur les 7 derniers jours
  • TF-ICON@Shilin-LU

    [ICCV 2023] "TF-ICON : Diffusion-Based Training-Free Cross-Domain Image Composition" (implémentation officielle).

    814+0Évolution des étoiles sur les 7 derniers jours
  • [TMLR 2025🔥] Étude sur les modèles autorégressifs en vision.

    808+0Évolution des étoiles sur les 7 derniers jours
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB = texte vers image/vidéo.

    789+0Évolution des étoiles sur les 7 derniers jours
  • Attend-and-Excite@yuval-alaluf

    Implémentation officielle de "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)

    770+0Évolution des étoiles sur les 7 derniers jours
  • Une collection d'études exceptionnelles sur la génération de texte vers image.

    765+0Évolution des étoiles sur les 7 derniers jours
  • Une étude sur la génération et la synthèse de texte vers vidéo.

    744+3Évolution des étoiles sur les 7 derniers jours
  • PaddleMIX@PaddlePaddle

    Paddle Multimodal Integration and eXploration, prenant en charge les tâches multimodales courantes, incluant des modèles de pré-entraînement multimodaux à grande échelle et une boîte à outils de modèles de diffusion, alliant haute performance et flexibilité.

    723-1Évolution des étoiles sur les 7 derniers jours
  • NanoBananaEditor@markfulton

    Application de génération et d'édition d'images Nano Banana la plus avancée. Votre hub central pour la génération et la révision d'images par IA. Interface intuitive avec images de référence, édition par masques, historique des versions, et plus encore. Propulsé par l'API d'images Gemini 2.5 Flash.

    710+0Évolution des étoiles sur les 7 derniers jours
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1 : Un modèle de diffusion efficace pour la génération d'images texte‑à‑image haute résolution (2K)

    674-1Évolution des étoiles sur les 7 derniers jours
  • OneDiffusion@lehduong

    Implémentation officielle du papier OneDiffusion (CVPR 2025)

    665+0Évolution des étoiles sur les 7 derniers jours
  • flash-diffusion@gojasper

    Flash Diffusion — accélération des modèles de diffusion conditionnelle (AAAI 2025 Oral)

    664+1Évolution des étoiles sur les 7 derniers jours
  • face-to-sticker

    641+0Évolution des étoiles sur les 7 derniers jours
  • Liquid@FoundationVision

    (Accepté par IJCV) Liquid : Les modèles de langage sont des générateurs multimodaux évolutifs et unifiés

    640+0Évolution des étoiles sur les 7 derniers jours
  • blended-latent-diffusion@omriav

    Implémentation officielle de "Blended Latent Diffusion" [SIGGRAPH 2023]

    632+0Évolution des étoiles sur les 7 derniers jours
  • MIGC@limuloo

    [Sélection CVPR 2024] MIGC et [TPAMI 2024] MIGC++ (Implémentation officielle)

    614+0Évolution des étoiles sur les 7 derniers jours
  • Collection sélectionnée de modèles de prompts JSON réutilisables et de références de style pour la génération d'images par IA. Mis à jour quotidiennement.

    592+6Évolution des étoiles sur les 7 derniers jours
  • blended-diffusion@omriav

    Implémentation officielle de "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022]

    588-1Évolution des étoiles sur les 7 derniers jours
  • semantic-draw@ironjr

    Code officiel de l'article CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."

    588+0Évolution des étoiles sur les 7 derniers jours
  • Une liste organisée d'articles sur la génération multimodale basée sur les LLM (image, vidéo, 3D et audio).

    552+0Évolution des étoiles sur les 7 derniers jours
  • payload-ai@ashbuilds

    AI Plugin est une extension puissante pour Payload CMS, intégrant des capacités d'IA avancées pour améliorer la création et la gestion de contenu.

    547-1Évolution des étoiles sur les 7 derniers jours
  • UniTok@FoundationVision

    [NeurIPS 2025 Spotlight] Un tokenizer unifié pour la génération et la compréhension visuelle.

    529-1Évolution des étoiles sur les 7 derniers jours
  • Google-Colab_Notebooks@Isi-dev

    Une collection de notebooks Google Colab pour divers projets

    519+1Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets