Zum Hauptinhalt springen
buildradar
Sign in
Thema · text-to-image

text-to-image

Erfasste Open-Source-Repos mit dem Tag text-to-image, sortiert nach Sternen.

62 Repos
  • WebAI2API@foxhui

    WebAI2API: Ein auf Camoufox basierendes Web-AI-zu-API-Tool, das LMArena/Gemini usw. sowie Mehrfenster-Konkurrenz und Kontoisolierung unterstützt.

    1.315+16Sterne-Änderung der letzten 7 Tage
  • airunner@Capsize-Games

    Offline-Inferenz-Engine für Kunst, Echtzeit-Sprachkonversationen, LLM-gestützte Chatbots und automatisierte Workflows

    1.314+0Sterne-Änderung der letzten 7 Tage
  • Eine Sammlung von Ressourcen zur steuerbaren Generierung mit Text-to-Image-Diffusion-Modellen.

    1.110+0Sterne-Änderung der letzten 7 Tage
  • CogView4@zai-org

    CogView4, CogView3-Plus und CogView3 (ECCV 2024)

    1.102+1Sterne-Änderung der letzten 7 Tage
  • awesome-agent-apis@Anil-matcha

    Eine kuratierte Liste von OpenClaw-Ressourcen, Tools, Fähigkeiten, Tutorials und Artikeln. OpenClaw (ehemals Moltbot / Clawdbot) – ein Open-Source, selbst gehosteter KI-Agent für WhatsApp, Telegram, Discord und über 50 Integrationen.

    1.005+8Sterne-Änderung der letzten 7 Tage
  • muse-maskgit-pytorch@lucidrains

    Implementierung von Muse: Text-zu-Bild-Generierung via Masked Generative Transformers in PyTorch

    918+0Sterne-Änderung der letzten 7 Tage
  • unfake.js@jenissimo

    KI-generierte Pixel-Art und Vektorgrafiken direkt im Browser korrigieren

    916+5Sterne-Änderung der letzten 7 Tage
  • Lora-for-Diffusers@haofanwang

    Das verständlichste Tutorial zur Verwendung von LoRA (Low-Rank Adaptation) innerhalb des diffusers-Frameworks für KI-Generierungsforscher.

    822-1Sterne-Änderung der letzten 7 Tage
  • TF-ICON@Shilin-LU

    [ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (Offizielle Implementierung)

    814+0Sterne-Änderung der letzten 7 Tage
  • [TMLR 2025🔥] Eine Übersicht über autoregressive Modelle in der Vision.

    808+1Sterne-Änderung der letzten 7 Tage
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB = Text zu Bild/Video

    789+0Sterne-Änderung der letzten 7 Tage
  • Attend-and-Excite@yuval-alaluf

    Offizielle Implementierung für „Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models“ (SIGGRAPH 2023)

    770+0Sterne-Änderung der letzten 7 Tage
  • Eine Sammlung fantastischer Studien zur Text-zu-Bild-Generierung.

    765+0Sterne-Änderung der letzten 7 Tage
  • Eine Übersicht zur Text-zu-Video-Generierung/-Synthese.

    744+3Sterne-Änderung der letzten 7 Tage
  • PaddleMIX@PaddlePaddle

    Paddle Multimodal Integration and eXploration, unterstützt gängige multimodale Aufgaben, einschließlich End-to-End-Trainingsmodellen für große multimodale Daten und einer Diffusion-Model-Toolbox. Ausgezeichnet durch hohe Leistung und Flexibilität.

    723-1Sterne-Änderung der letzten 7 Tage
  • NanoBananaEditor@markfulton

    Die fortschrittlichste Nano Banana Bildgenerator- und Editor-Anwendung. Deine zentrale Anlaufstelle für KI-Bildgenerierung und -überarbeitungen. Intuitive Benutzeroberfläche mit Referenzbildern, Bearbeitung per Bildmasken, Versionsverlauf und mehr. Unterstützt durch die Gemini 2.5 Flash Images API.

    710+0Sterne-Änderung der letzten 7 Tage
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: Ein effizientes Diffusionsmodell für hochauflösende (2K) Text-zu-Bild-Generierung

    674+0Sterne-Änderung der letzten 7 Tage
  • OneDiffusion@lehduong

    Offizielle Implementierung des OneDiffusion-Papers (CVPR 2025)

    665+0Sterne-Änderung der letzten 7 Tage
  • flash-diffusion@gojasper

    Flash Diffusion – Beschleunigung bedingter Diffusionsmodelle (AAAI 2025 Oral)

    664+1Sterne-Änderung der letzten 7 Tage
  • face-to-sticker

    641+0Sterne-Änderung der letzten 7 Tage
  • Liquid@FoundationVision

    (Akzeptiert bei IJCV) Liquid: Sprachmodelle sind skalierbare und einheitliche multimodale Generatoren

    640+0Sterne-Änderung der letzten 7 Tage
  • blended-latent-diffusion@omriav

    Offizielle Implementierung für „Blended Latent Diffusion“ [SIGGRAPH 2023]

    632+0Sterne-Änderung der letzten 7 Tage
  • MIGC@limuloo

    [CVPR 2024 Highlight] MIGC und [TPAMI 2024] MIGC++ (Offizielle Implementierung)

    614+0Sterne-Änderung der letzten 7 Tage
  • Kuratierte Sammlung wiederverwendbarer JSON-Prompt-Vorlagen und Stilreferenzen für die KI-Bilderzeugung. Täglich aktualisiert.

    593+17Sterne-Änderung der letzten 7 Tage
  • blended-diffusion@omriav

    Offizielle Implementierung für „Blended Diffusion for Text-driven Editing of Natural Images“ [CVPR 2022].

    588+0Sterne-Änderung der letzten 7 Tage
  • semantic-draw@ironjr

    Offizieller Code für das CVPR 2025 Paper "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."

    588-1Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Forschungsarbeiten zur LLM-basierten multimodalen Generierung (Bild, Video, 3D und Audio).

    552+0Sterne-Änderung der letzten 7 Tage
  • payload-ai@ashbuilds

    AI Plugin ist eine leistungsstarke Erweiterung für Payload CMS, die fortschrittliche KI-Funktionen zur Optimierung der Inhaltserstellung und -verwaltung integriert.

    547+2Sterne-Änderung der letzten 7 Tage
  • UniTok@FoundationVision

    [NeurIPS 2025 Spotlight] Ein vereinheitlichter Tokenizer für visuelle Generierung und Verständnis

    529-1Sterne-Änderung der letzten 7 Tage
  • Google-Colab_Notebooks@Isi-dev

    Eine Sammlung von Google Colab Notebooks für verschiedene Projekte

    519+5Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen