text-to-image
Erfasste Open-Source-Repos mit dem Tag text-to-image, sortiert nach Sternen.
- #31
WebAI2API: Ein auf Camoufox basierendes Web-AI-zu-API-Tool, das LMArena/Gemini usw. sowie Mehrfenster-Konkurrenz und Kontoisolierung unterstützt.
★ 1.315+16Sterne-Änderung der letzten 7 Tage - #32
Offline-Inferenz-Engine für Kunst, Echtzeit-Sprachkonversationen, LLM-gestützte Chatbots und automatisierte Workflows
★ 1.314+0Sterne-Änderung der letzten 7 Tage - #33
Eine Sammlung von Ressourcen zur steuerbaren Generierung mit Text-to-Image-Diffusion-Modellen.
★ 1.110+0Sterne-Änderung der letzten 7 Tage - #34★ 1.102+1Sterne-Änderung der letzten 7 Tage
- #35
Eine kuratierte Liste von OpenClaw-Ressourcen, Tools, Fähigkeiten, Tutorials und Artikeln. OpenClaw (ehemals Moltbot / Clawdbot) – ein Open-Source, selbst gehosteter KI-Agent für WhatsApp, Telegram, Discord und über 50 Integrationen.
★ 1.005+8Sterne-Änderung der letzten 7 Tage - #36
Implementierung von Muse: Text-zu-Bild-Generierung via Masked Generative Transformers in PyTorch
★ 918+0Sterne-Änderung der letzten 7 Tage - #37★ 916+5Sterne-Änderung der letzten 7 Tage
- #38
Das verständlichste Tutorial zur Verwendung von LoRA (Low-Rank Adaptation) innerhalb des diffusers-Frameworks für KI-Generierungsforscher.
★ 822-1Sterne-Änderung der letzten 7 Tage - #39
[ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (Offizielle Implementierung)
★ 814+0Sterne-Änderung der letzten 7 Tage - #40
[TMLR 2025🔥] Eine Übersicht über autoregressive Modelle in der Vision.
★ 808+1Sterne-Änderung der letzten 7 Tage - #41
CLIP + FFT/DWT/RGB = Text zu Bild/Video
★ 789+0Sterne-Änderung der letzten 7 Tage - #42
Offizielle Implementierung für „Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models“ (SIGGRAPH 2023)
★ 770+0Sterne-Änderung der letzten 7 Tage - #43
Eine Sammlung fantastischer Studien zur Text-zu-Bild-Generierung.
★ 765+0Sterne-Änderung der letzten 7 Tage - #44
Eine Übersicht zur Text-zu-Video-Generierung/-Synthese.
★ 744+3Sterne-Änderung der letzten 7 Tage - #45
Paddle Multimodal Integration and eXploration, unterstützt gängige multimodale Aufgaben, einschließlich End-to-End-Trainingsmodellen für große multimodale Daten und einer Diffusion-Model-Toolbox. Ausgezeichnet durch hohe Leistung und Flexibilität.
★ 723-1Sterne-Änderung der letzten 7 Tage - #46
Die fortschrittlichste Nano Banana Bildgenerator- und Editor-Anwendung. Deine zentrale Anlaufstelle für KI-Bildgenerierung und -überarbeitungen. Intuitive Benutzeroberfläche mit Referenzbildern, Bearbeitung per Bildmasken, Versionsverlauf und mehr. Unterstützt durch die Gemini 2.5 Flash Images API.
★ 710+0Sterne-Änderung der letzten 7 Tage - #47
HunyuanImage-2.1: Ein effizientes Diffusionsmodell für hochauflösende (2K) Text-zu-Bild-Generierung
★ 674+0Sterne-Änderung der letzten 7 Tage - #48
Offizielle Implementierung des OneDiffusion-Papers (CVPR 2025)
★ 665+0Sterne-Änderung der letzten 7 Tage - #49
Flash Diffusion – Beschleunigung bedingter Diffusionsmodelle (AAAI 2025 Oral)
★ 664+1Sterne-Änderung der letzten 7 Tage - #50
face-to-sticker
★ 641+0Sterne-Änderung der letzten 7 Tage - #51
(Akzeptiert bei IJCV) Liquid: Sprachmodelle sind skalierbare und einheitliche multimodale Generatoren
★ 640+0Sterne-Änderung der letzten 7 Tage - #52
Offizielle Implementierung für „Blended Latent Diffusion“ [SIGGRAPH 2023]
★ 632+0Sterne-Änderung der letzten 7 Tage - #53★ 614+0Sterne-Änderung der letzten 7 Tage
- #54
Kuratierte Sammlung wiederverwendbarer JSON-Prompt-Vorlagen und Stilreferenzen für die KI-Bilderzeugung. Täglich aktualisiert.
★ 593+17Sterne-Änderung der letzten 7 Tage - #55
Offizielle Implementierung für „Blended Diffusion for Text-driven Editing of Natural Images“ [CVPR 2022].
★ 588+0Sterne-Änderung der letzten 7 Tage - #56
Offizieller Code für das CVPR 2025 Paper "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."
★ 588-1Sterne-Änderung der letzten 7 Tage - #57
Eine kuratierte Liste von Forschungsarbeiten zur LLM-basierten multimodalen Generierung (Bild, Video, 3D und Audio).
★ 552+0Sterne-Änderung der letzten 7 Tage - #58
AI Plugin ist eine leistungsstarke Erweiterung für Payload CMS, die fortschrittliche KI-Funktionen zur Optimierung der Inhaltserstellung und -verwaltung integriert.
★ 547+2Sterne-Änderung der letzten 7 Tage - #59
[NeurIPS 2025 Spotlight] Ein vereinheitlichter Tokenizer für visuelle Generierung und Verständnis
★ 529-1Sterne-Änderung der letzten 7 Tage - #60
Eine Sammlung von Google Colab Notebooks für verschiedene Projekte
★ 519+5Sterne-Änderung der letzten 7 Tage