image-generation
Erfasste Open-Source-Repos mit dem Tag image-generation, sortiert nach Sternen.
- #91
[TMLR 2025🔥] Eine Übersicht über autoregressive Modelle in der Vision.
★ 808+1Sterne-Änderung der letzten 7 Tage - #92
Open-WebUI Tools ist ein modulares Toolkit zur Erweiterung und Bereicherung Ihrer Open-WebUI-Instanz, das sie in eine leistungsstarke KI-Workstation verwandelt. Mit über 15 spezialisierten Tools, Funktions-Pipelines und Filtern unterstützt dieses Projekt akademische Forschung, agentenbasierte Autonomie, multimodale Kreativität, Workflows und mehr.
★ 807+5Sterne-Änderung der letzten 7 Tage - #93
Local-first visuelle Generierungs-Laufzeitumgebung und -Studio für Menschen und Coding Agents, mit reproduzierbaren Bild- und Video-Workflows über mehrere Anbieter hinweg.
★ 751+30Sterne-Änderung der letzten 7 Tage - #94
Eine Übersicht zur Text-zu-Video-Generierung/-Synthese.
★ 744+3Sterne-Änderung der letzten 7 Tage - #95
Eine Source-Available Codex-Fähigkeit zur Reduzierung von Fotografien auf sparsame redaktionelle Abstraktionen.
★ 743+35Sterne-Änderung der letzten 7 Tage - #96
Über 1.400 kuratierte, trendige KI-Bild-Prompts von X, nach Interaktion sortiert. Funktioniert mit NanoBanana, GPT Image 2, Midjourney
★ 731+7Sterne-Änderung der letzten 7 Tage - #97
Lokales, agenten-natives Control Plane für ComfyUI – MCP-Server + Seitenleisten-Agent, der Bilder, Videos und Audio generiert, Workflows erstellt und ausführt sowie Ihren Live-Graphen in natürlicher Sprache mit beliebigem LLM (Claude, ChatGPT, Gemini, offline Ollama oder jedem gehosteten Modell) bearbeitet. 178 Tools, 36 KI-Fähigkeiten, 55 Installer-Pakete. Lokal, LAN, VPS oder Comfy Cloud.
★ 729+35Sterne-Änderung der letzten 7 Tage - #98
[ICCV 2021] Focal Frequency Loss für Bildrekonstruktion und -synthese
★ 714+1Sterne-Änderung der letzten 7 Tage - #99
[ICLR 2026] ChronoEdit: Hin zu temporalem Schließen für Bildbearbeitung und Weltsimulation
★ 706+1Sterne-Änderung der letzten 7 Tage - #100
Leitfaden zur Bildsignalverarbeitung (ISP). Erfahren Sie alles über die Umwandlung eines Bildes/Videos in digitaler Form durch Aufgaben wie Rauschunterdrückung, Filterung, Belichtungsautomatik, Autofokus, HDR-Korrektur und Bildschärfung mit einem spezialisierten Medienprozessor.
★ 703+1Sterne-Änderung der letzten 7 Tage - #101
[ECCV 2024] OMG: Verdeckungsfreundliche, personalisierte Multikonzept-Generierung in Diffusionsmodellen
★ 702+1Sterne-Änderung der letzten 7 Tage - #102
Ein KI-Bildgenerierungs-WebUI-Arbeitsbereich für GPT-image-2 mit Unterstützung für Codex Responses und OpenAI-kompatible APIs, integrierter öffentlicher Galerie, Multi-Typ-Chip-Schnellreferenzen, Prompt-Vorlagen, Multitasking und lokaler Warteschlangenverwaltung.
★ 693+9Sterne-Änderung der letzten 7 Tage - #103
Ein einheitliches Framework für einfaches Reinforcement Learning in Flow-Matching-Modellen
★ 692+7Sterne-Änderung der letzten 7 Tage - #104
Eine Sammlung von Papers und Code für CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024 AIGC
★ 677+1Sterne-Änderung der letzten 7 Tage - #105
HunyuanImage-2.1: Ein effizientes Diffusionsmodell für hochauflösende (2K) Text-zu-Bild-Generierung
★ 675+0Sterne-Änderung der letzten 7 Tage - #106★ 660-1Sterne-Änderung der letzten 7 Tage
- #107
Eine Sammlung von Papers und Code zu Low-Level-Vision von der CVPR2023/2022
★ 660+0Sterne-Änderung der letzten 7 Tage - #108
Dieses Repository enthält eine reine C++ ONNX-Implementierung mehrerer Offline-KI-Modelle wie StableDiffusion (1.5 und XL), ControlNet, Midas, HED und OpenPose.
★ 633+0Sterne-Änderung der letzten 7 Tage - #109
Offizielle Implementierung für „Blended Latent Diffusion“ [SIGGRAPH 2023]
★ 632+0Sterne-Änderung der letzten 7 Tage - #110
Eigenständige Charakter-Auswahl-App mit AI-Prompt- und ComfyUI/WebUI-API-Unterstützung für waiIllustriousSDXL, waiANIMA und andere Modelle
★ 611+1Sterne-Änderung der letzten 7 Tage - #111
Eine weitere PyTorch-Implementierung von Stable Diffusion (wahrscheinlich leicht zu lesen)
★ 594+0Sterne-Änderung der letzten 7 Tage - #112
Kuratierte Sammlung wiederverwendbarer JSON-Prompt-Vorlagen und Stilreferenzen für die KI-Bilderzeugung. Täglich aktualisiert.
★ 592+18Sterne-Änderung der letzten 7 Tage - #113
Offizieller Code für das CVPR 2025 Paper "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."
★ 588-1Sterne-Änderung der letzten 7 Tage - #114
📚 GPT4o Prompts Dictionary | Kuratierte Sammlung von KI-Bildgenerierungs-Prompts
★ 585+0Sterne-Änderung der letzten 7 Tage - #115
Kostenlose Open-Source-Alternative zu Weavy AI, Krea Nodes, Freepik Spaces & FloraFauna AI — knotenbasierter KI-Workflow-Builder für generative Bild- und Videopipelines
★ 575+10Sterne-Änderung der letzten 7 Tage - #116
Offizieller Code für das ECCV 2024 Paper — One-Shot Diffusion Mimicker für die Generierung handschriftlicher Texte
★ 562+1Sterne-Änderung der letzten 7 Tage - #117
[AAAI2024] FontDiffuser: One-Shot-Schriftgenerierung mittels Denoising Diffusion mit Multi-Scale Content Aggregation und Style Contrastive Learning
★ 560+7Sterne-Änderung der letzten 7 Tage - #118
Genblaze ist ein Open-Source-Python-SDK zur Orchestrierung generativer KI-Medienpipelines über Video-, Audio- und Bildanbieter hinweg, mit integrierter Herkunftsnachverfolgung für jeden Output.
★ 559-1Sterne-Änderung der letzten 7 Tage - #119
Codex skill for turning everyday photos into poetic white-paper hand-drawn illustrations.
★ 557+46Sterne-Änderung der letzten 7 Tage - #120
AI Plugin ist eine leistungsstarke Erweiterung für Payload CMS, die fortschrittliche KI-Funktionen zur Optimierung der Inhaltserstellung und -verwaltung integriert.
★ 548+2Sterne-Änderung der letzten 7 Tage