image-generation
Erfasste Open-Source-Repos mit dem Tag image-generation, sortiert nach Sternen.
- #61
Ein einfacher, eigenständiger Viewer zum Lesen von Prompts aus Stable Diffusion-generierten Bildern außerhalb der WebUI.
★ 1.340+0Sterne-Änderung der letzten 7 Tage - #62
Ein natives, einheitliches multimodales Modell mit 3B aktiven Parametern für Bild- und Videoverständnis, -generierung und -bearbeitung.
★ 1.334+3Sterne-Änderung der letzten 7 Tage - #63
WebAI2API: Ein auf Camoufox basierendes Web-AI-zu-API-Tool, das LMArena/Gemini usw. sowie Mehrfenster-Konkurrenz und Kontoisolierung unterstützt.
★ 1.315+16Sterne-Änderung der letzten 7 Tage - #64
Offline-Inferenz-Engine für Kunst, Echtzeit-Sprachkonversationen, LLM-gestützte Chatbots und automatisierte Workflows
★ 1.314+0Sterne-Änderung der letzten 7 Tage - #65
[NeurIPS 2020] Differentiable Augmentation für das dateneffiziente GAN-Training
★ 1.308+0Sterne-Änderung der letzten 7 Tage - #66
Bernini ist ein einheitliches Framework für die Videoerstellung und -bearbeitung, das einen MLLM-basierten semantischen Planer mit einem DiT-basierten Renderer kombiniert.
★ 1.300+10Sterne-Änderung der letzten 7 Tage - #67
Inpaint Anything-Erweiterung führt Stable-Diffusion-Inpainting in einer Browser-UI mit Masken von Segment Anything aus
★ 1.298+0Sterne-Änderung der letzten 7 Tage - #68
[ICCV 2025] Offizielle Implementierung von "MV-Adapter: Multi-view Consistent Image Generation Made Easy"
★ 1.289+1Sterne-Änderung der letzten 7 Tage - #69
Einfache Erstellung von PDFs und Bildern in Symfony durch HTML-Konvertierung mit WebKit
★ 1.247+0Sterne-Änderung der letzten 7 Tage - #70
Einfaches Shell-Skript zur Nutzung von OpenAI ChatGPT und DALL-E über das Terminal. Kein Python oder JS erforderlich.
★ 1.241+3Sterne-Änderung der letzten 7 Tage - #71
Sammlung großartiger Ressourcen zur Bild-zu-Bild-Übersetzung.
★ 1.239+0Sterne-Änderung der letzten 7 Tage - #72
Automatische Fehlersuche in Bilddatensätzen und Anwendung datenzentrierter Computer Vision.
★ 1.199+0Sterne-Änderung der letzten 7 Tage - #73
PyTorch - FID-Berechnung mit korrekten Schritten zur Bildgrößenänderung und Quantisierung [CVPR 2022]
★ 1.167+0Sterne-Änderung der letzten 7 Tage - #74
[ICLR24] Offizielle Implementierung des Papiers „MagicDrive: Street View Generation with Diverse 3D Geometry Control“
★ 1.167+1Sterne-Änderung der letzten 7 Tage - #75
Offizielle PyTorch-Implementierung von „VITON-HD: High-Resolution Virtual Try-On via Misalignment-Aware Normalization“ (CVPR 2021)
★ 1.161+0Sterne-Änderung der letzten 7 Tage - #76
Unzensiertes lokales KI-Studio für Windows, Linux und macOS. Installationsfreie GUI für Bildgenerierung, GGUF-LLMs, Text-to-Speech & Speech-to-Text
★ 1.118+87Sterne-Änderung der letzten 7 Tage - #77
Guicangs Material-Illustration-Skill: Generierung von beschrifteten Erklärungsgrafiken, Diagrammverschönerung und Referenz-Hilfsbildern.
★ 1.116+37Sterne-Änderung der letzten 7 Tage - #78
Nativer LLM-Inferenzserver für Apple Silicon. Kompatibel mit der OpenAI- und Anthropic-API. Kein Python. Inklusive MLX Core macOS-App mit Chat, Agentenmodus und Tool-Aufrufen.
★ 1.115+245Sterne-Änderung der letzten 7 Tage - #79★ 1.102+1Sterne-Änderung der letzten 7 Tage
- #80
Nahtlose Erweiterung jedes Bildes in jede Richtung mit KI. Open-Source-Web-App, angetrieben von Gemini über OpenRouter, mit Poisson-geblendeten Übergängen und Best-of-3-Variantenauswahl.
★ 1.101+4Sterne-Änderung der letzten 7 Tage - #81
Eine kuratierte Liste von OpenClaw-Ressourcen, Tools, Fähigkeiten, Tutorials und Artikeln. OpenClaw (ehemals Moltbot / Clawdbot) – ein Open-Source, selbst gehosteter KI-Agent für WhatsApp, Telegram, Discord und über 50 Integrationen.
★ 1.005+8Sterne-Änderung der letzten 7 Tage - #82
:fire: :fire: :fire: Eine Literaturliste zu einigen aktuellen Arbeiten im Bereich Computer Vision (CV)
★ 973+1Sterne-Änderung der letzten 7 Tage - #83
[ICLR 2026] Ein trainingsfreies iteratives Framework für die Visualisierung langer Geschichten
★ 957-2Sterne-Änderung der letzten 7 Tage - #84
Generierung von Bildern aus beliebigen Kameraperspektiven mittels interaktiver 3D-Steuerung. Bewegen Sie die Kamera im 3D-Raum oder nutzen Sie Schieberegler für Azimut, Elevation und Distanz. Erstellt mit Three.js und Gradio, zweisprachige Benutzeroberfläche (ZH/EN).
★ 955+218Sterne-Änderung der letzten 7 Tage - #85
Offizielle PyTorch-Implementierung für das Paper High-Resolution Virtual Try-On with Misalignment and Occlusion-Handled Conditions (ECCV 2022).
★ 917+0Sterne-Änderung der letzten 7 Tage - #86
Ein Local-First AI-Workflow-WebUI für Gemini mit integriertem multimodalem Chat, Canvas, Dateiverarbeitung, Echtzeitsuche, Codeausführung und fortgeschrittenem Reasoning.
★ 899+1Sterne-Änderung der letzten 7 Tage - #87★ 881-1Sterne-Änderung der letzten 7 Tage
- #88
🎨 Open-Source-KI-Präsentationsstudio in Codex: bildnative Decks, jede Folie eine vollständige visuelle Leinwand. ⚡ Über 10 hochwertige Folien in ca. 4–5 Minuten — Der Schnellmodus rendert jede Seite parallel. 🔍 Die gesamte Kette live verfolgen: Recherche → Gliederung → Stil → Rendern → Bearbeiten → Präsentieren → PDF/PPTX exportieren. 🖥️ Browser-first · keine API-Schlüssel · persistente Projekte.
★ 878+23Sterne-Änderung der letzten 7 Tage - #89★ 875+1Sterne-Änderung der letzten 7 Tage
- #90
Flatkey Media-Generierungs-CLI für Bilder, Videos, Audio, Text, Credits und Modellsuche.
★ 845+191Sterne-Änderung der letzten 7 Tage