vision
Erfasste Open-Source-Repos mit dem Tag vision, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit vision am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit vision getaggt wurden.
- #1
Ein Vision-Toolkit und Skill für rein textbasierte LLMs – Bild-Frage-Antwort, OCR bei langen Screenshots, Frontend-UI-Wiederherstellung und GUI-Automatisierung mit optionaler nahtloser Integration für Codex, Claude Code, Pi, Oh My Pi und OpenCode
★ 1.127 - #2
Augen für rein textbasierte DeepSeek Harness Agents: integrierte kostenlose Vision-Chain (kein Schlüssel) + pixelgenaue Vision-Tools (Fragen & Antworten, Grounding, Zuschneiden, Pixel-Diff, Farben, OCR, SVG-Trace, Freistellen, Screenshots). Ein-Befehl-Installation, kein Python, Bildverarbeitung funktioniert wie normale Tool-Aufrufe.
★ 1.034
- #1
Enhanced ChatGPT Clone: Features Agents, MCP, Skills, DeepSeek, Anthropic, AWS, OpenAI, Responses API, Azure, Groq, o1, GPT-5, Mistral, OpenRouter, Vertex AI, Gemini, Artifacts, AI model switching, message search, Code Interpreter, langchain, DALL-E-3, OpenAPI Actions, Functions, Secure Multi-User Auth, Presets, open-source für Self-Hosting. Active
★ 42.597+274Sterne-Änderung der letzten 7 Tage - #2
Xray, durchdringt alles. Auch das beste v2ray-core. Wo die Magie passiert. Eine offene Plattform für verschiedene Anwendungen.
★ 41.282+130Sterne-Änderung der letzten 7 Tage - #3
Der Open-Source Multimodal AI Agent Stack: Verbindet modernste KI-Modelle und Agenten-Infrastruktur
★ 38.742+62Sterne-Änderung der letzten 7 Tage - #4★ 34.555-5Sterne-Änderung der letzten 7 Tage
- #5★ 22.878+52Sterne-Änderung der letzten 7 Tage
- #6
Das Ende des Web-Parsings. Der Beginn der skalierbaren, pixel-nativen Suche. Link: https://pixelrag.ai/
★ 9.788+134Sterne-Änderung der letzten 7 Tage - #7
📸 Eine leistungsstarke React Native Kamera-Bibliothek.
★ 9.586+18Sterne-Änderung der letzten 7 Tage - #8
Das erste Vision-Plugin für DeepSeek Harness und die Vision-Brücke für jeden reinen Text-Coding-Agenten. Bild einfügen, strukturierte JSON-Beweise erhalten (OCR, Layout, Semantik).
★ 3.756+255Sterne-Änderung der letzten 7 Tage - #9
SimpleMem: Effizientes, lebenslanges Gedächtnis für LLM-Agenten – Text & Multimodal
★ 3.726+18Sterne-Änderung der letzten 7 Tage - #10
Open-Source-Hardware- und Software-Plattform zum Bau eines autonomen Kleinwagen-Modells.
★ 3.496+2Sterne-Änderung der letzten 7 Tage - #11
[CVPR 2023] DepGraph: Hin zu beliebigen strukturellen Pruning-Verfahren; LLMs, Vision Foundation Models usw.
★ 3.348+1Sterne-Änderung der letzten 7 Tage - #12★ 2.730+1Sterne-Änderung der letzten 7 Tage
- #13★ 2.331-1Sterne-Änderung der letzten 7 Tage
- #14
Java- und Kotlin-Codebeispiele, die auf cloud.google.com verwendet werden
★ 1.906+1Sterne-Änderung der letzten 7 Tage - #15
Visuelle Intelligenz für Ihr Zuhause.
★ 1.446+10Sterne-Änderung der letzten 7 Tage - #16★ 1.270+2Sterne-Änderung der letzten 7 Tage
- #17
Videos, Notizen und Experimente zum Verständnis von Deep Learning
★ 1.198+1Sterne-Änderung der letzten 7 Tage - #18
🌝 MLKit ist ein leistungsstarkes und benutzerfreundliches Toolkit. Mit ML Kit können Sie ganz einfach Funktionen wie Texterkennung, Barcode-Erkennung, Bildbeschriftung, Gesichtserkennung und Objekterkennung implementieren.
★ 1.169+1Sterne-Änderung der letzten 7 Tage - #19
Ein Vision-Toolkit und Skill für rein textbasierte LLMs – Bild-Frage-Antwort, OCR bei langen Screenshots, Frontend-UI-Wiederherstellung und GUI-Automatisierung mit optionaler nahtloser Integration für Codex, Claude Code, Pi, Oh My Pi und OpenCode
★ 1.127+23Sterne-Änderung der letzten 7 Tage - #20
Eine reine MLP-Lösung für Computer Vision von Google AI
★ 1.064+1Sterne-Änderung der letzten 7 Tage - #21
Augen für rein textbasierte DeepSeek Harness Agents: integrierte kostenlose Vision-Chain (kein Schlüssel) + pixelgenaue Vision-Tools (Fragen & Antworten, Grounding, Zuschneiden, Pixel-Diff, Farben, OCR, SVG-Trace, Freistellen, Screenshots). Ein-Befehl-Installation, kein Python, Bildverarbeitung funktioniert wie normale Tool-Aufrufe.
★ 1.034+85Sterne-Änderung der letzten 7 Tage - #22
CALVIN - Ein Benchmark für Language-Conditioned Policy Learning für Long-Horizon-Roboter-Manipulationsaufgaben
★ 977+5Sterne-Änderung der letzten 7 Tage - #23★ 953+2Sterne-Änderung der letzten 7 Tage
- #24
Eine kuratierte Sammlung von iOS-, ML- und AR-Ressourcen, ergänzt durch einige UI-Erweiterungen
★ 911+0Sterne-Änderung der letzten 7 Tage - #25
3DMatch - ein 3D-ConvNet-basierter lokaler geometrischer Deskriptor zum Ausrichten von 3D-Meshes und Punktwolken.
★ 905+1Sterne-Änderung der letzten 7 Tage - #26
Hochleistungs-Vision-Bibliothek in Python. Skalieren Sie Ihre Forschung, nicht Boilerplate.
★ 816+2Sterne-Änderung der letzten 7 Tage - #27
🎰 Eine kuratierte Liste von Machine-Learning-Ressourcen, vorzugsweise CoreML
★ 813+0Sterne-Änderung der letzten 7 Tage - #28
Diese Anwendung kann Text übersetzen, der von einer beliebigen auf Ihrem Computer laufenden Anwendung erfasst wurde.
★ 754+12Sterne-Änderung der letzten 7 Tage - #29
Konvertieren Sie jeden Webdesign-Screenshot in sauberen HTML/CSS-Code
★ 681-1Sterne-Änderung der letzten 7 Tage - #30
Computer Vision-basiertes Tool zur Generierung von ML-Trainingsdaten :rocket:
★ 612+0Sterne-Änderung der letzten 7 Tage