llama-cpp
Erfasste Open-Source-Repos mit dem Tag llama-cpp, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit llama-cpp am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit llama-cpp getaggt wurden.
- #1
Sudoloser Apple Silicon Systemmonitor (native SwiftUI GUI) mit ANE-, Media Engine- und Speicherbandbreiten-Tracking
★ 901 - #2
Open-Source-Tool für Android ohne Root-Zugriff zur Echtzeit-Bildschirmübersetzung, geeignet für Spiele, Visual Novels und Mangas. Unterstützt On-Device- und Cloud-OCR, Offline-LLMs, verschiedene Übersetzungsdienste sowie Text-to-Speech (TTS), wobei Übersetzungen direkt auf dem Bildschirm angezeigt werden.
★ 697 - #3
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 513 - #4
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 494
- #1★ 25.746+78Sterne-Änderung der letzten 7 Tage
- #2
Schnellste und einzige macOS-Diktierapp mit On-Device-STT und speziell trainiertem KI-Erweiterungsmodell. Windows-Build verfügbar! Eine lokale Alternative zu Wispr Flow. Schreib uns auf X für ein Osterei 😉 - https://x.com/fluidvoiceapp
★ 11.060+273Sterne-Änderung der letzten 7 Tage - #3
Ein selbst gehosteter, offlinefähiger Chatbot im ChatGPT-Stil. Unterstützt durch Llama 2. 100 % privat, es verlässt kein Daten Ihr Gerät. Neu: Code Llama-Unterstützung!
★ 10.938-1Sterne-Änderung der letzten 7 Tage - #4
Ersetzen Sie GPT durch ein beliebiges LLM, indem Sie nur eine einzige Codezeile ändern. Mit Xinference können Sie Open-Source-, Sprach- und multimodale Modelle in der Cloud, on-premise oder auf Ihrem Laptop ausführen – alles über eine einheitliche, produktionsbereite Inferenz-API.
★ 9.528+21Sterne-Änderung der letzten 7 Tage - #5
Open-Source-Modell SenseVoiceSmall für ASR in Mandarin, Kantonesisch, Englisch, Japanisch und Koreanisch, Spracherkennung, Emotionserkennung und Audio-Ereigniserkennung.
★ 9.172+51Sterne-Änderung der letzten 7 Tage - #6
Verwandeln Sie Ihren PC, Mac oder Linux-Rechner in einen KI-Server. LLM-Inferenz, Chat-UI, Sprache, Agenten, Workflows, RAG und Bildgenerierung.
★ 4.823+197Sterne-Änderung der letzten 7 Tage - #7
Eine C#/.NET-Bibliothek zum effizienten Ausführen von LLMs (🦙LLaMA/LLaVA) auf Ihrem lokalen Gerät.
★ 3.788+2Sterne-Änderung der letzten 7 Tage - #8
Open-Source-KI-Kamera-Fähigkeitenplattform, KI-NVR & CCTV-Überwachung. Lokale VLM-Videoanalyse mit Qwen, DeepSeek, SmolVLM, LLaVA, YOLO26. KI-gestützter Agenten-Sicherheitskamera-Agent – überwacht, versteht, erinnert sich und schützt Ihr Zuhause über Telegram, Discord oder Slack. Erweiterbare KI-Fähigkeiten. OpenAI, Google, Anthropic oder lokale KI. Läuft auf Mac Mini & AI-PCs.
★ 3.024+18Sterne-Änderung der letzten 7 Tage - #9
Das Schweizer Taschenmesser für Offline-KI. Chatten, sehen, sprechen und Bilder generieren auf deinem Smartphone oder Mac – GGUF-LLMs, Vision, Whisper-Sprache-zu-Text, Stable Diffusion, Tool-Aufrufe und lokale Netzwerkserver. Läuft auf CPU, GPU oder NPU. Kein Konto, kein API-Key, null Daten verlassen dein Gerät.
★ 3.021+54Sterne-Änderung der letzten 7 Tage - #10
LLM-Inferenzserver für spekulatives Sampling auf Consumer- und heterogener Hardware
★ 2.813+35Sterne-Änderung der letzten 7 Tage - #11
Maid ist eine freie Open-Source-Anwendung für die lokale Interaktion mit llama.cpp-Modellen sowie für dieリモート-Interaktion mit Modellen von Anthropic, DeepSeek, Ollama, Mistral und OpenAI.
★ 2.655+18Sterne-Änderung der letzten 7 Tage - #12
Local-First-KI-Agent. Optimiert für lokale KI-Modelle. Großes Kontextfenster. Korrekte Tool-Aufrufe. Läuft privat auf dem eigenen Gerät.
★ 2.425-9Sterne-Änderung der letzten 7 Tage - #13
Ein Python-Framework für selbst gehostetes LLM-Tool-Calling und mehrstufige agentische Workflows.
★ 2.229+6Sterne-Änderung der letzten 7 Tage - #14
Führe KI-Modelle lokal auf deinem Rechner aus mit Node.js-Bindings für llama.cpp. Erzwinge ein JSON-Schema für die Modellausgabe auf Generierungsebene.
★ 2.167+5Sterne-Änderung der letzten 7 Tage - #15★ 1.702+1Sterne-Änderung der letzten 7 Tage
- #16
Mit dem Mac sprechen, Dokumente abfragen, keine Cloud erforderlich. Sprach-KI auf dem Gerät + RAG
★ 1.542-1Sterne-Änderung der letzten 7 Tage - #17
Open-Source-LLM-basiertes ASR-Modellfamilie für Chinesisch, Dialekte, Akzente und mehrsprachige Sprache, mit FunASR, vLLM, Streaming- und llama.cpp-Runtimes.
★ 1.503+16Sterne-Änderung der letzten 7 Tage - #18
Ein gemütliches Zuhause für Ihre LLMs.
★ 1.477+11Sterne-Änderung der letzten 7 Tage - #19★ 1.398+1Sterne-Änderung der letzten 7 Tage
- #20★ 1.028+4Sterne-Änderung der letzten 7 Tage
- #21
KI-Agenten mit Docker Compose erstellen und ausführen. Eine Sammlung einsatzbereiter Beispiele zur Orchestrierung von Open-Source-LLMs, Tools und Agent-Runtimes.
★ 1.027+1Sterne-Änderung der letzten 7 Tage - #22
Cotabby ist eine lokale KI-Autovervollständigung für Ihren gesamten Mac. Open Source. Auf dem Gerät. Überall, wo Sie tippen.
★ 980+18Sterne-Änderung der letzten 7 Tage - #23
Sudoloser Apple Silicon Systemmonitor (native SwiftUI GUI) mit ANE-, Media Engine- und Speicherbandbreiten-Tracking
★ 901+57Sterne-Änderung der letzten 7 Tage - #24
Open-Source-Tool für Android ohne Root-Zugriff zur Echtzeit-Bildschirmübersetzung, geeignet für Spiele, Visual Novels und Mangas. Unterstützt On-Device- und Cloud-OCR, Offline-LLMs, verschiedene Übersetzungsdienste sowie Text-to-Speech (TTS), wobei Übersetzungen direkt auf dem Bildschirm angezeigt werden.
★ 697+67Sterne-Änderung der letzten 7 Tage - #25★ 678—Sterne-Änderung der letzten 7 Tage
- #26
Selbstevaluierungs-Interview für KI-Programmierer.
★ 598+0Sterne-Änderung der letzten 7 Tage - #27
ComfyUI-Knoten für Vision-Language-Modelle: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Plus Open-Vocabulary-Erkennung, SAM2/SAM3-Segmentierung, Video-Temporal-Reasoning, GGUF über llama.cpp und gehostete LLM/VLM-APIs.
★ 589+4Sterne-Änderung der letzten 7 Tage - #28
GraphRAG-rs ist eine leistungsstarke, hochmoderne Rust-Implementierung von GraphRAG (Graph-basierte Retrieval Augmented Generation), die Wissensgraphen aus Dokumenten erstellt und Abfragen in natürlicher Sprache mit konfigurierbarer Entitätsextraktion und lokaler LLM-Integration ermöglicht.
★ 525-1Sterne-Änderung der letzten 7 Tage - #29
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 513—Sterne-Änderung der letzten 7 Tage