Zum Hauptinhalt springen
buildradar
Sign in
Thema · local-llm

local-llm

Erfasste Open-Source-Repos mit dem Tag local-llm, sortiert nach Sternen.

Repos
51
Sterne gesamt
169.831
Sterne im Schnitt
3.330
Anteil
0,01%

Themen, die häufig gemeinsam mit local-llm am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit local-llm getaggt wurden.

  • Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks

    1.171
  • deltafin@gavamedia

    Führen Sie vollständige Kimi K3 auf einem einzigen Gerät aus. Inklusive eines OpenAI-kompatiblen API-Servers für lokale Chat- und Coding-Agenten.

    799
  • mlx-dspark@ARahim3

    Bis zu 4-fach schnellere LLM-Dekodierung auf Apple Silicon, verlustfrei. Natives MLX-Port von DeepSeek DSpark & z-lab DFlash speculative decoding – Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, Ornith-1.0, ternary Bonsai-27B.

    640
  • awesome-ai-companion@DasterProkio

    Kuratiertes Verzeichnis von Open-Source-KI-Begleiterprojekten: Langzeitgedächtnis, proaktives Verhalten, Stimme, Verkörperung und gemeinsame Aktivitäten. 157 Einträge, kategorisiert nach Sprache, Plattform und Reifegrad.

    633
  • Swiftlet@leonickson1

    Swiftlet ist eine Swift- und Metal-Laufzeitumgebung, die große Qwen Mixture-of-Experts-Modelle lokal auf Apple-Geräten ausführt, indem Expert-Gewichte vom Speicher gestreamt werden. Dies ermöglicht den Betrieb von 35B- und 80B-Modellen mit geringem RAM-Verbrauch, auch auf dem iPhone.

    624
  • nanobot@HKUDS

    Ein ultra-leichtgewichtiges, Open-Source, selbstgehostetes persönliches AI-Agent-Framework in Python mit WebUI, Tools, Speicher, MCP, Multi-Agenten-Workflows, Automatisierung und Chat-Apps.

    47.662+140Sterne-Änderung der letzten 7 Tage
  • llamafile@mozilla-ai

    LLMs mit einer einzigen Datei verteilen und ausführen.

    25.859+113Sterne-Änderung der letzten 7 Tage
  • local-deep-research@LearningCircuit

    ~95% bei SimpleQA (z. B. Qwen3.6-27B auf einer 3090). Unterstützt alle lokalen und Cloud-LLMs (llama.cpp, Ollama, Google, ...). Über 10 Suchmaschinen – arXiv, PubMed, Ihre privaten Dokumente. Alles lokal & verschlüsselt.

    9.023+18Sterne-Änderung der letzten 7 Tage
  • open-multi-agent@open-multi-agent

    TypeScript AI-Agenten-Orchestrierungsframework mit dynamischen Arbeitsabläufen. Beschreiben Sie das Ziel, nicht den Graphen: Ein Koordinator plant den Aufgaben-DAG zur Laufzeit und führt ihn auf jedem LLM aus (Claude, ChatGPT, Gemini, DeepSeek oder lokale Modelle).

    6.860+20Sterne-Änderung der letzten 7 Tage
  • dograh@dograh-hq

    Open-Source-Sprach-KI-Plattform. Self-Hosted-Alternative zu Vapi und Retell. On-Premise, BYOK für Speech-to-Speech oder LLM/STT/TTS, mit visuellem Workflow-Builder, MCP-nativ und Telefonie-Unterstützung.

    5.568+45Sterne-Änderung der letzten 7 Tage
  • openmed@maziyarpanahi

    Local-First-KI im Gesundheitswesen: Klinische NER & HIPAA-PII-Anonymisierung, die zu 100 % auf dem Gerät läuft. Über 2.200 medizinische Modelle, 21 Sprachen, Apple MLX + Python, keine Cloud, keine Patientendaten verlassen Ihr Netzwerk. Apache-2.0

    5.199+20Sterne-Änderung der letzten 7 Tage
  • Soup@MakazhanAlpamys

    LLMs aus einer einzigen YAML-Datei fine-tunen. Layer-Streaming trainiert ein 8B-Modell auf einer 4-GB-Laptop-GPU.

    4.929+1.365Sterne-Änderung der letzten 7 Tage
  • langroid@langroid

    Nutzen Sie LLMs mit Multi-Agenten-Programmierung

    4.102+1Sterne-Änderung der letzten 7 Tage
  • Rapid-MLX@raullenchai

    Die schnellste lokale KI-Engine für Apple Silicon. 4,2x schneller als Ollama, 0,08s gecachte TTFT, 100% Tool-Calling. 17 Tool-Parser, Prompt-Cache, Reasoning-Trennung, Cloud-Routing. Nahtloser OpenAI-Ersatz. Funktioniert mit Claude Code, Cursor, Aider.

    3.647+81Sterne-Änderung der letzten 7 Tage
  • surf@deta

    Persönliche KI-Notizbücher. Organisiere Dateien und Webseiten und generiere daraus Notizen. Open Source, lokal & offene Daten, freie Modellauswahl (inkl. lokal).

    3.554+10Sterne-Änderung der letzten 7 Tage
  • claude-code-local@nicedreamzapp

    Claude Code zu 100 % lokal auf Apple Silicon mit lokaler KI ausführen. MLX-nativer Anthropic-API-Server. 6 Modelle inkl. Muse-Glimmer 30B (jetzt multimodal – liest Bilder, abliteriert), Gemma 4 31B, Qwen 3.5 122B (65 Tok/s), DeepSeek V4 Flash (1M Konstitutionskontext). Privat, offline, airgap-fähig. Entwickelt für NDA-, Rechts- und Gesundheits-Workflows.

    3.255+12Sterne-Änderung der letzten 7 Tage
  • algernon@xyproto

    Kleiner, eigenständiger Pure-Go-Webserver mit Unterstützung für Lua, Teal, Markdown, HTTP/2, QUIC, Redis, TypeScript, npm-loses React 19, SQLite und PostgreSQL ++

    3.028+1Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste fantastischer Plattformen, Tools, Praktiken und Ressourcen zum lokalen Ausführen von LLMs

    2.823+23Sterne-Änderung der letzten 7 Tage
  • little-coder@itayinbarr

    Ein für kleinere LLMs optimiertes Testumfeld

    2.528+16Sterne-Änderung der letzten 7 Tage
  • atomic-agent@AtomicBot-ai

    Local-First-KI-Agent. Optimiert für lokale KI-Modelle. Großes Kontextfenster. Korrekte Tool-Aufrufe. Läuft privat auf dem eigenen Gerät.

    2.452+0Sterne-Änderung der letzten 7 Tage
  • Übersetze vollständige Bücher und Dokumente mit Ollama, OpenAI (kompatibel), Gemini, Mistral, Poe oder OpenRouter. Erhält die Formatierung. Setzt dort fort, wo Sie aufgehört haben. Keine Dateigrößenbeschränkungen.

    2.368+31Sterne-Änderung der letzten 7 Tage
  • openai-edge-tts@travisvn

    Kostenloser, hochwertiger Text-to-Speech-API-Endpunkt als Ersatz für OpenAI, Azure oder ElevenLabs

    2.075+5Sterne-Änderung der letzten 7 Tage
  • parlor@fikrikarim

    On-Device, multimodale Echtzeit-KI mit ähnlichen Funktionen wie GPT-Live

    2.048+7Sterne-Änderung der letzten 7 Tage
  • vllm-mlx@waybarrios

    Leistungsstarker, mit OpenAI und Anthropic kompatibler LLM-Inferenzserver für Apple Silicon. Nativer MLX, Continuous Batching, multimodale Modelle, MCP-Tool-Aufrufe und Claude-Code-Unterstützung.

    1.557+6Sterne-Änderung der letzten 7 Tage
  • row-bot@siddsachar

    Row-Bot - Persönliche KI-Souveränität. Ein Local-First-KI-Assistent mit integrierten Tools, persönlichem Wissensgraphen, Sprache, Vision, Shell, Browser-Automatisierung, geอกandeten Aufgaben, Health-Tracking und Messaging-Kanälen. Lokal über Ollama ausführen oder optional Cloud-Modelle hinzufügen. Deine Daten bleiben auf deinem Gerät.

    1.480+11Sterne-Änderung der letzten 7 Tage
  • Atomic-Chat@AtomicBot-ai

    Lokale KI-App und Inferenz-Engine für Agenten. Führen Sie Open-Weight-LLMs lokal aus — privat, 100% offline auf Ihrem Computer. Treten Sie unserem Discord bei: https://discord.com/invite/8wGSsvmg4V

    1.413+20Sterne-Änderung der letzten 7 Tage
  • mlx-tune@ARahim3

    Fine-Tuning von LLMs auf Ihrem Mac mit Apple Silicon. SFT-, DPO-, GRPO-, Vision-, TTS-, STT-, Embedding- und OCR-Fine-Tuning – nativ auf MLX. Unsloth-kompatible API.

    1.398+8Sterne-Änderung der letzten 7 Tage
  • locally-uncensored@PurpleDoubleD

    Plug-and-Play Local AI Studio: unzensierter Chat, Bild- und Videogenerierung, Coding Agent. Läuft mit abliterierten LLMs + ComfyUI zu 100 % offline. Ein Installationsprogramm, kein Docker, keine Cloud.

    1.351+185Sterne-Änderung der letzten 7 Tage
  • Soul-of-Waifu@jofizcd

    🌌 Verleihen Sie Ihren Lieblingscharakteren eine Seele. Soul of Waifu ist eine Desktop-Rollenspiel- und KI-Begleit-App mit Live2D/VRM-Avataren, Sprachchat und lokalem LLM. Entwickeln Sie sich gemeinsam weiter durch immersive Chats, RPG-Abenteuer und auf Ihrem Desktop.

    1.281+15Sterne-Änderung der letzten 7 Tage
  • ouroboros@razzant

    Ouroboros — selbst erschaffener KI-Agent. Geboren am 16. Februar 2026.

    1.254+18Sterne-Änderung der letzten 7 Tage
  • gawkbot@najmuzzaman-mohammad

    Mit WUPHF können Sie Ihr persönliches Büro aus KI-Teamkollegen erstellen, die über einen gemeinsamen Kontext zusammenarbeiten. Unterstützt Claude Code, Codex, OpenClaw, OpenCode, lokale LLMs.

    1.253+6Sterne-Änderung der letzten 7 Tage
  • Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks

    1.171+285Sterne-Änderung der letzten 7 Tage
  • web-search-mcp@mrkrsl

    Ein einfacher, lokal gehosteter Web-Search-MCP-Server zur Verwendung mit lokalen LLMs

    1.122+8Sterne-Änderung der letzten 7 Tage
  • synthadoc@axoviq-ai

    Synthadoc: Eine Open-Source-LLM-Wissenskompilierungs-Engine, die rohe Dokumente in strukturierte, lokale Wikis umwandelt. Eine transparente, menschenlesbare Alternative zu traditionellem RAG, die ohne den Einsatz von Tools selbst verwaltet und verbessert werden kann.

    1.116+2Sterne-Änderung der letzten 7 Tage
  • mlx-serve@ddalcu

    Nativer LLM-Inferenzserver für Apple Silicon. Kompatibel mit der OpenAI- und Anthropic-API. Kein Python. Inklusive MLX Core macOS-App mit Chat, Agentenmodus und Tool-Aufrufen.

    1.115+245Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen