Aller au contenu principal
buildradar
Sign in
Sujet · local-llm

local-llm

Dépôts open source suivis étiquetés local-llm, triés par étoiles.

Dépôts
51
Total d'étoiles
169 831
Étoiles en moyenne
3 330
Part
0,01%

Sujets qui apparaissent souvent aux côtés de local-llm sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés local-llm.

  • Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks

    1 200
  • deltafin@gavamedia

    Exécutez Kimi K3 complet sur un seul appareil. Inclut un serveur API compatible OpenAI pour le chat local et les agents de codage.

    799
  • mlx-dspark@ARahim3

    Décodage LLM jusqu'à 4 fois plus rapide sur Apple Silicon, sans perte. Portage MLX natif du décodage spéculatif DSpark de DeepSeek et DFlash de z-lab — Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, Ornith-1.0, Bonsai-27B ternaire.

    640
  • awesome-ai-companion@DasterProkio

    Index organisé de projets open source de compagnons IA : mémoire à long terme, comportement proactif, voix, incarnation et activités partagées. 157 entrées classées par langage, plateforme et état de préparation.

    633
  • Swiftlet@leonickson1

    Swiftlet est un runtime Swift et Metal qui exécute localement de grands modèles Qwen Mixture-of-Experts sur les appareils Apple en diffusant les poids des experts depuis le stockage, permettant aux modèles 35B et 80B de fonctionner avec peu de RAM, y compris sur iPhone.

    628
  • nanobot@HKUDS

    Framework d'agent IA personnel ultra-léger, open source et auto-hébergé en Python avec interface Web, outils, mémoire, MCP, flux de travail multi-agents, automatisation et applications de chat

    47 662+140Évolution des étoiles sur les 7 derniers jours
  • llamafile@mozilla-ai

    Distribuez et exécutez des LLM avec un seul fichier.

    25 859+113Évolution des étoiles sur les 7 derniers jours
  • local-deep-research@LearningCircuit

    ~95 % sur SimpleQA (par ex. Qwen3.6-27B sur une 3090). Prend en charge tous les LLM locaux et cloud (llama.cpp, Ollama, Google, ...). Plus de 10 moteurs de recherche - arXiv, PubMed, vos documents privés. Tout est local et chiffré.

    9 023+18Évolution des étoiles sur les 7 derniers jours
  • open-multi-agent@open-multi-agent

    Framework d'orchestration d'agents IA en TypeScript avec workflows dynamiques. Décrivez l'objectif plutôt que le graphe : un coordinateur planifie le DAG des tâches à l'exécution sur n'importe quel LLM (Claude, ChatGPT, Gemini, DeepSeek ou modèles locaux).

    6 860+20Évolution des étoiles sur les 7 derniers jours
  • dograh@dograh-hq

    Plateforme IA vocale open source. Alternative auto-hébergée à Vapi et Retell. Déploiement sur site, BYOK pour Speech-to-Speech ou LLM/STT/TTS, avec un constructeur de workflow visuel, support natif MCP et téléphonie.

    5 568+45Évolution des étoiles sur les 7 derniers jours
  • openmed@maziyarpanahi

    IA de santé locale : reconnaissance d'entités nommées cliniques et désidentification PII HIPAA fonctionnant à 100 % sur l'appareil. Plus de 2 200 modèles médicaux, 21 langues, Apple MLX + Python, sans cloud, aucune donnée patient ne quitte votre réseau. Apache-2.0

    5 199+20Évolution des étoiles sur les 7 derniers jours
  • Soup@MakazhanAlpamys

    Fine-tuning de LLM à partir d'un seul fichier YAML. Le streaming de couches permet d'entraîner un modèle 8B sur un GPU d'ordinateur portable de 4 Go.

    4 929+1 365Évolution des étoiles sur les 7 derniers jours
  • langroid@langroid

    Exploiter les LLM avec la programmation multi-agents

    4 102+1Évolution des étoiles sur les 7 derniers jours
  • Rapid-MLX@raullenchai

    Le moteur d'IA local le plus rapide pour Apple Silicon. 4,2x plus rapide qu'Ollama, 0,08s de TTFT mis en cache, 100% d'appel d'outils. 17 analyseurs d'outils, cache de prompt, séparation du raisonnement, routage cloud. Remplacement direct d'OpenAI. Fonctionne avec Claude Code, Cursor, Aider.

    3 647+81Évolution des étoiles sur les 7 derniers jours
  • surf@deta

    Carnets de notes IA personnels. Organisez vos fichiers et pages web pour générer des notes. Open source, données locales et ouvertes, choix de modèles ouvert (y compris local).

    3 554+10Évolution des étoiles sur les 7 derniers jours
  • claude-code-local@nicedreamzapp

    Exécutez Claude Code à 100 % sur l'appareil avec une IA locale sur Apple Silicon. Serveur Anthropic-API natif MLX. Inclut 6 modèles dont Muse-Glimmer 30B (désormais multimodal, lit les images, abliterated), Gemma 4 31B, Qwen 3.5 122B (65 tok/s), DeepSeek V4 Flash (1M ctx). Privé, hors ligne, prêt pour les environnements isolés. Conçu pour les flux de travail juridiques, de santé ou sous NDA.

    3 255+12Évolution des étoiles sur les 7 derniers jours
  • algernon@xyproto

    Petit serveur web autonome en pur Go avec support pour Lua, Teal, Markdown, HTTP/2, QUIC, Redis, TypeScript, React 19 sans npm, SQLite et PostgreSQL.

    3 028+1Évolution des étoiles sur les 7 derniers jours
  • Une liste organisée de plateformes, outils, pratiques et ressources pour exécuter des LLM localement

    2 823+23Évolution des étoiles sur les 7 derniers jours
  • little-coder@itayinbarr

    Un harnais optimisé pour les LLM plus petits.

    2 528+16Évolution des étoiles sur les 7 derniers jours
  • atomic-agent@AtomicBot-ai

    Agent IA local. Optimisé pour les modèles d'IA locaux. Longue fenêtre de contexte. Appels d'outils appropriés. Fonctionne de manière privée sur votre appareil.

    2 452+0Évolution des étoiles sur les 7 derniers jours
  • Traduisez des livres et documents complets avec Ollama, OpenAI (compatible), Gemini, Mistral, Poe ou OpenRouter. Préserve le formatage. Reprend là où vous vous étiez arrêté. Aucune limite de taille de fichier.

    2 368+31Évolution des étoiles sur les 7 derniers jours
  • openai-edge-tts@travisvn

    Point de terminaison d'API de synthèse vocale gratuit et de haute qualité pour remplacer OpenAI, Azure ou ElevenLabs.

    2 075+5Évolution des étoiles sur les 7 derniers jours
  • parlor@fikrikarim

    IA multimodale en temps réel sur appareil, avec des fonctionnalités similaires à GPT-Live

    2 048+7Évolution des étoiles sur les 7 derniers jours
  • vllm-mlx@waybarrios

    Serveur d'inférence LLM haute performance compatible OpenAI et Anthropic pour Apple Silicon. Support natif MLX, traitement par lots continu, modèles multimodaux, appel d'outils MCP et support de Claude Code.

    1 557+6Évolution des étoiles sur les 7 derniers jours
  • row-bot@siddsachar

    Row-Bot - Souveraineté IA personnelle. Un assistant IA local avec outils intégrés, graphe de connaissances personnel, voix, vision, shell, automatisation de navigateur, tâches planifiées, suivi de santé et canaux de messagerie. Exécution locale via Ollama ou modèles cloud optionnels. Vos données restent sur votre machine.

    1 480+11Évolution des étoiles sur les 7 derniers jours
  • Atomic-Chat@AtomicBot-ai

    Application d'IA locale et moteur d'inférence pour agents. Exécutez des LLM à poids ouverts localement — privé, 100 % hors ligne sur votre ordinateur.

    1 413+20Évolution des étoiles sur les 7 derniers jours
  • mlx-tune@ARahim3

    Fine-tuning de LLM sur Mac avec Apple Silicon. Support natif MLX pour SFT, DPO, GRPO, Vision, TTS, STT, Embedding et OCR. API compatible avec Unsloth.

    1 398+8Évolution des étoiles sur les 7 derniers jours
  • locally-uncensored@PurpleDoubleD

    Studio d'IA local prêt à l'emploi : chat non censuré, génération d'images et de vidéos, agent de codage. Exécute des LLM abliterated et ComfyUI 100 % hors ligne. Un seul installateur, sans Docker ni cloud.

    1 351+185Évolution des étoiles sur les 7 derniers jours
  • Soul-of-Waifu@jofizcd

    Donnez une âme à vos personnages préférés. Soul of Waifu est une application de jeu de rôle et de compagnon IA pour bureau, intégrant des avatars Live2D/VRM, un chat vocal et un LLM local. Évoluez ensemble à travers des discussions immersives, des aventures RPG et votre bureau.

    1 281+15Évolution des étoiles sur les 7 derniers jours
  • ouroboros@razzant

    Ouroboros — agent IA auto-créateur. Né le 16 février 2026.

    1 254+18Évolution des étoiles sur les 7 derniers jours
  • gawkbot@najmuzzaman-mohammad

    WUPHF vous permet de créer votre bureau personnel d'équipiers IA collaborant via un contexte partagé. Supporte Claude Code, Codex, OpenClaw, OpenCode et les LLM locaux.

    1 253+6Évolution des étoiles sur les 7 derniers jours
  • Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks

    1 200+316Évolution des étoiles sur les 7 derniers jours
  • web-search-mcp@mrkrsl

    Un serveur MCP de recherche Web simple, hébergé localement, pour une utilisation avec des LLM locaux

    1 122+8Évolution des étoiles sur les 7 derniers jours
  • synthadoc@axoviq-ai

    Synthadoc : un moteur de compilation de connaissances LLM open-source qui transforme des documents bruts en wikis structurés et locaux. Une alternative transparente et lisible par l'humain au RAG traditionnel, auto-hébergée et auto-améliorée sans outils tiers.

    1 116+2Évolution des étoiles sur les 7 derniers jours
  • mlx-serve@ddalcu

    Serveur d'inférence LLM natif pour Apple Silicon. Compatible avec les API OpenAI et Anthropic. Sans Python. Inclut l'application macOS MLX Core avec chat, mode agent et appel d'outils.

    1 115+245Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets