local-llm
Dépôts open source suivis étiquetés local-llm, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de local-llm sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés local-llm.
- #1
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1 200 - #2
Exécutez Kimi K3 complet sur un seul appareil. Inclut un serveur API compatible OpenAI pour le chat local et les agents de codage.
★ 799 - #3
Décodage LLM jusqu'à 4 fois plus rapide sur Apple Silicon, sans perte. Portage MLX natif du décodage spéculatif DSpark de DeepSeek et DFlash de z-lab — Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, Ornith-1.0, Bonsai-27B ternaire.
★ 640 - #4
Index organisé de projets open source de compagnons IA : mémoire à long terme, comportement proactif, voix, incarnation et activités partagées. 157 entrées classées par langage, plateforme et état de préparation.
★ 633 - #5
Swiftlet est un runtime Swift et Metal qui exécute localement de grands modèles Qwen Mixture-of-Experts sur les appareils Apple en diffusant les poids des experts depuis le stockage, permettant aux modèles 35B et 80B de fonctionner avec peu de RAM, y compris sur iPhone.
★ 628
- #1
Framework d'agent IA personnel ultra-léger, open source et auto-hébergé en Python avec interface Web, outils, mémoire, MCP, flux de travail multi-agents, automatisation et applications de chat
★ 47 662+140Évolution des étoiles sur les 7 derniers jours - #2★ 25 859+113Évolution des étoiles sur les 7 derniers jours
- #3
~95 % sur SimpleQA (par ex. Qwen3.6-27B sur une 3090). Prend en charge tous les LLM locaux et cloud (llama.cpp, Ollama, Google, ...). Plus de 10 moteurs de recherche - arXiv, PubMed, vos documents privés. Tout est local et chiffré.
★ 9 023+18Évolution des étoiles sur les 7 derniers jours - #4
Framework d'orchestration d'agents IA en TypeScript avec workflows dynamiques. Décrivez l'objectif plutôt que le graphe : un coordinateur planifie le DAG des tâches à l'exécution sur n'importe quel LLM (Claude, ChatGPT, Gemini, DeepSeek ou modèles locaux).
★ 6 860+20Évolution des étoiles sur les 7 derniers jours - #5
Plateforme IA vocale open source. Alternative auto-hébergée à Vapi et Retell. Déploiement sur site, BYOK pour Speech-to-Speech ou LLM/STT/TTS, avec un constructeur de workflow visuel, support natif MCP et téléphonie.
★ 5 568+45Évolution des étoiles sur les 7 derniers jours - #6
IA de santé locale : reconnaissance d'entités nommées cliniques et désidentification PII HIPAA fonctionnant à 100 % sur l'appareil. Plus de 2 200 modèles médicaux, 21 langues, Apple MLX + Python, sans cloud, aucune donnée patient ne quitte votre réseau. Apache-2.0
★ 5 199+20Évolution des étoiles sur les 7 derniers jours - #7
Fine-tuning de LLM à partir d'un seul fichier YAML. Le streaming de couches permet d'entraîner un modèle 8B sur un GPU d'ordinateur portable de 4 Go.
★ 4 929+1 365Évolution des étoiles sur les 7 derniers jours - #8★ 4 102+1Évolution des étoiles sur les 7 derniers jours
- #9
Le moteur d'IA local le plus rapide pour Apple Silicon. 4,2x plus rapide qu'Ollama, 0,08s de TTFT mis en cache, 100% d'appel d'outils. 17 analyseurs d'outils, cache de prompt, séparation du raisonnement, routage cloud. Remplacement direct d'OpenAI. Fonctionne avec Claude Code, Cursor, Aider.
★ 3 647+81Évolution des étoiles sur les 7 derniers jours - #10
Carnets de notes IA personnels. Organisez vos fichiers et pages web pour générer des notes. Open source, données locales et ouvertes, choix de modèles ouvert (y compris local).
★ 3 554+10Évolution des étoiles sur les 7 derniers jours - #11
Exécutez Claude Code à 100 % sur l'appareil avec une IA locale sur Apple Silicon. Serveur Anthropic-API natif MLX. Inclut 6 modèles dont Muse-Glimmer 30B (désormais multimodal, lit les images, abliterated), Gemma 4 31B, Qwen 3.5 122B (65 tok/s), DeepSeek V4 Flash (1M ctx). Privé, hors ligne, prêt pour les environnements isolés. Conçu pour les flux de travail juridiques, de santé ou sous NDA.
★ 3 255+12Évolution des étoiles sur les 7 derniers jours - #12
Petit serveur web autonome en pur Go avec support pour Lua, Teal, Markdown, HTTP/2, QUIC, Redis, TypeScript, React 19 sans npm, SQLite et PostgreSQL.
★ 3 028+1Évolution des étoiles sur les 7 derniers jours - #13
Une liste organisée de plateformes, outils, pratiques et ressources pour exécuter des LLM localement
★ 2 823+23Évolution des étoiles sur les 7 derniers jours - #14
Un harnais optimisé pour les LLM plus petits.
★ 2 528+16Évolution des étoiles sur les 7 derniers jours - #15
Agent IA local. Optimisé pour les modèles d'IA locaux. Longue fenêtre de contexte. Appels d'outils appropriés. Fonctionne de manière privée sur votre appareil.
★ 2 452+0Évolution des étoiles sur les 7 derniers jours - #16
Traduisez des livres et documents complets avec Ollama, OpenAI (compatible), Gemini, Mistral, Poe ou OpenRouter. Préserve le formatage. Reprend là où vous vous étiez arrêté. Aucune limite de taille de fichier.
★ 2 368+31Évolution des étoiles sur les 7 derniers jours - #17
Point de terminaison d'API de synthèse vocale gratuit et de haute qualité pour remplacer OpenAI, Azure ou ElevenLabs.
★ 2 075+5Évolution des étoiles sur les 7 derniers jours - #18
IA multimodale en temps réel sur appareil, avec des fonctionnalités similaires à GPT-Live
★ 2 048+7Évolution des étoiles sur les 7 derniers jours - #19
Serveur d'inférence LLM haute performance compatible OpenAI et Anthropic pour Apple Silicon. Support natif MLX, traitement par lots continu, modèles multimodaux, appel d'outils MCP et support de Claude Code.
★ 1 557+6Évolution des étoiles sur les 7 derniers jours - #20
Row-Bot - Souveraineté IA personnelle. Un assistant IA local avec outils intégrés, graphe de connaissances personnel, voix, vision, shell, automatisation de navigateur, tâches planifiées, suivi de santé et canaux de messagerie. Exécution locale via Ollama ou modèles cloud optionnels. Vos données restent sur votre machine.
★ 1 480+11Évolution des étoiles sur les 7 derniers jours - #21
Application d'IA locale et moteur d'inférence pour agents. Exécutez des LLM à poids ouverts localement — privé, 100 % hors ligne sur votre ordinateur.
★ 1 413+20Évolution des étoiles sur les 7 derniers jours - #22
Fine-tuning de LLM sur Mac avec Apple Silicon. Support natif MLX pour SFT, DPO, GRPO, Vision, TTS, STT, Embedding et OCR. API compatible avec Unsloth.
★ 1 398+8Évolution des étoiles sur les 7 derniers jours - #23
Studio d'IA local prêt à l'emploi : chat non censuré, génération d'images et de vidéos, agent de codage. Exécute des LLM abliterated et ComfyUI 100 % hors ligne. Un seul installateur, sans Docker ni cloud.
★ 1 351+185Évolution des étoiles sur les 7 derniers jours - #24
Donnez une âme à vos personnages préférés. Soul of Waifu est une application de jeu de rôle et de compagnon IA pour bureau, intégrant des avatars Live2D/VRM, un chat vocal et un LLM local. Évoluez ensemble à travers des discussions immersives, des aventures RPG et votre bureau.
★ 1 281+15Évolution des étoiles sur les 7 derniers jours - #25★ 1 254+18Évolution des étoiles sur les 7 derniers jours
- #26
WUPHF vous permet de créer votre bureau personnel d'équipiers IA collaborant via un contexte partagé. Supporte Claude Code, Codex, OpenClaw, OpenCode et les LLM locaux.
★ 1 253+6Évolution des étoiles sur les 7 derniers jours - #27
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1 200+316Évolution des étoiles sur les 7 derniers jours - #28
Un serveur MCP de recherche Web simple, hébergé localement, pour une utilisation avec des LLM locaux
★ 1 122+8Évolution des étoiles sur les 7 derniers jours - #29
Synthadoc : un moteur de compilation de connaissances LLM open-source qui transforme des documents bruts en wikis structurés et locaux. Une alternative transparente et lisible par l'humain au RAG traditionnel, auto-hébergée et auto-améliorée sans outils tiers.
★ 1 116+2Évolution des étoiles sur les 7 derniers jours - #30
Serveur d'inférence LLM natif pour Apple Silicon. Compatible avec les API OpenAI et Anthropic. Sans Python. Inclut l'application macOS MLX Core avec chat, mode agent et appel d'outils.
★ 1 115+245Évolution des étoiles sur les 7 derniers jours