llama-cpp
Dépôts open source suivis étiquetés llama-cpp, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de llama-cpp sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés llama-cpp.
- #1
Moniteur système sans sudo pour Apple Silicon (interface SwiftUI native) avec suivi de l'ANE, du Media Engine et de la bande passante mémoire
★ 901 - #2
Traducteur d'écran Android en temps réel open-source sans root, idéal pour les jeux, visual novels et mangas. Prend en charge l'OCR sur l'appareil et dans le cloud, les LLM hors ligne, divers services de traduction et la synthèse vocale (TTS), avec affichage direct des traductions à l'écran.
★ 697 - #3
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 513 - #4
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 494
- #1★ 25 746+78Évolution des étoiles sur les 7 derniers jours
- #2
L'application de dictée macOS la plus rapide et la seule avec STT sur l'appareil et un modèle d'amélioration IA personnalisé. Pré-build Windows disponible ! Une alternative locale à Wispr Flow. Envoyez-nous un DM sur X pour un easter egg 😉 - https://x.com/fluidvoiceapp
★ 11 060+273Évolution des étoiles sur les 7 derniers jours - #3
Un chatbot de type ChatGPT auto-hébergé et hors ligne. Propulsé par Llama 2. 100 % privé, aucune donnée ne quitte votre appareil. Nouveauté : support de Code Llama !
★ 10 938-1Évolution des étoiles sur les 7 derniers jours - #4
Remplacez GPT par n'importe quel LLM en changeant une seule ligne de code. Xinference vous permet d'exécuter des modèles open source, vocaux et multimodaux sur le cloud, en local ou sur votre ordinateur portable, le tout via une API d'inférence unifiée et prête pour la production.
★ 9 528+21Évolution des étoiles sur les 7 derniers jours - #5
Modèle open source SenseVoiceSmall pour la reconnaissance vocale (ASR) en mandarin, cantonais, anglais, japonais et coréen, incluant l'identification de la langue, la reconnaissance des émotions et la détection d'événements audio.
★ 9 172+51Évolution des étoiles sur les 7 derniers jours - #6
Transformez votre PC, Mac ou machine Linux en serveur d'IA. Inférence LLM, interface de chat, voix, agents, workflows, RAG et génération d'images.
★ 4 823+197Évolution des étoiles sur les 7 derniers jours - #7
Une bibliothèque C#/.NET pour exécuter efficacement des LLM (🦙LLaMA/LLaVA) sur votre appareil local.
★ 3 788+2Évolution des étoiles sur les 7 derniers jours - #8
Plateforme open source de compétences pour caméra IA, NVR et surveillance CCTV. Analyse vidéo locale par VLM (Qwen, DeepSeek, SmolVLM, LLaVA, YOLO26). Agent de sécurité intelligent avec intégration Telegram, Discord ou Slack. Fonctionne sur Mac Mini et PC IA.
★ 3 024+18Évolution des étoiles sur les 7 derniers jours - #9
Le couteau suisse de l'IA hors ligne. Discutez, voyez, parlez et générez des images sur votre téléphone ou Mac — LLM GGUF, vision, reconnaissance vocale Whisper, Stable Diffusion, appel d'outils et serveurs réseau locaux. Fonctionne sur votre CPU, GPU ou NPU. Aucun compte, aucune clé API, aucune donnée ne quitte votre appareil.
★ 3 021+54Évolution des étoiles sur les 7 derniers jours - #10★ 2 813+35Évolution des étoiles sur les 7 derniers jours
- #11
Maid est une application libre et open source permettant d'interfacer localement des modèles llama.cpp, et à distance des modèles Anthropic, DeepSeek, Ollama, Mistral et OpenAI.
★ 2 655+18Évolution des étoiles sur les 7 derniers jours - #12
Agent IA local. Optimisé pour les modèles d'IA locaux. Longue fenêtre de contexte. Appels d'outils appropriés. Fonctionne de manière privée sur votre appareil.
★ 2 425-9Évolution des étoiles sur les 7 derniers jours - #13
Framework Python pour l'appel d'outils par LLM auto-hébergés et les flux de travail multi-étapes pour agents.
★ 2 229+6Évolution des étoiles sur les 7 derniers jours - #14
Exécutez des modèles d'IA localement sur votre machine avec des liaisons node.js pour llama.cpp. Appliquez un schéma JSON sur la sortie du modèle au niveau de la génération.
★ 2 167+5Évolution des étoiles sur les 7 derniers jours - #15★ 1 702+1Évolution des étoiles sur les 7 derniers jours
- #16
Interagissez avec votre Mac et interrogez vos documents sans cloud. IA vocale locale et RAG sur appareil.
★ 1 542-1Évolution des étoiles sur les 7 derniers jours - #17
Famille de modèles ASR open-source basés sur LLM pour le chinois, les dialectes, les accents et la parole multilingue, avec runtimes FunASR, vLLM, streaming et llama.cpp.
★ 1 503+16Évolution des étoiles sur les 7 derniers jours - #18
Un foyer confortable pour vos LLM.
★ 1 477+11Évolution des étoiles sur les 7 derniers jours - #19★ 1 398+1Évolution des étoiles sur les 7 derniers jours
- #20★ 1 028+4Évolution des étoiles sur les 7 derniers jours
- #21
Construisez et exécutez des agents IA avec Docker Compose. Une collection d'exemples prêts à l'emploi pour orchestrer des LLM open-source, des outils et des environnements d'exécution d'agents.
★ 1 027+1Évolution des étoiles sur les 7 derniers jours - #22
Cotabby est un outil d'autocomplétion IA local pour macOS. Open source, exécuté sur l'appareil, disponible partout où vous tapez.
★ 980+18Évolution des étoiles sur les 7 derniers jours - #23
Moniteur système sans sudo pour Apple Silicon (interface SwiftUI native) avec suivi de l'ANE, du Media Engine et de la bande passante mémoire
★ 901+57Évolution des étoiles sur les 7 derniers jours - #24
Traducteur d'écran Android en temps réel open-source sans root, idéal pour les jeux, visual novels et mangas. Prend en charge l'OCR sur l'appareil et dans le cloud, les LLM hors ligne, divers services de traduction et la synthèse vocale (TTS), avec affichage direct des traductions à l'écran.
★ 697+67Évolution des étoiles sur les 7 derniers jours - #25★ 681—Évolution des étoiles sur les 7 derniers jours
- #26
Entretien auto-évalué pour les codeurs IA
★ 598+0Évolution des étoiles sur les 7 derniers jours - #27
Nœuds ComfyUI pour les modèles vision-langage : Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Inclut également la détection à vocabulaire ouvert, la segmentation SAM2/SAM3, le raisonnement temporel vidéo, GGUF via llama.cpp et des API LLM/VLM hébergées.
★ 589+4Évolution des étoiles sur les 7 derniers jours - #28
GraphRAG-rs est une implémentation Rust haute performance et de pointe de GraphRAG (Graph-based Retrieval Augmented Generation) qui construit des graphes de connaissances à partir de documents et permet des requêtes en langage naturel avec une extraction d'entités configurable et l'intégration de LLM locaux
★ 525-1Évolution des étoiles sur les 7 derniers jours - #29
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 513—Évolution des étoiles sur les 7 derniers jours