gguf
Dépôts open source suivis étiquetés gguf, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de gguf sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés gguf.
- #1
Traducteur d'écran Android en temps réel open-source sans root, idéal pour les jeux, visual novels et mangas. Prend en charge l'OCR sur l'appareil et dans le cloud, les LLM hors ligne, divers services de traduction et la synthèse vocale (TTS), avec affichage direct des traductions à l'écran.
★ 786 - #2
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 548 - #3
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501
- #1
Des centaines de modèles et de fournisseurs. Une seule commande pour trouver ce qui fonctionne sur votre matériel.
★ 34 759+265Évolution des étoiles sur les 7 derniers jours - #2★ 25 859+113Évolution des étoiles sur les 7 derniers jours
- #3
⚡ Moteur d'inférence WebGPU en pur Rust — compatible avec l'API OpenAI, natif GGUF, fonctionne sur n'importe quel GPU. Pas de Python. Pas de llama.cpp. Binaire unique.
★ 5 816+6Évolution des étoiles sur les 7 derniers jours - #4
Fine-tuning de LLM à partir d'un seul fichier YAML. Le streaming de couches permet d'entraîner un modèle 8B sur un GPU d'ordinateur portable de 4 Go.
★ 4 929+1 365Évolution des étoiles sur les 7 derniers jours - #5
Le couteau suisse de l'IA hors ligne. Discutez, voyez, parlez et générez des images sur votre téléphone ou Mac — LLM GGUF, vision, reconnaissance vocale Whisper, Stable Diffusion, appel d'outils et serveurs réseau locaux. Fonctionne sur votre CPU, GPU ou NPU. Aucun compte, aucune clé API, aucune donnée ne quitte votre appareil.
★ 3 038+17Évolution des étoiles sur les 7 derniers jours - #6
Maid est une application libre et open source permettant d'interfacer localement des modèles llama.cpp, et à distance des modèles Anthropic, DeepSeek, Ollama, Mistral et OpenAI.
★ 2 656+1Évolution des étoiles sur les 7 derniers jours - #7
Apprendre à utiliser Ollama, déployer des grands modèles sur CPU, lecture en ligne : https://datawhalechina.github.io/handy-ollama/
★ 2 516+3Évolution des étoiles sur les 7 derniers jours - #8
Agent IA local. Optimisé pour les modèles d'IA locaux. Longue fenêtre de contexte. Appels d'outils appropriés. Fonctionne de manière privée sur votre appareil.
★ 2 452+0Évolution des étoiles sur les 7 derniers jours - #9
Framework d'agent LLM dans ComfyUI incluant des nœuds pour serveur MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 et FLUX, accès à Feishu, discord, et compatible avec tous les LLM utilisant des interfaces similaires à openai / aisuite, tels que o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi, doubao. Adapté aux LLM locaux, VLM et GGUF tels que llama-3.3, Janus-Pro et Linkage graphRAG.
★ 2 348+5Évolution des étoiles sur les 7 derniers jours - #10
Exécutez des modèles d'IA localement sur votre machine avec des liaisons node.js pour llama.cpp. Appliquez un schéma JSON sur la sortie du modèle au niveau de la génération.
★ 2 170+4Évolution des étoiles sur les 7 derniers jours - #11
Inférence speech-to-text ggml pour plus de 16 familles de modèles
★ 1 872+19Évolution des étoiles sur les 7 derniers jours - #12★ 1 835-1Évolution des étoiles sur les 7 derniers jours
- #13
Un algorithme de quantification SOTA pour l'inférence LLM basse précision haute précision, optimisé pour CPU/XPU/CUDA, avec support multi-type et compatibilité totale avec vLLM, SGLang et Transformers.
★ 1 599+8Évolution des étoiles sur les 7 derniers jours - #14
Famille de modèles ASR open-source basés sur LLM pour le chinois, les dialectes, les accents et la parole multilingue, avec runtimes FunASR, vLLM, streaming et llama.cpp.
★ 1 512+10Évolution des étoiles sur les 7 derniers jours - #15★ 1 437+0Évolution des étoiles sur les 7 derniers jours
- #16
Application d'IA locale et moteur d'inférence pour agents. Exécutez des LLM à poids ouverts localement — privé, 100 % hors ligne sur votre ordinateur.
★ 1 413+20Évolution des étoiles sur les 7 derniers jours - #17
Un outil DevOps open source de la CNCF pour empaqueter et versionner des modèles IA/ML, des jeux de données, du code et des configurations sous forme d'artefact OCI.
★ 1 409+0Évolution des étoiles sur les 7 derniers jours - #18
Studio d'IA local prêt à l'emploi : chat non censuré, génération d'images et de vidéos, agent de codage. Exécute des LLM abliterated et ComfyUI 100 % hors ligne. Un seul installateur, sans Docker ni cloud.
★ 1 351+185Évolution des étoiles sur les 7 derniers jours - #19
Serveur d'inférence LLM natif pour Apple Silicon. Compatible avec les API OpenAI et Anthropic. Sans Python. Inclut l'application macOS MLX Core avec chat, mode agent et appel d'outils.
★ 1 115+245Évolution des étoiles sur les 7 derniers jours - #20
Un outil en ligne de commande écrit en Python pour estimer les besoins en mémoire d'inférence des modèles Hugging Face.
★ 939+0Évolution des étoiles sur les 7 derniers jours - #21
LLM.swift est une bibliothèque simple et lisible permettant d'interagir facilement avec des modèles de langage locaux sur macOS, iOS, watchOS, tvOS et visionOS.
★ 874+3Évolution des étoiles sur les 7 derniers jours - #22
Inférence Llama 3+ en Java pur
★ 816+0Évolution des étoiles sur les 7 derniers jours - #23
La suite d'IA côté client la plus avancée et entièrement hors ligne disponible aujourd'hui sur Android.
★ 812+15Évolution des étoiles sur les 7 derniers jours - #24
Traducteur d'écran Android en temps réel open-source sans root, idéal pour les jeux, visual novels et mangas. Prend en charge l'OCR sur l'appareil et dans le cloud, les LLM hors ligne, divers services de traduction et la synthèse vocale (TTS), avec affichage direct des traductions à l'écran.
★ 786+82Évolution des étoiles sur les 7 derniers jours - #25
Go avec votre propre intelligence - Applications Go qui intègrent directement llama.cpp pour l'inférence locale avec accélération matérielle.
★ 594+16Évolution des étoiles sur les 7 derniers jours - #26
Nœuds ComfyUI pour les modèles vision-langage : Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Inclut également la détection à vocabulaire ouvert, la segmentation SAM2/SAM3, le raisonnement temporel vidéo, GGUF via llama.cpp et des API LLM/VLM hébergées.
★ 588-1Évolution des étoiles sur les 7 derniers jours - #27
Bibliothèque Go pour la recherche vectorielle intégrée et les plongements sémantiques utilisant llama.cpp
★ 559+0Évolution des étoiles sur les 7 derniers jours - #28
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 548—Évolution des étoiles sur les 7 derniers jours - #29
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501+7Évolution des étoiles sur les 7 derniers jours