Aller au contenu principal
buildradar
Sign in
Sujet · gguf

gguf

Dépôts open source suivis étiquetés gguf, triés par étoiles.

Dépôts
29
Total d'étoiles
106 447
Étoiles en moyenne
3 671
Part
0,01%

Sujets qui apparaissent souvent aux côtés de gguf sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés gguf.

  • Traducteur d'écran Android en temps réel open-source sans root, idéal pour les jeux, visual novels et mangas. Prend en charge l'OCR sur l'appareil et dans le cloud, les LLM hors ligne, divers services de traduction et la synthèse vocale (TTS), avec affichage direct des traductions à l'écran.

    786
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    548
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501
  • llmfit@AlexsJones

    Des centaines de modèles et de fournisseurs. Une seule commande pour trouver ce qui fonctionne sur votre matériel.

    34 759+265Évolution des étoiles sur les 7 derniers jours
  • llamafile@mozilla-ai

    Distribuez et exécutez des LLM avec un seul fichier.

    25 859+113Évolution des étoiles sur les 7 derniers jours
  • shimmy@Michael-A-Kuykendall

    ⚡ Moteur d'inférence WebGPU en pur Rust — compatible avec l'API OpenAI, natif GGUF, fonctionne sur n'importe quel GPU. Pas de Python. Pas de llama.cpp. Binaire unique.

    5 816+6Évolution des étoiles sur les 7 derniers jours
  • Soup@MakazhanAlpamys

    Fine-tuning de LLM à partir d'un seul fichier YAML. Le streaming de couches permet d'entraîner un modèle 8B sur un GPU d'ordinateur portable de 4 Go.

    4 929+1 365Évolution des étoiles sur les 7 derniers jours
  • OGAM@off-grid-ai

    Le couteau suisse de l'IA hors ligne. Discutez, voyez, parlez et générez des images sur votre téléphone ou Mac — LLM GGUF, vision, reconnaissance vocale Whisper, Stable Diffusion, appel d'outils et serveurs réseau locaux. Fonctionne sur votre CPU, GPU ou NPU. Aucun compte, aucune clé API, aucune donnée ne quitte votre appareil.

    3 038+17Évolution des étoiles sur les 7 derniers jours
  • maid@Mobile-Artificial-Intelligence

    Maid est une application libre et open source permettant d'interfacer localement des modèles llama.cpp, et à distance des modèles Anthropic, DeepSeek, Ollama, Mistral et OpenAI.

    2 656+1Évolution des étoiles sur les 7 derniers jours
  • handy-ollama@datawhalechina

    Apprendre à utiliser Ollama, déployer des grands modèles sur CPU, lecture en ligne : https://datawhalechina.github.io/handy-ollama/

    2 516+3Évolution des étoiles sur les 7 derniers jours
  • atomic-agent@AtomicBot-ai

    Agent IA local. Optimisé pour les modèles d'IA locaux. Longue fenêtre de contexte. Appels d'outils appropriés. Fonctionne de manière privée sur votre appareil.

    2 452+0Évolution des étoiles sur les 7 derniers jours
  • comfyui_LLM_party@heshengtao

    Framework d'agent LLM dans ComfyUI incluant des nœuds pour serveur MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 et FLUX, accès à Feishu, discord, et compatible avec tous les LLM utilisant des interfaces similaires à openai / aisuite, tels que o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi, doubao. Adapté aux LLM locaux, VLM et GGUF tels que llama-3.3, Janus-Pro et Linkage graphRAG.

    2 348+5Évolution des étoiles sur les 7 derniers jours
  • node-llama-cpp@withcatai

    Exécutez des modèles d'IA localement sur votre machine avec des liaisons node.js pour llama.cpp. Appliquez un schéma JSON sur la sortie du modèle au niveau de la génération.

    2 170+4Évolution des étoiles sur les 7 derniers jours
  • transcribe.cpp@handy-computer

    Inférence speech-to-text ggml pour plus de 16 familles de modèles

    1 872+19Évolution des étoiles sur les 7 derniers jours
  • gollama@sammcj

    Gérez vos modèles Ollama avec Go

    1 835-1Évolution des étoiles sur les 7 derniers jours
  • auto-round@intel

    Un algorithme de quantification SOTA pour l'inférence LLM basse précision haute précision, optimisé pour CPU/XPU/CUDA, avec support multi-type et compatibilité totale avec vLLM, SGLang et Transformers.

    1 599+8Évolution des étoiles sur les 7 derniers jours
  • Fun-ASR@QwenAudio

    Famille de modèles ASR open-source basés sur LLM pour le chinois, les dialectes, les accents et la parole multilingue, avec runtimes FunASR, vLLM, streaming et llama.cpp.

    1 512+10Évolution des étoiles sur les 7 derniers jours
  • OuteTTS@edwko

    Interface pour les modèles OuteTTS.

    1 437+0Évolution des étoiles sur les 7 derniers jours
  • Atomic-Chat@AtomicBot-ai

    Application d'IA locale et moteur d'inférence pour agents. Exécutez des LLM à poids ouverts localement — privé, 100 % hors ligne sur votre ordinateur.

    1 413+20Évolution des étoiles sur les 7 derniers jours
  • kitops@kitops-ml

    Un outil DevOps open source de la CNCF pour empaqueter et versionner des modèles IA/ML, des jeux de données, du code et des configurations sous forme d'artefact OCI.

    1 409+0Évolution des étoiles sur les 7 derniers jours
  • locally-uncensored@PurpleDoubleD

    Studio d'IA local prêt à l'emploi : chat non censuré, génération d'images et de vidéos, agent de codage. Exécute des LLM abliterated et ComfyUI 100 % hors ligne. Un seul installateur, sans Docker ni cloud.

    1 351+185Évolution des étoiles sur les 7 derniers jours
  • mlx-serve@ddalcu

    Serveur d'inférence LLM natif pour Apple Silicon. Compatible avec les API OpenAI et Anthropic. Sans Python. Inclut l'application macOS MLX Core avec chat, mode agent et appel d'outils.

    1 115+245Évolution des étoiles sur les 7 derniers jours
  • hf-mem@alvarobartt

    Un outil en ligne de commande écrit en Python pour estimer les besoins en mémoire d'inférence des modèles Hugging Face.

    939+0Évolution des étoiles sur les 7 derniers jours
  • LLM.swift@eastriverlee

    LLM.swift est une bibliothèque simple et lisible permettant d'interagir facilement avec des modèles de langage locaux sur macOS, iOS, watchOS, tvOS et visionOS.

    874+3Évolution des étoiles sur les 7 derniers jours
  • llama3.java@mukel

    Inférence Llama 3+ en Java pur

    816+0Évolution des étoiles sur les 7 derniers jours
  • Box@jegly

    La suite d'IA côté client la plus avancée et entièrement hors ligne disponible aujourd'hui sur Android.

    812+15Évolution des étoiles sur les 7 derniers jours
  • Traducteur d'écran Android en temps réel open-source sans root, idéal pour les jeux, visual novels et mangas. Prend en charge l'OCR sur l'appareil et dans le cloud, les LLM hors ligne, divers services de traduction et la synthèse vocale (TTS), avec affichage direct des traductions à l'écran.

    786+82Évolution des étoiles sur les 7 derniers jours
  • yzma@hybridgroup

    Go avec votre propre intelligence - Applications Go qui intègrent directement llama.cpp pour l'inférence locale avec accélération matérielle.

    594+16Évolution des étoiles sur les 7 derniers jours
  • ComfyUI_VLM_nodes@gokayfem

    Nœuds ComfyUI pour les modèles vision-langage : Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Inclut également la détection à vocabulaire ouvert, la segmentation SAM2/SAM3, le raisonnement temporel vidéo, GGUF via llama.cpp et des API LLM/VLM hébergées.

    588-1Évolution des étoiles sur les 7 derniers jours
  • search@kelindar

    Bibliothèque Go pour la recherche vectorielle intégrée et les plongements sémantiques utilisant llama.cpp

    559+0Évolution des étoiles sur les 7 derniers jours
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    548Évolution des étoiles sur les 7 derniers jours
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501+7Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets