gguf
Repositórios de código aberto acompanhados marcados com gguf, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de gguf no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com gguf.
- #1
Ferramenta de tradução de tela em tempo real para Android de código aberto e sem root, ideal para jogos, romances visuais e mangás. Suporta OCR local e em nuvem, LLMs offline, vários serviços de tradução e conversão de texto em fala (TTS), com traduções exibidas diretamente na tela.
★ 768 - #2
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543 - #3
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501
- #1
Centenas de modelos e provedores. Um único comando para descobrir o que roda no seu hardware.
★ 34.759+265Variação de estrelas nos últimos 7 dias - #2★ 25.859+113Variação de estrelas nos últimos 7 dias
- #3
⚡ Mecanismo de inferência WebGPU em Rust puro — compatível com a API da OpenAI, nativo em GGUF, roda em qualquer GPU. Sem Python. Sem llama.cpp. Binário único.
★ 5.816+6Variação de estrelas nos últimos 7 dias - #4
Ajuste fino de LLMs a partir de um único YAML. O streaming de camadas treina um modelo de 8B em uma GPU de laptop de 4 GB.
★ 4.929+1.365Variação de estrelas nos últimos 7 dias - #5
O canivete suíço da IA offline. Converse, veja, fale e gere imagens no seu celular ou Mac — LLMs GGUF, visão, transcrição de fala Whisper, Stable Diffusion, chamadas de ferramentas e servidores de rede local. Executa na sua CPU, GPU ou NPU. Sem conta, sem chave de API, nenhum dado sai do seu dispositivo.
★ 3.038+17Variação de estrelas nos últimos 7 dias - #6
Maid é um aplicativo gratuito e de código aberto para interagir com modelos llama.cpp localmente, e com modelos Anthropic, DeepSeek, Ollama, Mistral e OpenAI remotamente.
★ 2.656+1Variação de estrelas nos últimos 7 dias - #7
Aprenda a usar o Ollama, execute a implantação de grandes modelos de linguagem (LLMs) via CPU. Leitura online: https://datawhalechina.github.io/handy-ollama/
★ 2.516+3Variação de estrelas nos últimos 7 dias - #8
Agente de IA Local-First. Otimizado para modelos de IA locais. Janela de contexto longa. Chamadas de ferramentas adequadas. Executa privadamente no seu dispositivo.
★ 2.452+0Variação de estrelas nos últimos 7 dias - #9
Framework de agentes LLM no ComfyUI, incluindo servidor MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 e nós de prompt FLUX, com acesso a Feishu e Discord, adaptando-se a todos os LLMs com interfaces similares à da OpenAI/aisuite, como o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi e doubao. Adaptado para LLMs locais, VLM e GGUF, como llama-3.3, Janus-Pro e Linkage graphRAG.
★ 2.348+5Variação de estrelas nos últimos 7 dias - #10
Execute modelos de IA localmente em sua máquina com bindings de Node.js para llama.cpp. Aplique um esquema JSON na saída do modelo no nível de geração.
★ 2.170+4Variação de estrelas nos últimos 7 dias - #11
Inferência de fala para texto ggml para mais de 16 famílias de modelos
★ 1.872+19Variação de estrelas nos últimos 7 dias - #12★ 1.835-1Variação de estrelas nos últimos 7 dias
- #13
Um algoritmo de quantização SOTA para inferência de LLM de baixo bit e alta precisão, otimizado para CPU/XPU/CUDA, com suporte a múltiplos tipos de dados e compatibilidade total com vLLM, SGLang e Transformers.
★ 1.599+8Variação de estrelas nos últimos 7 dias - #14
Família de modelos ASR de código aberto baseados em LLM para chinês, dialetos, sotaques e fala multilíngue, com runtimes FunASR, vLLM, streaming e llama.cpp.
★ 1.512+10Variação de estrelas nos últimos 7 dias - #15★ 1.437+0Variação de estrelas nos últimos 7 dias
- #16
Aplicativo de IA local e motor de inferência para agentes. Execute LLMs de pesos abertos localmente — privado, 100% offline no seu computador. Entre no nosso Discord: https://discord.com/invite/8wGSsvmg4V
★ 1.413+20Variação de estrelas nos últimos 7 dias - #17
Uma ferramenta DevOps de código aberto da CNCF para empacotar e versionar modelos de IA/ML, conjuntos de dados, código e configurações em um OCI Artifact.
★ 1.409+0Variação de estrelas nos últimos 7 dias - #18
Estúdio de IA local plug-and-play: chat sem censura, geração de imagens e vídeos, agente de código. Executa LLMs deslimitados + ComfyUI 100% offline. Um instalador, sem Docker, sem nuvem.
★ 1.351+185Variação de estrelas nos últimos 7 dias - #19
Servidor de inferência LLM nativo para Apple Silicon. Compatível com a API da OpenAI e Anthropic. Sem Python. Inclui o aplicativo MLX Core para macOS com chat, modo agente e chamada de ferramentas.
★ 1.115+245Variação de estrelas nos últimos 7 dias - #20
Uma CLI para estimar os requisitos de memória de inferência para modelos do Hugging Face, escrita em Python.
★ 939+0Variação de estrelas nos últimos 7 dias - #21
LLM.swift é uma biblioteca simples e legível que permite interagir facilmente com grandes modelos de linguagem localmente em macOS, iOS, watchOS, tvOS e visionOS.
★ 874+3Variação de estrelas nos últimos 7 dias - #22
Inferência do Llama 3+ em puro Java
★ 816+0Variação de estrelas nos últimos 7 dias - #23★ 803+15Variação de estrelas nos últimos 7 dias
- #24
Ferramenta de tradução de tela em tempo real para Android de código aberto e sem root, ideal para jogos, romances visuais e mangás. Suporta OCR local e em nuvem, LLMs offline, vários serviços de tradução e conversão de texto em fala (TTS), com traduções exibidas diretamente na tela.
★ 768+71Variação de estrelas nos últimos 7 dias - #25
Vá com sua própria inteligência - Aplicativos Go que integram diretamente o llama.cpp para inferência local usando aceleração de hardware.
★ 589+14Variação de estrelas nos últimos 7 dias - #26
Nós do ComfyUI para modelos de visão-linguagem: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Inclui detecção de vocabulário aberto, segmentação SAM2/SAM3, raciocínio temporal de vídeo, GGUF via llama.cpp e APIs de LLM/VLM hospedadas.
★ 588-1Variação de estrelas nos últimos 7 dias - #27
Biblioteca Go para busca vetorial incorporada e embeddings semânticos usando llama.cpp
★ 559+0Variação de estrelas nos últimos 7 dias - #28
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543—Variação de estrelas nos últimos 7 dias - #29
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501+7Variação de estrelas nos últimos 7 dias