Pular para o conteúdo principal
buildradar
Sign in
Tópico · gguf

gguf

Repositórios de código aberto acompanhados marcados com gguf, ordenados por estrelas.

Repositórios
29
Total de estrelas
106.447
Média de estrelas
3.671
Participação
0,01%

Tópicos que aparecem com frequência ao lado de gguf no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com gguf.

  • Ferramenta de tradução de tela em tempo real para Android de código aberto e sem root, ideal para jogos, romances visuais e mangás. Suporta OCR local e em nuvem, LLMs offline, vários serviços de tradução e conversão de texto em fala (TTS), com traduções exibidas diretamente na tela.

    768
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    543
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501
  • llmfit@AlexsJones

    Centenas de modelos e provedores. Um único comando para descobrir o que roda no seu hardware.

    34.759+265Variação de estrelas nos últimos 7 dias
  • llamafile@mozilla-ai

    Distribua e execute LLMs com um único arquivo.

    25.859+113Variação de estrelas nos últimos 7 dias
  • shimmy@Michael-A-Kuykendall

    ⚡ Mecanismo de inferência WebGPU em Rust puro — compatível com a API da OpenAI, nativo em GGUF, roda em qualquer GPU. Sem Python. Sem llama.cpp. Binário único.

    5.816+6Variação de estrelas nos últimos 7 dias
  • Soup@MakazhanAlpamys

    Ajuste fino de LLMs a partir de um único YAML. O streaming de camadas treina um modelo de 8B em uma GPU de laptop de 4 GB.

    4.929+1.365Variação de estrelas nos últimos 7 dias
  • OGAM@off-grid-ai

    O canivete suíço da IA offline. Converse, veja, fale e gere imagens no seu celular ou Mac — LLMs GGUF, visão, transcrição de fala Whisper, Stable Diffusion, chamadas de ferramentas e servidores de rede local. Executa na sua CPU, GPU ou NPU. Sem conta, sem chave de API, nenhum dado sai do seu dispositivo.

    3.038+17Variação de estrelas nos últimos 7 dias
  • maid@Mobile-Artificial-Intelligence

    Maid é um aplicativo gratuito e de código aberto para interagir com modelos llama.cpp localmente, e com modelos Anthropic, DeepSeek, Ollama, Mistral e OpenAI remotamente.

    2.656+1Variação de estrelas nos últimos 7 dias
  • handy-ollama@datawhalechina

    Aprenda a usar o Ollama, execute a implantação de grandes modelos de linguagem (LLMs) via CPU. Leitura online: https://datawhalechina.github.io/handy-ollama/

    2.516+3Variação de estrelas nos últimos 7 dias
  • atomic-agent@AtomicBot-ai

    Agente de IA Local-First. Otimizado para modelos de IA locais. Janela de contexto longa. Chamadas de ferramentas adequadas. Executa privadamente no seu dispositivo.

    2.452+0Variação de estrelas nos últimos 7 dias
  • comfyui_LLM_party@heshengtao

    Framework de agentes LLM no ComfyUI, incluindo servidor MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 e nós de prompt FLUX, com acesso a Feishu e Discord, adaptando-se a todos os LLMs com interfaces similares à da OpenAI/aisuite, como o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi e doubao. Adaptado para LLMs locais, VLM e GGUF, como llama-3.3, Janus-Pro e Linkage graphRAG.

    2.348+5Variação de estrelas nos últimos 7 dias
  • node-llama-cpp@withcatai

    Execute modelos de IA localmente em sua máquina com bindings de Node.js para llama.cpp. Aplique um esquema JSON na saída do modelo no nível de geração.

    2.170+4Variação de estrelas nos últimos 7 dias
  • transcribe.cpp@handy-computer

    Inferência de fala para texto ggml para mais de 16 famílias de modelos

    1.872+19Variação de estrelas nos últimos 7 dias
  • gollama@sammcj

    Gerencie seus modelos Ollama

    1.835-1Variação de estrelas nos últimos 7 dias
  • auto-round@intel

    Um algoritmo de quantização SOTA para inferência de LLM de baixo bit e alta precisão, otimizado para CPU/XPU/CUDA, com suporte a múltiplos tipos de dados e compatibilidade total com vLLM, SGLang e Transformers.

    1.599+8Variação de estrelas nos últimos 7 dias
  • Fun-ASR@QwenAudio

    Família de modelos ASR de código aberto baseados em LLM para chinês, dialetos, sotaques e fala multilíngue, com runtimes FunASR, vLLM, streaming e llama.cpp.

    1.512+10Variação de estrelas nos últimos 7 dias
  • OuteTTS@edwko

    Interface para modelos OuteTTS.

    1.437+0Variação de estrelas nos últimos 7 dias
  • Atomic-Chat@AtomicBot-ai

    Aplicativo de IA local e motor de inferência para agentes. Execute LLMs de pesos abertos localmente — privado, 100% offline no seu computador. Entre no nosso Discord: https://discord.com/invite/8wGSsvmg4V

    1.413+20Variação de estrelas nos últimos 7 dias
  • kitops@kitops-ml

    Uma ferramenta DevOps de código aberto da CNCF para empacotar e versionar modelos de IA/ML, conjuntos de dados, código e configurações em um OCI Artifact.

    1.409+0Variação de estrelas nos últimos 7 dias
  • locally-uncensored@PurpleDoubleD

    Estúdio de IA local plug-and-play: chat sem censura, geração de imagens e vídeos, agente de código. Executa LLMs deslimitados + ComfyUI 100% offline. Um instalador, sem Docker, sem nuvem.

    1.351+185Variação de estrelas nos últimos 7 dias
  • mlx-serve@ddalcu

    Servidor de inferência LLM nativo para Apple Silicon. Compatível com a API da OpenAI e Anthropic. Sem Python. Inclui o aplicativo MLX Core para macOS com chat, modo agente e chamada de ferramentas.

    1.115+245Variação de estrelas nos últimos 7 dias
  • hf-mem@alvarobartt

    Uma CLI para estimar os requisitos de memória de inferência para modelos do Hugging Face, escrita em Python.

    939+0Variação de estrelas nos últimos 7 dias
  • LLM.swift@eastriverlee

    LLM.swift é uma biblioteca simples e legível que permite interagir facilmente com grandes modelos de linguagem localmente em macOS, iOS, watchOS, tvOS e visionOS.

    874+3Variação de estrelas nos últimos 7 dias
  • llama3.java@mukel

    Inferência do Llama 3+ em puro Java

    816+0Variação de estrelas nos últimos 7 dias
  • Box@jegly

    A suíte de IA client-side mais avançada e totalmente offline no Android atualmente.

    803+15Variação de estrelas nos últimos 7 dias
  • Ferramenta de tradução de tela em tempo real para Android de código aberto e sem root, ideal para jogos, romances visuais e mangás. Suporta OCR local e em nuvem, LLMs offline, vários serviços de tradução e conversão de texto em fala (TTS), com traduções exibidas diretamente na tela.

    768+71Variação de estrelas nos últimos 7 dias
  • yzma@hybridgroup

    Vá com sua própria inteligência - Aplicativos Go que integram diretamente o llama.cpp para inferência local usando aceleração de hardware.

    589+14Variação de estrelas nos últimos 7 dias
  • ComfyUI_VLM_nodes@gokayfem

    Nós do ComfyUI para modelos de visão-linguagem: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Inclui detecção de vocabulário aberto, segmentação SAM2/SAM3, raciocínio temporal de vídeo, GGUF via llama.cpp e APIs de LLM/VLM hospedadas.

    588-1Variação de estrelas nos últimos 7 dias
  • search@kelindar

    Biblioteca Go para busca vetorial incorporada e embeddings semânticos usando llama.cpp

    559+0Variação de estrelas nos últimos 7 dias
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    543Variação de estrelas nos últimos 7 dias
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501+7Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos