llama-cpp
Repositórios de código aberto acompanhados marcados com llama-cpp, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de llama-cpp no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com llama-cpp.
- #1
Monitor de sistema Apple Silicon sem necessidade de sudo (interface gráfica nativa em SwiftUI) com rastreamento de ANE / Media Engine / largura de banda de memória
★ 901 - #2
Ferramenta de tradução de tela em tempo real para Android de código aberto e sem root, ideal para jogos, romances visuais e mangás. Suporta OCR local e em nuvem, LLMs offline, vários serviços de tradução e conversão de texto em fala (TTS), com traduções exibidas diretamente na tela.
★ 697 - #3
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 513 - #4
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 494
- #1★ 25.746+78Variação de estrelas nos últimos 7 dias
- #2
O aplicativo de ditado para macOS mais rápido e único, com STT no dispositivo e modelo de aprimoramento de IA treinado personalizado. Versão pré-compilada para Windows disponível! Uma alternativa local ao Wispr Flow. Envie uma DM no X para um easter egg 😉 - https://x.com/fluidvoiceapp
★ 11.060+273Variação de estrelas nos últimos 7 dias - #3
Um chatbot estilo ChatGPT auto-hospedado e offline. Desenvolvido com Llama 2. 100% privado, sem que nenhum dado deixe o seu dispositivo. Novo: Suporte a Code Llama!
★ 10.938-1Variação de estrelas nos últimos 7 dias - #4
Troque o GPT por qualquer LLM alterando apenas uma linha de código. O Xinference permite executar modelos de código aberto, de fala e multimodais na nuvem, localmente ou no seu laptop — tudo através de uma API de inferência unificada e pronta para produção.
★ 9.528+21Variação de estrelas nos últimos 7 dias - #5
Modelo SenseVoiceSmall de código aberto para ASR em mandarim, cantonês, inglês, japonês e coreano, identificação de idioma, reconhecimento de emoção e detecção de eventos de áudio.
★ 9.172+51Variação de estrelas nos últimos 7 dias - #6
Transforme seu PC, Mac ou Linux em um servidor de IA. Inferência de LLM, interface de chat, voz, agentes, fluxos de trabalho, RAG e geração de imagens.
★ 4.823+197Variação de estrelas nos últimos 7 dias - #7
Uma biblioteca C#/.NET para executar LLM (🦙LLaMA/LLaVA) no seu dispositivo local com eficiência.
★ 3.788+2Variação de estrelas nos últimos 7 dias - #8
Plataforma de habilidades de câmera com IA de código aberto, NVR de IA e vigilância por CFTV. Análise de vídeo VLM local com Qwen, DeepSeek, SmolVLM, LLaVA, YOLO26. Agente de câmera de segurança baseado em LLM — observa, entende, lembra e protege sua casa via Telegram, Discord ou Slack. Habilidades de IA conectáveis. OpenAI, Google, Anthropic ou IA local. Executa em Mac Mini e PCs com IA.
★ 3.024+18Variação de estrelas nos últimos 7 dias - #9
O canivete suíço da IA offline. Converse, veja, fale e gere imagens no seu celular ou Mac — LLMs GGUF, visão, transcrição de fala Whisper, Stable Diffusion, chamadas de ferramentas e servidores de rede local. Executa na sua CPU, GPU ou NPU. Sem conta, sem chave de API, nenhum dado sai do seu dispositivo.
★ 3.021+54Variação de estrelas nos últimos 7 dias - #10★ 2.813+35Variação de estrelas nos últimos 7 dias
- #11
Maid é um aplicativo gratuito e de código aberto para interagir com modelos llama.cpp localmente, e com modelos Anthropic, DeepSeek, Ollama, Mistral e OpenAI remotamente.
★ 2.655+18Variação de estrelas nos últimos 7 dias - #12
Agente de IA Local-First. Otimizado para modelos de IA locais. Janela de contexto longa. Chamadas de ferramentas adequadas. Executa privadamente no seu dispositivo.
★ 2.425-9Variação de estrelas nos últimos 7 dias - #13
Um framework Python para chamadas de ferramentas LLM auto-hospedadas e fluxos de trabalho de agentes em várias etapas.
★ 2.229+6Variação de estrelas nos últimos 7 dias - #14
Execute modelos de IA localmente em sua máquina com bindings de Node.js para llama.cpp. Aplique um esquema JSON na saída do modelo no nível de geração.
★ 2.167+5Variação de estrelas nos últimos 7 dias - #15★ 1.702+1Variação de estrelas nos últimos 7 dias
- #16
Fale com seu Mac, consulte seus documentos, sem necessidade de nuvem. IA de voz e RAG executados localmente no dispositivo.
★ 1.542-1Variação de estrelas nos últimos 7 dias - #17
Família de modelos ASR de código aberto baseados em LLM para chinês, dialetos, sotaques e fala multilíngue, com runtimes FunASR, vLLM, streaming e llama.cpp.
★ 1.503+16Variação de estrelas nos últimos 7 dias - #18
Um lar aconchegante para seus LLMs.
★ 1.477+11Variação de estrelas nos últimos 7 dias - #19★ 1.398+1Variação de estrelas nos últimos 7 dias
- #20★ 1.028+4Variação de estrelas nos últimos 7 dias
- #21
Construa e execute agentes de IA usando Docker Compose. Uma coleção de exemplos prontos para uso para orquestrar LLMs de código aberto, ferramentas e runtimes de agentes.
★ 1.027+1Variação de estrelas nos últimos 7 dias - #22
Cotabby é o autocompletar de IA local para todo o seu Mac. Código aberto. No dispositivo. Em tudo o que você digita.
★ 980+18Variação de estrelas nos últimos 7 dias - #23
Monitor de sistema Apple Silicon sem necessidade de sudo (interface gráfica nativa em SwiftUI) com rastreamento de ANE / Media Engine / largura de banda de memória
★ 901+57Variação de estrelas nos últimos 7 dias - #24
Ferramenta de tradução de tela em tempo real para Android de código aberto e sem root, ideal para jogos, romances visuais e mangás. Suporta OCR local e em nuvem, LLMs offline, vários serviços de tradução e conversão de texto em fala (TTS), com traduções exibidas diretamente na tela.
★ 697+67Variação de estrelas nos últimos 7 dias - #25★ 678—Variação de estrelas nos últimos 7 dias
- #26
Entrevista autoavaliada para codificadores de IA
★ 598+0Variação de estrelas nos últimos 7 dias - #27
Nós do ComfyUI para modelos de visão-linguagem: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Inclui detecção de vocabulário aberto, segmentação SAM2/SAM3, raciocínio temporal de vídeo, GGUF via llama.cpp e APIs de LLM/VLM hospedadas.
★ 589+4Variação de estrelas nos últimos 7 dias - #28
GraphRAG-rs é uma implementação em Rust de alto desempenho e de última geração do GraphRAG (Graph-based Retrieval Augmented Generation) que constrói grafos de conhecimento a partir de documentos e permite consultas em linguagem natural com extração de entidades configurável e integração de LLM local
★ 525-1Variação de estrelas nos últimos 7 dias - #29
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 513—Variação de estrelas nos últimos 7 dias