local-llm
Repositórios de código aberto acompanhados marcados com local-llm, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de local-llm no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com local-llm.
- #1
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1.200 - #2
Execute o Kimi K3 completo em um único dispositivo. E um servidor de API compatível com OpenAI para chat local e agentes de programação.
★ 799 - #3
Decodificação de LLM até 4x mais rápida no Apple Silicon, sem perdas. Port nativo em MLX do DSpark da DeepSeek e da decodificação especulativa DFlash do z-lab — Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, Ornith-1.0, Bonsai-27B ternário.
★ 645 - #4
Índice selecionado de projetos de código aberto de companheiros de IA: memória de longo prazo, comportamento proativo, voz, incorporação e atividades compartilhadas. 157 entradas marcadas por idioma, plataforma e prontidão. Índice de infraestrutura de código aberto para construir relacionamentos de companheiros de IA de longo prazo.
★ 641 - #5
Swiftlet é um runtime Swift e Metal que executa grandes modelos Qwen Mixture-of-Experts localmente em dispositivos Apple, transmitindo pesos de especialistas do armazenamento, permitindo que modelos de 35B e 80B rodem com pouca RAM, inclusive no iPhone.
★ 628
- #1
Framework de agente de IA pessoal ultraleve, de código aberto e auto-hospedado em Python com WebUI, ferramentas, memória, MCP, fluxos de trabalho multiagente, automação e aplicativos de chat
★ 47.662+140Variação de estrelas nos últimos 7 dias - #2★ 25.859+113Variação de estrelas nos últimos 7 dias
- #3
~95% no SimpleQA (ex: Qwen3.6-27B em uma 3090). Suporta todos os LLMs locais e em nuvem (llama.cpp, Ollama, Google, ...). Mais de 10 mecanismos de busca - arXiv, PubMed, seus documentos privados. Tudo local e criptografado.
★ 9.023+18Variação de estrelas nos últimos 7 dias - #4
Framework de orquestração de agentes de IA em TypeScript com fluxos de trabalho dinâmicos. Descreva o objetivo, não o grafo: um coordenador planeja o DAG de tarefas em tempo de execução e o executa em qualquer LLM (Claude, ChatGPT, Gemini, DeepSeek ou modelos locais).
★ 6.860+20Variação de estrelas nos últimos 7 dias - #5
Plataforma de voz AI de código aberto. Alternativa auto-hospedada ao Vapi e Retell. On-prem, BYOK para Speech to Speech ou LLM/STT/TTS, com construtor visual de fluxo de trabalho, suporte nativo a MCP e telefonia.
★ 5.568+45Variação de estrelas nos últimos 7 dias - #6
IA de saúde local: NER clínico e desidentificação de PII HIPAA que roda 100% no dispositivo. Mais de 2.200 modelos médicos, 21 idiomas, Apple MLX + Python, sem nuvem, sem que dados de pacientes saiam da sua rede. Apache-2.0
★ 5.199+20Variação de estrelas nos últimos 7 dias - #7
Ajuste fino de LLMs a partir de um único YAML. O streaming de camadas treina um modelo de 8B em uma GPU de laptop de 4 GB.
★ 4.929+1.365Variação de estrelas nos últimos 7 dias - #8★ 4.102+1Variação de estrelas nos últimos 7 dias
- #9
O mecanismo de IA local mais rápido para Apple Silicon. 4,2x mais rápido que o Ollama, TTFT em cache de 0,08s, suporte total a chamadas de ferramentas (100% tool calling). 17 analisadores de ferramentas, cache de prompts, separação de raciocínio, roteamento em nuvem. Substituto direto da API OpenAI. Funciona com Claude Code, Cursor e Aider.
★ 3.647+81Variação de estrelas nos últimos 7 dias - #10
Cadernos de IA pessoais. Organize arquivos e páginas da web e gere notas a partir deles. Código aberto, dados locais e abertos, escolha de modelo aberta (incluindo local).
★ 3.554+10Variação de estrelas nos últimos 7 dias - #11
Execute o Claude Code 100% no dispositivo com IA local em Apple Silicon. Servidor Anthropic-API nativo em MLX. 6 modelos incluindo Muse-Glimmer 30B (agora multimodal — lê imagens, abliterated), Gemma 4 31B, Qwen 3.5 122B (65 tok/s), DeepSeek V4 Flash (1M ctx). Privado, offline, pronto para airgap. Construído para fluxos de trabalho de NDA / jurídico / saúde.
★ 3.255+12Variação de estrelas nos últimos 7 dias - #12
Servidor web pequeno e autônomo em Go puro com suporte a Lua, Teal, Markdown, HTTP/2, QUIC, Redis, TypeScript, React 19 sem npm, SQLite e PostgreSQL, entre outros.
★ 3.028+1Variação de estrelas nos últimos 7 dias - #13
Uma lista curada de plataformas, ferramentas, práticas e recursos incríveis que ajudam a executar LLMs localmente
★ 2.823+23Variação de estrelas nos últimos 7 dias - #14
Um harness otimizado para LLMs menores.
★ 2.528+16Variação de estrelas nos últimos 7 dias - #15
Agente de IA Local-First. Otimizado para modelos de IA locais. Janela de contexto longa. Chamadas de ferramentas adequadas. Executa privadamente no seu dispositivo.
★ 2.452+0Variação de estrelas nos últimos 7 dias - #16
Traduza livros e documentos completos com Ollama, OpenAI (compatível), Gemini, Mistral, Poe ou OpenRouter. Preserva a formatação. Retoma de onde parou. Sem limites de tamanho de arquivo.
★ 2.368+31Variação de estrelas nos últimos 7 dias - #17
Endpoint de API de conversão de texto em fala gratuito e de alta qualidade para substituir OpenAI, Azure ou ElevenLabs
★ 2.075+5Variação de estrelas nos últimos 7 dias - #18
IA multimodal em tempo real executada no dispositivo, com recursos semelhantes ao GPT-Live.
★ 2.048+7Variação de estrelas nos últimos 7 dias - #19
Servidor de inferência LLM de alto desempenho compatível com OpenAI e Anthropic para Apple Silicon. MLX nativo, processamento contínuo, modelos multimodais, chamada de ferramentas MCP e suporte ao Claude Code.
★ 1.557+6Variação de estrelas nos últimos 7 dias - #20
Row-Bot - Soberania de IA pessoal. Um assistente de IA local-first com ferramentas integradas, grafo de conhecimento pessoal, voz, visão, shell, automação de navegador, tarefas agendadas, monitoramento de saúde e canais de mensagens. Execute localmente via Ollama ou adicione modelos em nuvem opcionais. Seus dados permanecem na sua máquina.
★ 1.480+11Variação de estrelas nos últimos 7 dias - #21
Aplicativo de IA local e motor de inferência para agentes. Execute LLMs de pesos abertos localmente — privado, 100% offline no seu computador. Entre no nosso Discord: https://discord.com/invite/8wGSsvmg4V
★ 1.413+20Variação de estrelas nos últimos 7 dias - #22
Faça o fine-tuning de LLMs no seu Mac com Apple Silicon. SFT, DPO, GRPO, Vision, TTS, STT, Embedding e fine-tuning de OCR — nativamente no MLX. API compatível com Unsloth.
★ 1.398+8Variação de estrelas nos últimos 7 dias - #23
Estúdio de IA local plug-and-play: chat sem censura, geração de imagens e vídeos, agente de código. Executa LLMs deslimitados + ComfyUI 100% offline. Um instalador, sem Docker, sem nuvem.
★ 1.351+185Variação de estrelas nos últimos 7 dias - #24
🌌 Dê alma aos seus personagens favoritos. Soul of Waifu é um aplicativo de desktop para RPG e companhia de IA com avatares Live2D/VRM, chat de voz e LLM local. Evoluam juntos através de chats imersivos, aventuras de RPG e sua área de trabalho.
★ 1.281+15Variação de estrelas nos últimos 7 dias - #25★ 1.254+18Variação de estrelas nos últimos 7 dias
- #26
WUPHF permite criar seu escritório pessoal de colegas de IA que colaboram através de contexto compartilhado. Suporta Claude Code, Codex, OpenClaw, OpenCode e LLMs locais.
★ 1.253+6Variação de estrelas nos últimos 7 dias - #27
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1.200+316Variação de estrelas nos últimos 7 dias - #28
Um servidor MCP de busca web simples e hospedado localmente para uso com LLMs locais
★ 1.122+8Variação de estrelas nos últimos 7 dias - #29
Synthadoc: Um motor de compilação de conhecimento LLM de código aberto que transforma documentos brutos em wikis estruturadas e locais. Uma alternativa transparente e legível por humanos ao RAG tradicional, que pode ser autogerenciada e autoaprimorada sem o uso de ferramentas externas.
★ 1.116+2Variação de estrelas nos últimos 7 dias - #30
Servidor de inferência LLM nativo para Apple Silicon. Compatível com a API da OpenAI e Anthropic. Sem Python. Inclui o aplicativo MLX Core para macOS com chat, modo agente e chamada de ferramentas.
★ 1.115+245Variação de estrelas nos últimos 7 dias