Pular para o conteúdo principal
buildradar
Sign in
Tópico · local-llm

local-llm

Repositórios de código aberto acompanhados marcados com local-llm, ordenados por estrelas.

Repositórios
51
Total de estrelas
169.831
Média de estrelas
3.330
Participação
0,01%

Tópicos que aparecem com frequência ao lado de local-llm no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com local-llm.

  • Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks

    1.200
  • deltafin@gavamedia

    Execute o Kimi K3 completo em um único dispositivo. E um servidor de API compatível com OpenAI para chat local e agentes de programação.

    799
  • mlx-dspark@ARahim3

    Decodificação de LLM até 4x mais rápida no Apple Silicon, sem perdas. Port nativo em MLX do DSpark da DeepSeek e da decodificação especulativa DFlash do z-lab — Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, Ornith-1.0, Bonsai-27B ternário.

    645
  • awesome-ai-companion@DasterProkio

    Índice selecionado de projetos de código aberto de companheiros de IA: memória de longo prazo, comportamento proativo, voz, incorporação e atividades compartilhadas. 157 entradas marcadas por idioma, plataforma e prontidão. Índice de infraestrutura de código aberto para construir relacionamentos de companheiros de IA de longo prazo.

    641
  • Swiftlet@leonickson1

    Swiftlet é um runtime Swift e Metal que executa grandes modelos Qwen Mixture-of-Experts localmente em dispositivos Apple, transmitindo pesos de especialistas do armazenamento, permitindo que modelos de 35B e 80B rodem com pouca RAM, inclusive no iPhone.

    628
  • nanobot@HKUDS

    Framework de agente de IA pessoal ultraleve, de código aberto e auto-hospedado em Python com WebUI, ferramentas, memória, MCP, fluxos de trabalho multiagente, automação e aplicativos de chat

    47.662+140Variação de estrelas nos últimos 7 dias
  • llamafile@mozilla-ai

    Distribua e execute LLMs com um único arquivo.

    25.859+113Variação de estrelas nos últimos 7 dias
  • local-deep-research@LearningCircuit

    ~95% no SimpleQA (ex: Qwen3.6-27B em uma 3090). Suporta todos os LLMs locais e em nuvem (llama.cpp, Ollama, Google, ...). Mais de 10 mecanismos de busca - arXiv, PubMed, seus documentos privados. Tudo local e criptografado.

    9.023+18Variação de estrelas nos últimos 7 dias
  • open-multi-agent@open-multi-agent

    Framework de orquestração de agentes de IA em TypeScript com fluxos de trabalho dinâmicos. Descreva o objetivo, não o grafo: um coordenador planeja o DAG de tarefas em tempo de execução e o executa em qualquer LLM (Claude, ChatGPT, Gemini, DeepSeek ou modelos locais).

    6.860+20Variação de estrelas nos últimos 7 dias
  • dograh@dograh-hq

    Plataforma de voz AI de código aberto. Alternativa auto-hospedada ao Vapi e Retell. On-prem, BYOK para Speech to Speech ou LLM/STT/TTS, com construtor visual de fluxo de trabalho, suporte nativo a MCP e telefonia.

    5.568+45Variação de estrelas nos últimos 7 dias
  • openmed@maziyarpanahi

    IA de saúde local: NER clínico e desidentificação de PII HIPAA que roda 100% no dispositivo. Mais de 2.200 modelos médicos, 21 idiomas, Apple MLX + Python, sem nuvem, sem que dados de pacientes saiam da sua rede. Apache-2.0

    5.199+20Variação de estrelas nos últimos 7 dias
  • Soup@MakazhanAlpamys

    Ajuste fino de LLMs a partir de um único YAML. O streaming de camadas treina um modelo de 8B em uma GPU de laptop de 4 GB.

    4.929+1.365Variação de estrelas nos últimos 7 dias
  • langroid@langroid

    Explore LLMs com Programação Multi-Agente

    4.102+1Variação de estrelas nos últimos 7 dias
  • Rapid-MLX@raullenchai

    O mecanismo de IA local mais rápido para Apple Silicon. 4,2x mais rápido que o Ollama, TTFT em cache de 0,08s, suporte total a chamadas de ferramentas (100% tool calling). 17 analisadores de ferramentas, cache de prompts, separação de raciocínio, roteamento em nuvem. Substituto direto da API OpenAI. Funciona com Claude Code, Cursor e Aider.

    3.647+81Variação de estrelas nos últimos 7 dias
  • surf@deta

    Cadernos de IA pessoais. Organize arquivos e páginas da web e gere notas a partir deles. Código aberto, dados locais e abertos, escolha de modelo aberta (incluindo local).

    3.554+10Variação de estrelas nos últimos 7 dias
  • claude-code-local@nicedreamzapp

    Execute o Claude Code 100% no dispositivo com IA local em Apple Silicon. Servidor Anthropic-API nativo em MLX. 6 modelos incluindo Muse-Glimmer 30B (agora multimodal — lê imagens, abliterated), Gemma 4 31B, Qwen 3.5 122B (65 tok/s), DeepSeek V4 Flash (1M ctx). Privado, offline, pronto para airgap. Construído para fluxos de trabalho de NDA / jurídico / saúde.

    3.255+12Variação de estrelas nos últimos 7 dias
  • algernon@xyproto

    Servidor web pequeno e autônomo em Go puro com suporte a Lua, Teal, Markdown, HTTP/2, QUIC, Redis, TypeScript, React 19 sem npm, SQLite e PostgreSQL, entre outros.

    3.028+1Variação de estrelas nos últimos 7 dias
  • Uma lista curada de plataformas, ferramentas, práticas e recursos incríveis que ajudam a executar LLMs localmente

    2.823+23Variação de estrelas nos últimos 7 dias
  • little-coder@itayinbarr

    Um harness otimizado para LLMs menores.

    2.528+16Variação de estrelas nos últimos 7 dias
  • atomic-agent@AtomicBot-ai

    Agente de IA Local-First. Otimizado para modelos de IA locais. Janela de contexto longa. Chamadas de ferramentas adequadas. Executa privadamente no seu dispositivo.

    2.452+0Variação de estrelas nos últimos 7 dias
  • Traduza livros e documentos completos com Ollama, OpenAI (compatível), Gemini, Mistral, Poe ou OpenRouter. Preserva a formatação. Retoma de onde parou. Sem limites de tamanho de arquivo.

    2.368+31Variação de estrelas nos últimos 7 dias
  • openai-edge-tts@travisvn

    Endpoint de API de conversão de texto em fala gratuito e de alta qualidade para substituir OpenAI, Azure ou ElevenLabs

    2.075+5Variação de estrelas nos últimos 7 dias
  • parlor@fikrikarim

    IA multimodal em tempo real executada no dispositivo, com recursos semelhantes ao GPT-Live.

    2.048+7Variação de estrelas nos últimos 7 dias
  • vllm-mlx@waybarrios

    Servidor de inferência LLM de alto desempenho compatível com OpenAI e Anthropic para Apple Silicon. MLX nativo, processamento contínuo, modelos multimodais, chamada de ferramentas MCP e suporte ao Claude Code.

    1.557+6Variação de estrelas nos últimos 7 dias
  • row-bot@siddsachar

    Row-Bot - Soberania de IA pessoal. Um assistente de IA local-first com ferramentas integradas, grafo de conhecimento pessoal, voz, visão, shell, automação de navegador, tarefas agendadas, monitoramento de saúde e canais de mensagens. Execute localmente via Ollama ou adicione modelos em nuvem opcionais. Seus dados permanecem na sua máquina.

    1.480+11Variação de estrelas nos últimos 7 dias
  • Atomic-Chat@AtomicBot-ai

    Aplicativo de IA local e motor de inferência para agentes. Execute LLMs de pesos abertos localmente — privado, 100% offline no seu computador. Entre no nosso Discord: https://discord.com/invite/8wGSsvmg4V

    1.413+20Variação de estrelas nos últimos 7 dias
  • mlx-tune@ARahim3

    Faça o fine-tuning de LLMs no seu Mac com Apple Silicon. SFT, DPO, GRPO, Vision, TTS, STT, Embedding e fine-tuning de OCR — nativamente no MLX. API compatível com Unsloth.

    1.398+8Variação de estrelas nos últimos 7 dias
  • locally-uncensored@PurpleDoubleD

    Estúdio de IA local plug-and-play: chat sem censura, geração de imagens e vídeos, agente de código. Executa LLMs deslimitados + ComfyUI 100% offline. Um instalador, sem Docker, sem nuvem.

    1.351+185Variação de estrelas nos últimos 7 dias
  • Soul-of-Waifu@jofizcd

    🌌 Dê alma aos seus personagens favoritos. Soul of Waifu é um aplicativo de desktop para RPG e companhia de IA com avatares Live2D/VRM, chat de voz e LLM local. Evoluam juntos através de chats imersivos, aventuras de RPG e sua área de trabalho.

    1.281+15Variação de estrelas nos últimos 7 dias
  • ouroboros@razzant

    Ouroboros — agente de IA autoconstrutivo. Criado em 16 de fevereiro de 2026.

    1.254+18Variação de estrelas nos últimos 7 dias
  • gawkbot@najmuzzaman-mohammad

    WUPHF permite criar seu escritório pessoal de colegas de IA que colaboram através de contexto compartilhado. Suporta Claude Code, Codex, OpenClaw, OpenCode e LLMs locais.

    1.253+6Variação de estrelas nos últimos 7 dias
  • Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks

    1.200+316Variação de estrelas nos últimos 7 dias
  • web-search-mcp@mrkrsl

    Um servidor MCP de busca web simples e hospedado localmente para uso com LLMs locais

    1.122+8Variação de estrelas nos últimos 7 dias
  • synthadoc@axoviq-ai

    Synthadoc: Um motor de compilação de conhecimento LLM de código aberto que transforma documentos brutos em wikis estruturadas e locais. Uma alternativa transparente e legível por humanos ao RAG tradicional, que pode ser autogerenciada e autoaprimorada sem o uso de ferramentas externas.

    1.116+2Variação de estrelas nos últimos 7 dias
  • mlx-serve@ddalcu

    Servidor de inferência LLM nativo para Apple Silicon. Compatível com a API da OpenAI e Anthropic. Sem Python. Inclui o aplicativo MLX Core para macOS com chat, modo agente e chamada de ferramentas.

    1.115+245Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos