on-device-ai
Repositórios de código aberto acompanhados marcados com on-device-ai, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de on-device-ai no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com on-device-ai.
- #1
Inferência do Gemma 4 26B-A4B em ~2 GB de RAM em qualquer MacBook com chip série M
★ 6.663 - #2
Swiftlet é um runtime Swift e Metal que executa grandes modelos Qwen Mixture-of-Experts localmente em dispositivos Apple, transmitindo pesos de especialistas do armazenamento, permitindo que modelos de 35B e 80B rodem com pouca RAM, inclusive no iPhone.
★ 624 - #3
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543
- #1
Kit de ferramentas pronto para produção para executar IA localmente.
★ 10.281+1Variação de estrelas nos últimos 7 dias - #2
Modelo de fundação de 14MB para dispositivos pequenos: celulares, wearables, casas inteligentes e robôs.
★ 10.106+445Variação de estrelas nos últimos 7 dias - #3
Execute LLMs e VLMs de ponta localmente em dispositivos Qualcomm via NPU, GPU e CPU com poucas linhas de código
★ 8.347+9Variação de estrelas nos últimos 7 dias - #4
Inferência do Gemma 4 26B-A4B em ~2 GB de RAM em qualquer MacBook com chip série M
★ 6.663+170Variação de estrelas nos últimos 7 dias - #5
LiteRT-LM é o framework de inferência de alto desempenho, pronto para produção e de código aberto do Google para implantar Grandes Modelos de Linguagem em dispositivos de borda.
★ 6.358+39Variação de estrelas nos últimos 7 dias - #6
Quantização, kernels, runtime e motor de inferência para dispositivos móveis, wearables, casas inteligentes e robôs.
★ 5.975+20Variação de estrelas nos últimos 7 dias - #7
IA que você controla: Escolha seus modelos. Seja dono dos seus dados. Elimine a dependência de fornecedores.
★ 4.761-2Variação de estrelas nos últimos 7 dias - #8
Ferramenta de gerenciamento de arquivos baseada em IA que garante privacidade ao organizar textos e imagens locais. Utiliza modelos Llama3.2 3B e Llava v1.6 com o Nexa SDK para escanear, reestruturar e organizar arquivos de forma intuitiva para acesso rápido e fácil recuperação.
★ 3.334+0Variação de estrelas nos últimos 7 dias - #9
Execute o Claude Code 100% no dispositivo com IA local em Apple Silicon. Servidor Anthropic-API nativo em MLX. 6 modelos incluindo Muse-Glimmer 30B (agora multimodal — lê imagens, abliterated), Gemma 4 31B, Qwen 3.5 122B (65 tok/s), DeepSeek V4 Flash (1M ctx). Privado, offline, pronto para airgap. Construído para fluxos de trabalho de NDA / jurídico / saúde.
★ 3.255+12Variação de estrelas nos últimos 7 dias - #10
Mano-P: Agente GUI-VLA de código aberto para dispositivos de borda. #1 no OSWorld (especializado, 58,2%). Executa localmente em Apple M4 Mac mini/MacBook — nenhum dado sai do seu dispositivo.
★ 2.615+15Variação de estrelas nos últimos 7 dias - #11
IA multimodal em tempo real executada no dispositivo, com recursos semelhantes ao GPT-Live.
★ 2.048+7Variação de estrelas nos últimos 7 dias - #12
Repositório de modelos Core ML para iOS/macOS — modelos PyTorch convertidos para .mlpackage prontos para uso, cada um com um script de conversão e um aplicativo de exemplo em SwiftUI. Repositórios irmãos cobrem o framework Core AI da Apple (iOS/macOS 27) e LLMs on-device.
★ 1.860+4Variação de estrelas nos últimos 7 dias - #13
Maneira declarativa de executar modelos de IA no React Native localmente, utilizando o ExecuTorch.
★ 1.707+5Variação de estrelas nos últimos 7 dias - #14
Fale com seu Mac, consulte seus documentos, sem necessidade de nuvem. IA de voz e RAG executados localmente no dispositivo.
★ 1.542+0Variação de estrelas nos últimos 7 dias - #15
[ICLR 2019] ProxylessNAS: Busca direta de arquitetura neural em tarefas e hardware de destino
★ 1.447+0Variação de estrelas nos últimos 7 dias - #16
Faça o fine-tuning de LLMs no seu Mac com Apple Silicon. SFT, DPO, GRPO, Vision, TTS, STT, Embedding e fine-tuning de OCR — nativamente no MLX. API compatível com Unsloth.
★ 1.398+8Variação de estrelas nos últimos 7 dias - #17
Execução de LLM no dispositivo em React Native com compatibilidade com o Vercel AI SDK
★ 1.392+3Variação de estrelas nos últimos 7 dias - #18
O PhoneClaw transforma telefones em runtimes de agentes de IA locais com modelos no dispositivo, Skills nativas para dispositivos móveis, LiveLand e inferência opcional via Mac Gateway.
★ 1.231+6Variação de estrelas nos últimos 7 dias - #19
Um laboratório prático para construir, testar e avaliar aplicativos com o framework de modelos de fundação da Apple.
★ 1.178+1Variação de estrelas nos últimos 7 dias - #20
Implementação oficial em PyTorch de "EdgeSAM: Prompt-In-the-Loop Distillation for On-Device Deployment of SAM".
★ 1.173-1Variação de estrelas nos últimos 7 dias - #21
NativeMind: Seu assistente de IA totalmente privado, de código aberto e executado no dispositivo
★ 1.130+1Variação de estrelas nos últimos 7 dias - #22
NobodyWho é um mecanismo de inferência que permite executar LLMs localmente e de forma eficiente em qualquer dispositivo.
★ 1.094+13Variação de estrelas nos últimos 7 dias - #23
Muesli - transcrição e ditado local de reuniões nativo para agentes no macOS (alternativa ao Granola + WisprFlow)
★ 1.085+37Variação de estrelas nos últimos 7 dias - #24
PokeClaw (PocketClaw) — a primeira IA executada no próprio dispositivo que controla seu telefone Android. Gemma 4, sem nuvem, sem chave de API. Poke é abreviação de Pocket.
★ 1.037+11Variação de estrelas nos últimos 7 dias - #25
[CVPR 2025] Implementação oficial em PyTorch de "EdgeTAM: On-Device Track Anything Model"
★ 974+1Variação de estrelas nos últimos 7 dias - #26
TinyChatEngine: Biblioteca de inferência de LLM em dispositivos
★ 961+0Variação de estrelas nos últimos 7 dias - #27
Assistente de IA local-first e de código aberto para seus dados. Unifique tarefas, notas, documentos, fotos e favoritos. Privado, auto-hospedado e extensível via APIs.
★ 917+5Variação de estrelas nos últimos 7 dias - #28
Monitor de sistema Apple Silicon sem necessidade de sudo (interface gráfica nativa em SwiftUI) com rastreamento de ANE / Media Engine / largura de banda de memória
★ 915+15Variação de estrelas nos últimos 7 dias - #29
Modelos Whisper otimizados para streaming e uso em dispositivos
★ 897+0Variação de estrelas nos últimos 7 dias - #30
Camada de memória de arquivo único compartilhada para todos os seus agentes, RAG sub-milissegundo sobre texto, foto e vídeo no Apple Silicon. Sem servidor. Sem API. Um arquivo. Swift puro.
★ 788-3Variação de estrelas nos últimos 7 dias