llamacpp
Repositórios de código aberto acompanhados marcados com llamacpp, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de llamacpp no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com llamacpp.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Jan é uma alternativa de código aberto ao ChatGPT que roda 100% offline no seu computador.
★ 44.305+54Variação de estrelas nos últimos 7 dias - #2
Seu segundo cérebro de IA. Auto-hospedável. Obtenha respostas da web ou dos seus documentos. Crie agentes personalizados, agende automações, faça pesquisas profundas. Transforme qualquer LLM online ou local em sua IA pessoal e autônoma (gpt, claude, gemini, llama, qwen, mistral). Comece agora - grátis.
★ 37.010+223Variação de estrelas nos últimos 7 dias - #3
Framework unificado para construir pipelines de RAG corporativos com modelos pequenos e especializados
★ 14.854+2Variação de estrelas nos últimos 7 dias - #4
Um chatbot estilo ChatGPT auto-hospedado e offline. Desenvolvido com Llama 2. 100% privado, sem que nenhum dado deixe o seu dispositivo. Novo: Suporte a Code Llama!
★ 10.939+1Variação de estrelas nos últimos 7 dias - #5
Kit de ferramentas pronto para produção para executar IA localmente.
★ 10.281+1Variação de estrelas nos últimos 7 dias - #6
Troque o GPT por qualquer LLM alterando apenas uma linha de código. O Xinference permite executar modelos de código aberto, de fala e multimodais na nuvem, localmente ou no seu laptop — tudo através de uma API de inferência unificada e pronta para produção.
★ 9.537+9Variação de estrelas nos últimos 7 dias - #7
Quantização, kernels, runtime e motor de inferência para dispositivos móveis, wearables, casas inteligentes e robôs.
★ 5.975+20Variação de estrelas nos últimos 7 dias - #8
⚡ Mecanismo de inferência WebGPU em Rust puro — compatível com a API da OpenAI, nativo em GGUF, roda em qualquer GPU. Sem Python. Sem llama.cpp. Binário único.
★ 5.816+6Variação de estrelas nos últimos 7 dias - #9
Troca de modelo confiável para qualquer servidor local compatível com OpenAI/Anthropic - llama.cpp, vllm, etc.
★ 5.562+49Variação de estrelas nos últimos 7 dias - #10
Seu agente no terminal, equipado com ferramentas locais: escreve código, usa o terminal e navega na web. Crie seu próprio agente autônomo persistente.
★ 4.405+2Variação de estrelas nos últimos 7 dias - #11★ 4.160+1Variação de estrelas nos últimos 7 dias
- #12
Uma biblioteca C#/.NET para executar LLM (🦙LLaMA/LLaVA) no seu dispositivo local com eficiência.
★ 3.790+2Variação de estrelas nos últimos 7 dias - #13
The most no-nonsense, locally or API-hosted AI code completion plugin for Visual Studio Code - like GitHub Copilot but 100% free.
★ 3.633+3Variação de estrelas nos últimos 7 dias - #14
AGiXT é uma plataforma dinâmica de automação de agentes de IA que orquestra perfeitamente o gerenciamento de instruções e a execução de tarefas complexas em diversos provedores de IA. Combinando memória adaptativa, recursos inteligentes e um sistema de plugins versátil, o AGiXT oferece soluções de IA eficientes e abrangentes.
★ 3.214+0Variação de estrelas nos últimos 7 dias - #15
LSP-AI é um servidor de linguagem de código aberto que atua como backend para funcionalidades baseadas em IA, projetado para auxiliar e capacitar engenheiros de software, não para substituí-los.
★ 3.204+3Variação de estrelas nos últimos 7 dias - #16
RamaLama é uma ferramenta de código aberto para desenvolvedores que simplifica a hospedagem local de modelos de IA de qualquer fonte e facilita seu uso para inferência em produção, tudo através da linguagem familiar de containers.
★ 3.031+6Variação de estrelas nos últimos 7 dias - #17
Demonstração do Bonsai
★ 2.271+15Variação de estrelas nos últimos 7 dias - #18★ 2.226+3Variação de estrelas nos últimos 7 dias
- #19★ 1.912+1Variação de estrelas nos últimos 7 dias
- #20
Painel de controle para VLLM, Sglang, llama.cpp, exllamav3
★ 1.749+7Variação de estrelas nos últimos 7 dias - #21
Plataforma de balanceamento de carga e serviço de LLM/VLM de código aberto para auto-hospedagem de LLMs (e VLMs) em escala. Alternativa a projetos como llm-d, Docker Model Runner, etc., mas com menos partes móveis e implantações simples construídas em torno do ecossistema ggml. Executa em CPU e GPU.
★ 1.665+0Variação de estrelas nos últimos 7 dias - #22
Converse com seus modelos LLaMA favoritos em um aplicativo nativo para macOS.
★ 1.510-1Variação de estrelas nos últimos 7 dias - #23
Aplicativo de IA local e motor de inferência para agentes. Execute LLMs de pesos abertos localmente — privado, 100% offline no seu computador. Entre no nosso Discord: https://discord.com/invite/8wGSsvmg4V
★ 1.413+20Variação de estrelas nos últimos 7 dias - #24
Crie aplicações LLM prontas para produção e agentes avançados usando Python, LangChain e LangGraph. Este é o repositório complementar do livro sobre IA generativa com LangChain.
★ 1.413+1Variação de estrelas nos últimos 7 dias - #25
Calcule tokens/s e requisitos de memória GPU para qualquer LLM. Suporta quantização llama.cpp/ggml/bnb/QLoRA.
★ 1.406+0Variação de estrelas nos últimos 7 dias - #26
A maneira mais fácil de usar Ollama no .NET.
★ 1.401+1Variação de estrelas nos últimos 7 dias - #27
🌌 Dê alma aos seus personagens favoritos. Soul of Waifu é um aplicativo de desktop para RPG e companhia de IA com avatares Live2D/VRM, chat de voz e LLM local. Evoluam juntos através de chats imersivos, aventuras de RPG e sua área de trabalho.
★ 1.281+15Variação de estrelas nos últimos 7 dias - #28
Vinculação WebAssembly para o llama.cpp - Habilitando inferência de LLM diretamente no navegador
★ 1.191+11Variação de estrelas nos últimos 7 dias - #29
Um serviço FastAPI para busca semântica de texto usando embeddings pré-computados e medidas de similaridade avançadas, com suporte integrado a vários tipos de arquivos via textract.
★ 1.055-1Variação de estrelas nos últimos 7 dias - #30
Execute qualquer SLM/LLM em formato GGUF localmente, diretamente no dispositivo Android
★ 892+2Variação de estrelas nos últimos 7 dias