local-llm
Repositorios de código abierto monitorizados etiquetados con local-llm, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a local-llm en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con local-llm.
- #1
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1191 - #2
Ejecuta Kimi K3 completo en un solo dispositivo. Incluye un servidor API compatible con OpenAI para chat local y agentes de programación.
★ 799 - #3
Decodificación de LLM hasta 4 veces más rápida en Apple Silicon, sin pérdida. Puerto nativo en MLX de DSpark de DeepSeek y DFlash de z-lab para decodificación especulativa: Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, Ornith-1.0, ternary Bonsai-27B.
★ 640 - #4
Open-source AI companions, desktop pets, long-term memory & proactive chat. 人机恋开源项目大全。让你的家机能够脱离官端自主存在,拥有记忆和主动性。
★ 633 - #5
Swiftlet es un entorno de ejecución de Swift y Metal que ejecuta modelos de mezcla de expertos Qwen de gran tamaño localmente en dispositivos Apple mediante la transmisión de pesos de expertos desde el almacenamiento, permitiendo ejecutar modelos de 35B y 80B con poca memoria RAM, incluso en iPhone.
★ 624
- #1
Framework de agente de IA personal ultraligero, de código abierto y autohospedado en Python con WebUI, herramientas, memoria, MCP, flujos de trabajo multiagente, automatización y aplicaciones de chat
★ 47.662+140Variación de estrellas de los últimos 7 días - #2★ 25.859+113Variación de estrellas de los últimos 7 días
- #3
~95% en SimpleQA (ej. Qwen3.6-27B en una 3090). Compatible con todos los LLM locales y en la nube (llama.cpp, Ollama, Google, ...). Más de 10 motores de búsqueda: arXiv, PubMed, tus documentos privados. Todo local y cifrado.
★ 9023+18Variación de estrellas de los últimos 7 días - #4
Framework de orquestación de agentes de IA en TypeScript con flujos de trabajo dinámicos. Describe el objetivo, no el grafo: un coordinador planifica el DAG de tareas en tiempo de ejecución y lo ejecuta en cualquier LLM (Claude, ChatGPT, Gemini, DeepSeek o modelos locales).
★ 6860+20Variación de estrellas de los últimos 7 días - #5
Plataforma de voz de IA de código abierto. Alternativa autohospedada a Vapi y Retell. En local (On Prem), BYOK para conversión de voz a voz o LLM/STT/TTS, con un creador visual de flujos de trabajo, compatibilidad nativa con MCP y telefonía
★ 5568+45Variación de estrellas de los últimos 7 días - #6
IA de salud local-first: NER clínico y desidentificación de PII de HIPAA que se ejecuta 100% en el dispositivo. Más de 2200 modelos médicos, 21 idiomas, Apple MLX + Python, sin nube y sin que los datos de pacientes salgan de tu red. Apache-2.0
★ 5199+20Variación de estrellas de los últimos 7 días - #7
Ajusta LLMs desde un solo YAML. El streaming de capas entrena un modelo de 8B en una GPU de laptop de 4 GB.
★ 4929+1365Variación de estrellas de los últimos 7 días - #8★ 4102+1Variación de estrellas de los últimos 7 días
- #9
El motor de IA local más rápido para Apple Silicon. 4.2x más rápido que Ollama, 0.08s de TTFT en caché, 100% de llamadas a herramientas. 17 analizadores de herramientas, caché de prompts, separación de razonamiento, enrutamiento en la nube. Reemplazo directo para OpenAI. Funciona con Claude Code, Cursor, Aider.
★ 3647+81Variación de estrellas de los últimos 7 días - #10
Cuadernos de IA personales. Organiza archivos y páginas web, y genera notas a partir de ellos. De código abierto, datos locales y abiertos, y con opción de elegir modelos (incluyendo locales).
★ 3554+10Variación de estrellas de los últimos 7 días - #11
Ejecuta Claude Code 100% en el dispositivo con IA local en Apple Silicon. Servidor de API de Anthropic nativo de MLX. 6 luchadores incl. Muse-Glimmer 30B (ahora multimodal — lee imágenes, abliterado), Gemma 4 31B, Qwen 3.5 122B (65 tok/s), DeepSeek V4 Flash (1M ctx). Privado, sin conexión, listo para air-gap. Diseñado para flujos de trabajo de NDA / legales / de salud.
★ 3255+12Variación de estrellas de los últimos 7 días - #12
Pequeño servidor web autónomo en Go puro con soporte para Lua, Teal, Markdown, HTTP/2, QUIC, Redis, TypeScript, React 19 sin npm, SQLite y PostgreSQL ++
★ 3028+1Variación de estrellas de los últimos 7 días - #13
Una lista seleccionada de plataformas, herramientas, prácticas y recursos increíbles que ayudan a ejecutar LLM de forma local.
★ 2823+23Variación de estrellas de los últimos 7 días - #14
Un arnés optimizado para LLMs más pequeños
★ 2528+16Variación de estrellas de los últimos 7 días - #15
Agente de IA Local First. Optimizado para modelos de IA locales. Ventana de contexto largo. Llamadas a herramientas adecuadas. Se ejecuta de forma privada en tu dispositivo.
★ 2452+0Variación de estrellas de los últimos 7 días - #16
Traduce libros completos y documentos con Ollama, OpenAI (compatible), Gemini, Mistral, Poe u OpenRouter. Mantiene el formato. Retoma donde lo dejaste. Sin límites de tamaño de archivo.
★ 2368+31Variación de estrellas de los últimos 7 días - #17
Endpoint de API de texto a voz gratuito y de alta calidad para reemplazar OpenAI, Azure o ElevenLabs
★ 2075+5Variación de estrellas de los últimos 7 días - #18
IA multimodal en tiempo real y en el dispositivo con funciones similares a GPT-Live
★ 2048+7Variación de estrellas de los últimos 7 días - #19
Servidor de inferencia LLM de alto rendimiento compatible con OpenAI y Anthropic para Apple Silicon. Incluye MLX nativo, procesamiento por lotes continuo, modelos multimodales, llamadas a herramientas MCP y soporte para Claude Code.
★ 1557+6Variación de estrellas de los últimos 7 días - #20
Row-Bot: Soberanía de IA personal. Un asistente de IA centrado en el uso local con herramientas integradas, un grafo de conocimiento personal, voz, visión, shell, automatización de navegador, tareas programadas, seguimiento de salud y canales de mensajería. Ejecútalo localmente mediante Ollama o añade modelos en la nube opcionales. Tus datos permanecen en tu máquina.
★ 1480+11Variación de estrellas de los últimos 7 días - #21
Aplicación de IA local y motor de inferencia para agentes. Ejecuta LLMs de pesos abiertos localmente: privado, 100% sin conexión en tu computadora. Únete a nuestro Discord: https://discord.com/invite/8wGSsvmg4V
★ 1413+20Variación de estrellas de los últimos 7 días - #22
Ajuste fino de LLM en tu Mac con Apple Silicon. SFT, DPO, GRPO, Vision, TTS, STT, Embedding y ajuste fino de OCR, de forma nativa en MLX. API compatible con Unsloth.
★ 1398+8Variación de estrellas de los últimos 7 días - #23
Estudio de IA local plug-and-play: chat sin censura, generación de imágenes y video, y agente de programación. Ejecuta LLM abliterados y ComfyUI 100% offline. Un solo instalador, sin Docker, sin nube.
★ 1351+185Variación de estrellas de los últimos 7 días - #24
Dale alma a tus personajes favoritos. Soul of Waifu es una aplicación de escritorio de rol y compañía con IA que incluye avatares Live2D/VRM, chat de voz y LLM local. Evolucionen juntos a través de chats inmersivos, aventuras RPG y su escritorio
★ 1281+15Variación de estrellas de los últimos 7 días - #25★ 1254+18Variación de estrellas de los últimos 7 días
- #26
WUPHF te permite crear tu oficina personal de compañeros de equipo de IA que colaboran mediante un contexto compartido. Compatible con Claude Code, Codex, OpenClaw, OpenCode y LLMs locales
★ 1253+6Variación de estrellas de los últimos 7 días - #27
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1191+285Variación de estrellas de los últimos 7 días - #28
Un servidor MCP de búsqueda web simple y alojado localmente para usar con LLMs locales
★ 1122+8Variación de estrellas de los últimos 7 días - #29
Synthadoc: motor de compilación de conocimiento LLM de código abierto que convierte documentos sin procesar en wikis estructurados y locales. Una alternativa transparente y legible por humanos al RAG tradicional, autogestionable y auto-mejorable sin herramientas externas.
★ 1116+2Variación de estrellas de los últimos 7 días - #30
Servidor de inferencia LLM nativo para Apple Silicon. Compatible con la API de OpenAI y Anthropic. Sin Python. Incluye la aplicación MLX Core para macOS con chat, modo agente y llamada a herramientas.
★ 1115+245Variación de estrellas de los últimos 7 días