llama-cpp
Repositorios de código abierto monitorizados etiquetados con llama-cpp, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a llama-cpp en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con llama-cpp.
- #1
Monitor de sistema para Apple Silicon sin necesidad de sudo (GUI nativa en SwiftUI) con seguimiento de ANE, Media Engine y ancho de banda de memoria
★ 901 - #2
Herramienta de traducción de pantalla en tiempo real para Android sin necesidad de ROOT, ideal para juegos, novelas visuales y manga. Soporta OCR local y en la nube, LLM offline, múltiples servicios de traducción y síntesis de voz (TTS), con visualización directa sobre la pantalla.
★ 697 - #3
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 521 - #4
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 494
- #1★ 25.746+78Variación de estrellas de los últimos 7 días
- #2
La aplicación de dictado para macOS más rápida y única con STT en el dispositivo y modelo de mejora de IA entrenado a medida. ¡Compilación previa para Windows disponible! Una alternativa local a Wispr Flow. Envíanos un DM en X para un huevo de pascua 😉 - https://x.com/fluidvoiceapp
★ 11.060+273Variación de estrellas de los últimos 7 días - #3
Un chatbot autohospedado, sin conexión, similar a ChatGPT. Impulsado por Llama 2. 100% privado, sin que los datos salgan de tu dispositivo. Nuevo: ¡Compatibilidad con Code Llama!
★ 10.938-1Variación de estrellas de los últimos 7 días - #4
Intercambia GPT por cualquier LLM cambiando una sola línea de código. Xinference te permite ejecutar modelos de código abierto, de voz y multimodales en la nube, localmente o en tu laptop, todo a través de una API de inferencia unificada y lista para producción.
★ 9528+21Variación de estrellas de los últimos 7 días - #5
Modelo de código abierto SenseVoiceSmall para ASR en mandarín, cantonés, inglés, japonés y coreano, identificación de idiomas, reconocimiento de emociones y detección de eventos de audio.
★ 9172+51Variación de estrellas de los últimos 7 días - #6
Convierte tu PC, Mac o equipo Linux en un servidor de IA. Inferencia de LLM, interfaz de chat, voz, agentes, flujos de trabajo, RAG y generación de imágenes.
★ 4823+197Variación de estrellas de los últimos 7 días - #7
Una biblioteca de C#/.NET para ejecutar LLM (🦙LLaMA/LLaVA) en tu dispositivo local de manera eficiente.
★ 3788+2Variación de estrellas de los últimos 7 días - #8
Plataforma de habilidades de cámara de IA de código abierto, AI NVR y videovigilancia CCTV. Análisis de video local con VLM usando Qwen, DeepSeek, SmolVLM, LLaVA, YOLO26. Agente de cámara de seguridad inteligente impulsado por LLM: observa, entiende, recuerda y protege su hogar a través de Telegram, Discord o Slack. Habilidades de IA acoplables. OpenAI, Google, Anthropic o IA local. Funciona en Mac Mini y AI PC.
★ 3024+18Variación de estrellas de los últimos 7 días - #9
La navaja suiza de la IA sin conexión. Chatea, visualiza, habla y genera imágenes en tu teléfono o Mac: LLMs GGUF, visión, conversión de voz a texto con Whisper, Stable Diffusion, llamadas a herramientas y servidores de red local. Se ejecuta en tu CPU, GPU o NPU. Sin cuentas, sin clave de API y cero datos abandonan tu dispositivo.
★ 3021+54Variación de estrellas de los últimos 7 días - #10★ 2813+35Variación de estrellas de los últimos 7 días
- #11
Maid es una aplicación gratuita y de código abierto para interactuar con modelos de llama.cpp localmente, y con modelos de Anthropic, DeepSeek, Ollama, Mistral y OpenAI de forma remota.
★ 2655+18Variación de estrellas de los últimos 7 días - #12
Agente de IA Local First. Optimizado para modelos de IA locales. Ventana de contexto largo. Llamadas a herramientas adecuadas. Se ejecuta de forma privada en tu dispositivo.
★ 2425-9Variación de estrellas de los últimos 7 días - #13
Un framework de Python para llamadas a herramientas de LLM autohospedadas y flujos de trabajo de agentes de varios pasos
★ 2229+6Variación de estrellas de los últimos 7 días - #14
Ejecuta modelos de IA localmente en tu máquina con enlaces de node.js para llama.cpp. Aplica un esquema JSON en la salida del modelo a nivel de generación
★ 2167+5Variación de estrellas de los últimos 7 días - #15★ 1702+1Variación de estrellas de los últimos 7 días
- #16
Habla con tu Mac, consulta tus documentos, sin necesidad de la nube. IA de voz en el dispositivo + RAG.
★ 1542-1Variación de estrellas de los últimos 7 días - #17
Familia de modelos ASR de código abierto basados en LLM para chino, dialectos, acentos y voz multilingüe, con motores de ejecución como FunASR, vLLM, streaming y llama.cpp.
★ 1503+16Variación de estrellas de los últimos 7 días - #18
Un hogar acogedor para tus LLMs.
★ 1477+11Variación de estrellas de los últimos 7 días - #19★ 1398+1Variación de estrellas de los últimos 7 días
- #20★ 1028+4Variación de estrellas de los últimos 7 días
- #21
Construye y ejecuta agentes de IA usando Docker Compose. Una colección de ejemplos listos para usar para orquestar LLMs de código abierto, herramientas y entornos de ejecución de agentes.
★ 1027+1Variación de estrellas de los últimos 7 días - #22
Cotabby es un autocompletado con IA local para todo tu Mac. Código abierto. En el dispositivo. Dondequiera que escribas.
★ 980+18Variación de estrellas de los últimos 7 días - #23
Monitor de sistema para Apple Silicon sin necesidad de sudo (GUI nativa en SwiftUI) con seguimiento de ANE, Media Engine y ancho de banda de memoria
★ 901+57Variación de estrellas de los últimos 7 días - #24
Herramienta de traducción de pantalla en tiempo real para Android sin necesidad de ROOT, ideal para juegos, novelas visuales y manga. Soporta OCR local y en la nube, LLM offline, múltiples servicios de traducción y síntesis de voz (TTS), con visualización directa sobre la pantalla.
★ 697+67Variación de estrellas de los últimos 7 días - #25★ 681—Variación de estrellas de los últimos 7 días
- #26
Entrevista de autoevaluación para programadores de IA.
★ 598+0Variación de estrellas de los últimos 7 días - #27
Nodos de ComfyUI para modelos de lenguaje visual: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Incluye detección de vocabulario abierto, segmentación SAM2/SAM3, razonamiento temporal de video, GGUF mediante llama.cpp y APIs de LLM/VLM alojadas.
★ 589+4Variación de estrellas de los últimos 7 días - #28
GraphRAG-rs es una implementación de alto rendimiento en Rust de GraphRAG (Generación Aumentada por Recuperación basada en grafos), que construye grafos de conocimiento a partir de documentos y permite consultas en lenguaje natural con extracción de entidades configurable e integración de LLM local.
★ 525-1Variación de estrellas de los últimos 7 días - #29
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 521—Variación de estrellas de los últimos 7 días