Saltar al contenido principal
buildradar
Sign in
Tema · gguf

gguf

Repositorios de código abierto monitorizados etiquetados con gguf, ordenados por estrellas.

Repositorios
29
Estrellas totales
106.447
Estrellas de media
3671
Proporción
0,01%

Temas que aparecen con frecuencia junto a gguf en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con gguf.

  • Herramienta de traducción de pantalla en tiempo real para Android sin necesidad de ROOT, ideal para juegos, novelas visuales y manga. Soporta OCR local y en la nube, LLM offline, múltiples servicios de traducción y síntesis de voz (TTS), con visualización directa sobre la pantalla.

    786
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    548
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501
  • llmfit@AlexsJones

    Cientos de modelos y proveedores. Un solo comando para encontrar lo que se ejecuta en tu hardware.

    34.759+265Variación de estrellas de los últimos 7 días
  • llamafile@mozilla-ai

    Distribuye y ejecuta LLMs con un solo archivo.

    25.859+113Variación de estrellas de los últimos 7 días
  • shimmy@Michael-A-Kuykendall

    ⚡ Motor de inferencia WebGPU en Rust puro: compatible con la API de OpenAI, nativo de GGUF, se ejecuta en cualquier GPU. Sin Python. Sin llama.cpp. Binario único.

    5816+6Variación de estrellas de los últimos 7 días
  • Soup@MakazhanAlpamys

    Ajusta LLMs desde un solo YAML. El streaming de capas entrena un modelo de 8B en una GPU de laptop de 4 GB.

    4929+1365Variación de estrellas de los últimos 7 días
  • OGAM@off-grid-ai

    La navaja suiza de la IA sin conexión. Chatea, visualiza, habla y genera imágenes en tu teléfono o Mac: LLMs GGUF, visión, conversión de voz a texto con Whisper, Stable Diffusion, llamadas a herramientas y servidores de red local. Se ejecuta en tu CPU, GPU o NPU. Sin cuentas, sin clave de API y cero datos abandonan tu dispositivo.

    3038+17Variación de estrellas de los últimos 7 días
  • maid@Mobile-Artificial-Intelligence

    Maid es una aplicación gratuita y de código abierto para interactuar con modelos de llama.cpp localmente, y con modelos de Anthropic, DeepSeek, Ollama, Mistral y OpenAI de forma remota.

    2656+1Variación de estrellas de los últimos 7 días
  • handy-ollama@datawhalechina

    Aprende Ollama de forma práctica, despliegue de grandes modelos en CPU. Dirección de lectura en línea: https://datawhalechina.github.io/handy-ollama/

    2516+3Variación de estrellas de los últimos 7 días
  • atomic-agent@AtomicBot-ai

    Agente de IA Local First. Optimizado para modelos de IA locales. Ventana de contexto largo. Llamadas a herramientas adecuadas. Se ejecuta de forma privada en tu dispositivo.

    2452+0Variación de estrellas de los últimos 7 días
  • comfyui_LLM_party@heshengtao

    Framework de agentes LLM en ComfyUI que incluye servidor MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 y nodos de prompts para FLUX, acceso a Feishu, Discord, y se adapta a todos los LLM con interfaces similares a OpenAI / aisuite, como o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi, doubao. Adaptado a LLM locales, VLM, GGUF como llama-3.3 Janus-Pro, Linkage graphRAG

    2348+5Variación de estrellas de los últimos 7 días
  • node-llama-cpp@withcatai

    Ejecuta modelos de IA localmente en tu máquina con enlaces de node.js para llama.cpp. Aplica un esquema JSON en la salida del modelo a nivel de generación

    2170+4Variación de estrellas de los últimos 7 días
  • transcribe.cpp@handy-computer

    Inferencia de voz a texto con ggml para más de 16 familias de modelos

    1872+19Variación de estrellas de los últimos 7 días
  • gollama@sammcj

    Gestiona tus modelos de Ollama.

    1835-1Variación de estrellas de los últimos 7 días
  • auto-round@intel

    Un algoritmo de cuantización SOTA para inferencia de LLM de bajo bit y alta precisión, optimizado para CPU/XPU/CUDA, con soporte para múltiples tipos de datos y compatibilidad total con vLLM, SGLang y Transformers.

    1599+8Variación de estrellas de los últimos 7 días
  • Fun-ASR@QwenAudio

    Familia de modelos ASR de código abierto basados en LLM para chino, dialectos, acentos y voz multilingüe, con motores de ejecución como FunASR, vLLM, streaming y llama.cpp.

    1512+10Variación de estrellas de los últimos 7 días
  • OuteTTS@edwko

    Interfaz para modelos OuteTTS.

    1437+0Variación de estrellas de los últimos 7 días
  • Atomic-Chat@AtomicBot-ai

    Aplicación de IA local y motor de inferencia para agentes. Ejecuta LLMs de pesos abiertos localmente: privado, 100% sin conexión en tu computadora. Únete a nuestro Discord: https://discord.com/invite/8wGSsvmg4V

    1413+20Variación de estrellas de los últimos 7 días
  • kitops@kitops-ml

    Una herramienta DevOps de código abierto de la CNCF para empaquetar y versionar modelos de IA/ML, conjuntos de datos, código y configuraciones en un artefacto OCI.

    1409+0Variación de estrellas de los últimos 7 días
  • locally-uncensored@PurpleDoubleD

    Estudio de IA local plug-and-play: chat sin censura, generación de imágenes y video, y agente de programación. Ejecuta LLM abliterados y ComfyUI 100% offline. Un solo instalador, sin Docker, sin nube.

    1351+185Variación de estrellas de los últimos 7 días
  • mlx-serve@ddalcu

    Servidor de inferencia LLM nativo para Apple Silicon. Compatible con la API de OpenAI y Anthropic. Sin Python. Incluye la aplicación MLX Core para macOS con chat, modo agente y llamada a herramientas.

    1115+245Variación de estrellas de los últimos 7 días
  • hf-mem@alvarobartt

    Una CLI escrita en Python para estimar los requisitos de memoria de inferencia de los modelos de Hugging Face.

    939+0Variación de estrellas de los últimos 7 días
  • LLM.swift@eastriverlee

    LLM.swift es una biblioteca simple y legible que permite interactuar fácilmente con modelos de lenguaje grandes de forma local en macOS, iOS, watchOS, tvOS y visionOS.

    874+3Variación de estrellas de los últimos 7 días
  • llama3.java@mukel

    Inferencia de Llama 3+ en Java puro.

    816+0Variación de estrellas de los últimos 7 días
  • Box@jegly

    La suite de IA del lado del cliente más avanzada y completamente offline disponible hoy en Android.

    812+15Variación de estrellas de los últimos 7 días
  • Herramienta de traducción de pantalla en tiempo real para Android sin necesidad de ROOT, ideal para juegos, novelas visuales y manga. Soporta OCR local y en la nube, LLM offline, múltiples servicios de traducción y síntesis de voz (TTS), con visualización directa sobre la pantalla.

    786+82Variación de estrellas de los últimos 7 días
  • yzma@hybridgroup

    Go con inteligencia propia: aplicaciones en Go que integran directamente llama.cpp para inferencia local mediante aceleración por hardware.

    594+16Variación de estrellas de los últimos 7 días
  • ComfyUI_VLM_nodes@gokayfem

    Nodos de ComfyUI para modelos de lenguaje visual: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Incluye detección de vocabulario abierto, segmentación SAM2/SAM3, razonamiento temporal de video, GGUF mediante llama.cpp y APIs de LLM/VLM alojadas.

    588-1Variación de estrellas de los últimos 7 días
  • search@kelindar

    Biblioteca de Go para búsqueda vectorial integrada e incrustaciones semánticas usando llama.cpp

    559+0Variación de estrellas de los últimos 7 días
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    548Variación de estrellas de los últimos 7 días
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501+7Variación de estrellas de los últimos 7 días
← Volver a temas