gguf
gguf 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 gguf 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 gguf 태그가 달린 리포지토리예요.
- #1
루트 권한이 필요 없는 오픈소스 Android 실시간 화면 번역 도구. 게임, 비주얼 노벨, 만화에 적합하며 온디바이스 및 클라우드 OCR, 오프라인 LLM, 다중 번역 서비스, TTS를 지원하고 화면 위에 직접 번역문을 표시합니다.
★ 768 - #2
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543 - #3
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501
- #1★ 34,759+265최근 7일 스타 변화
- #2★ 25,859+113최근 7일 스타 변화
- #3
⚡ 순수 Rust WebGPU 추론 엔진 — OpenAI API 호환, GGUF 네이티브, 모든 GPU에서 실행. Python 없음. llama.cpp 없음. 단일 바이너리.
★ 5,816+6최근 7일 스타 변화 - #4★ 4,929+1,365최근 7일 스타 변화
- #5
오프라인 AI를 위한 스위스 아미 나이프. 휴대폰이나 Mac에서 GGUF LLM, 비전, Whisper 음성 인식, Stable Diffusion, 툴 호출, 로컬 네트워크 서버를 활용해 채팅하고, 보고, 말하고, 이미지를 생성하세요. CPU, GPU, NPU에서 실행됩니다. 계정도, API 키도 없으며 데이터가 기기 외부로 전혀 유출되지 않습니다.
★ 3,038+17최근 7일 스타 변화 - #6
Maid는 로컬에서는 llama.cpp 모델과 연동하고, 원격으로는 Anthropic, DeepSeek, Ollama, Mistral, OpenAI 모델과 통신할 수 있는 무료 오픈소스 애플리케이션입니다.
★ 2,656+1최근 7일 스타 변화 - #7
Ollama 핸즈온, CPU로 거대 언어 모델 배포하기, 온라인 읽기 주소: https://datawhalechina.github.io/handy-ollama/
★ 2,516+3최근 7일 스타 변화 - #8
로컬 우선 AI 에이전트. 로컬 AI 모델에 최적화됨. 긴 컨텍스트 윈도우. 적절한 도구 호출. 기기에서 비공개로 실행됨.
★ 2,452+0최근 7일 스타 변화 - #9
ComfyUI의 LLM Agent Framework는 MCP 서버, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 및 FLUX 프롬프트 노드를 포함하며, Feishu와 Discord에 액세스하고, o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi, doubao와 같은 유사한 openai / aisuite 인터페이스를 가진 모든 LLM에 적응합니다. llama-3.3 Janus-Pro, Linkage graphRAG와 같은 로컬 LLM, VLM, GGUF에 적응합니다.
★ 2,348+5최근 7일 스타 변화 - #10
llama.cpp의 Node.js 바인딩을 사용하여 로컬 머신에서 AI 모델을 실행하고 생성 수준에서 JSON 스키마 강제 적용
★ 2,170+4최근 7일 스타 변화 - #11
16개 이상의 모델 계열을 지원하는 ggml 음성 인식 추론
★ 1,872+19최근 7일 스타 변화 - #12★ 1,835-1최근 7일 스타 변화
- #13
고정밀 저비트 LLM 추론을 위한 SOTA 양자화 알고리즘. CPU/XPU/CUDA에 최적화되었으며, 다양한 데이터 타입을 지원하고 vLLM, SGLang, Transformers와 완벽히 호환됩니다.
★ 1,599+8최근 7일 스타 변화 - #14
FunASR, vLLM, 스트리밍, llama.cpp 런타임을 지원하는 중국어, 방언, 사투리 및 다국어 음성을 위한 오픈소스 LLM 기반 ASR 모델 패밀리
★ 1,512+10최근 7일 스타 변화 - #15★ 1,437+0최근 7일 스타 변화
- #16
에이전트를 위한 로컬 AI 앱 및 추론 엔진. 비공개로 컴퓨터에서 100% 오프라인으로 오픈 웨이트 LLM을 로컬에서 실행하세요. Discord 참여하기: https://discord.com/invite/8wGSsvmg4V
★ 1,413+20최근 7일 스타 변화 - #17★ 1,409+0최근 7일 스타 변화
- #18
플러그앤플레이 방식의 로컬 AI 스튜디오: 검열 없는 채팅, 이미지 및 비디오 생성, 코딩 에이전트. abliterated LLM + ComfyUI 100% 오프라인 구동. 원 클릭 설치, Docker 및 클라우드 불필요.
★ 1,351+185최근 7일 스타 변화 - #19
Apple Silicon용 네이티브 LLM 추론 서버. OpenAI 및 Anthropic API 호환. Python 미사용. 채팅, 에이전트 모드, 도구 호출을 지원하는 MLX Core macOS 앱 포함.
★ 1,115+245최근 7일 스타 변화 - #20★ 939+0최근 7일 스타 변화
- #21
LLM.swift는 macOS, iOS, watchOS, tvOS 및 visionOS에서 로컬 대규모 언어 모델과 쉽게 상호 작용할 수 있도록 돕는 간결하고 읽기 쉬운 라이브러리입니다
★ 874+3최근 7일 스타 변화 - #22
순수 Java로 구현한 Llama 3+ 추론 엔진
★ 816+0최근 7일 스타 변화 - #23★ 803+15최근 7일 스타 변화
- #24
루트 권한이 필요 없는 오픈소스 Android 실시간 화면 번역 도구. 게임, 비주얼 노벨, 만화에 적합하며 온디바이스 및 클라우드 OCR, 오프라인 LLM, 다중 번역 서비스, TTS를 지원하고 화면 위에 직접 번역문을 표시합니다.
★ 768+71최근 7일 스타 변화 - #25★ 589+14최근 7일 스타 변화
- #26
Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V 등 비전-언어 모델을 위한 ComfyUI 노드입니다. 오픈 어휘 탐지, SAM2/SAM3 세그멘테이션, 비디오 시간 추론, llama.cpp 기반 GGUF 및 호스팅된 LLM/VLM API를 지원합니다.
★ 588-1최근 7일 스타 변화 - #27★ 559+0최근 7일 스타 변화
- #28
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543—최근 7일 스타 변화 - #29
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501+7최근 7일 스타 변화