gguf
Repositori open source terpantau bertanda gguf, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan gguf di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda gguf.
- #1
Alat penerjemah layar real-time Android sumber terbuka tanpa ROOT, cocok untuk game, novel visual, dan manga. Mendukung OCR perangkat dan cloud, LLM offline, berbagai layanan terjemahan, dan text-to-speech (TTS), dengan terjemahan yang langsung ditampilkan di layar.
★ 768 - #2
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543 - #3
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501
- #1
Ratusan model & penyedia. Satu perintah untuk menemukan apa yang berjalan di perangkat keras Anda.
★ 34.759+265Perubahan bintang dalam 7 hari terakhir - #2★ 25.859+113Perubahan bintang dalam 7 hari terakhir
- #3
⚡ Mesin inferensi WebGPU berbasis Pure-Rust — Kompatibel dengan OpenAI-API, mendukung GGUF secara native, berjalan di GPU apa pun. Tanpa Python. Tanpa llama.cpp. Berupa biner tunggal.
★ 5.816+6Perubahan bintang dalam 7 hari terakhir - #4
Fine-tune LLM dari satu file YAML. Streaming layer melatih model 8B pada GPU laptop 4 GB.
★ 4.929+1.365Perubahan bintang dalam 7 hari terakhir - #5
Pisau lipat Swiss untuk AI offline. Mengobrol, melihat, berbicara, dan menghasilkan gambar di ponsel atau Mac Anda — mendukung LLM GGUF, visi, pengenalan suara Whisper, Stable Diffusion, pemanggilan alat, dan server jaringan lokal. Berjalan di CPU, GPU, atau NPU Anda. Tanpa akun, tanpa kunci API, data tidak keluar dari perangkat Anda.
★ 3.038+17Perubahan bintang dalam 7 hari terakhir - #6
Maid adalah aplikasi sumber terbuka gratis untuk berinteraksi dengan model llama.cpp secara lokal, serta model Anthropic, DeepSeek, Ollama, Mistral, dan OpenAI secara jarak jauh.
★ 2.656+1Perubahan bintang dalam 7 hari terakhir - #7
Belajar Ollama secara praktis, menjalankan deployment model besar di CPU, baca daring di: https://datawhalechina.github.io/handy-ollama/
★ 2.516+3Perubahan bintang dalam 7 hari terakhir - #8
AI Agent Local First. Dioptimalkan untuk model AI lokal. Jendela konteks panjang. Pemanggilan alat yang tepat. Berjalan secara pribadi di perangkat Anda.
★ 2.452+0Perubahan bintang dalam 7 hari terakhir - #9
Framework Agen LLM di ComfyUI mencakup server MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0, dan node prompt FLUX, akses ke Feishu, discord, serta beradaptasi dengan semua LLM dengan antarmuka serupa openai / aisuite, seperti o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi, doubao. Diadaptasi untuk LLM lokal, VLM, GGUF seperti llama-3.3, Janus-Pro, dan Linkage graphRAG
★ 2.348+5Perubahan bintang dalam 7 hari terakhir - #10
Jalankan model AI secara lokal di mesin Anda dengan binding node.js untuk llama.cpp. Terapkan skema JSON pada output model di tingkat generasi
★ 2.170+4Perubahan bintang dalam 7 hari terakhir - #11
Inferensi speech-to-text ggml untuk 16+ keluarga model
★ 1.872+19Perubahan bintang dalam 7 hari terakhir - #12★ 1.835-1Perubahan bintang dalam 7 hari terakhir
- #13
Algoritma kuantisasi SOTA untuk inferensi LLM bit-rendah dengan akurasi tinggi, dioptimalkan secara mulus untuk CPU/XPU/CUDA, dengan dukungan berbagai tipe data dan kompatibilitas penuh dengan vLLM, SGLang, dan Transformers.
★ 1.599+8Perubahan bintang dalam 7 hari terakhir - #14
Keluarga model ASR berbasis LLM open-source untuk bahasa Mandarin, dialek, aksen, dan ucapan multilingual, lengkap dengan runtime FunASR, vLLM, streaming, dan llama.cpp.
★ 1.512+10Perubahan bintang dalam 7 hari terakhir - #15★ 1.437+0Perubahan bintang dalam 7 hari terakhir
- #16
Aplikasi AI lokal dan mesin inferensi untuk agen. Jalankan LLM bobot-terbuka secara lokal — privat, 100% offline di komputer Anda. Bergabunglah dengan Discord kami: https://discord.com/invite/8wGSsvmg4V
★ 1.413+20Perubahan bintang dalam 7 hari terakhir - #17
Alat DevOps sumber terbuka dari CNCF untuk memaketkan dan melakukan versi pada model AI/ML, dataset, kode, serta konfigurasi ke dalam OCI Artifact.
★ 1.409+0Perubahan bintang dalam 7 hari terakhir - #18
Studio AI lokal siap pakai: obrolan tanpa sensor, pembuatan gambar & video, agen koding. Menjalankan LLM abliterated + ComfyUI 100% secara offline. Satu penginstal, tanpa Docker, tanpa cloud.
★ 1.351+185Perubahan bintang dalam 7 hari terakhir - #19
Server inferensi LLM native untuk Apple Silicon. Kompatibel dengan API OpenAI + Anthropic. Tanpa Python. Termasuk aplikasi macOS MLX Core dengan obrolan, mode agen, dan pemanggilan alat.
★ 1.115+245Perubahan bintang dalam 7 hari terakhir - #20
CLI untuk memperkirakan kebutuhan memori inferensi untuk model Hugging Face, ditulis dengan Python.
★ 939+0Perubahan bintang dalam 7 hari terakhir - #21
LLM.swift adalah pustaka yang sederhana dan mudah dibaca yang memungkinkan Anda berinteraksi dengan model bahasa besar secara lokal dengan mudah untuk macOS, iOS, watchOS, tvOS, dan visionOS.
★ 874+3Perubahan bintang dalam 7 hari terakhir - #22
Inferensi Llama 3+ dalam Java murni.
★ 816+0Perubahan bintang dalam 7 hari terakhir - #23★ 803+15Perubahan bintang dalam 7 hari terakhir
- #24
Alat penerjemah layar real-time Android sumber terbuka tanpa ROOT, cocok untuk game, novel visual, dan manga. Mendukung OCR perangkat dan cloud, LLM offline, berbagai layanan terjemahan, dan text-to-speech (TTS), dengan terjemahan yang langsung ditampilkan di layar.
★ 768+82Perubahan bintang dalam 7 hari terakhir - #25
Gunakan kecerdasan Anda sendiri - Aplikasi Go yang secara langsung mengintegrasikan llama.cpp untuk inferensi lokal menggunakan akselerasi perangkat keras.
★ 589+16Perubahan bintang dalam 7 hari terakhir - #26
Node ComfyUI untuk model vision-language: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Ditambah deteksi open-vocabulary, segmentasi SAM2/SAM3, penalaran temporal video, GGUF melalui llama.cpp, dan API LLM/VLM yang dihost.
★ 588-1Perubahan bintang dalam 7 hari terakhir - #27
Pustaka Go untuk pencarian vektor tersemat dan embedding semantik menggunakan llama.cpp
★ 559+0Perubahan bintang dalam 7 hari terakhir - #28
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543—Perubahan bintang dalam 7 hari terakhir - #29
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501+7Perubahan bintang dalam 7 hari terakhir