gguf
Các kho mã nguồn mở đang theo dõi được gắn thẻ gguf, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng gguf trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ gguf.
- #1
Công cụ dịch màn hình Android thời gian thực mã nguồn mở không cần ROOT, phù hợp cho trò chơi, tiểu thuyết hình ảnh và manga. Hỗ trợ OCR trên thiết bị và đám mây, LLM ngoại tuyến, nhiều dịch vụ dịch thuật, hiển thị bản dịch trên màn hình và chuyển văn bản thành giọng nói (TTS).
★ 768 - #2
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543 - #3
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501
- #1
Hàng trăm mô hình và nhà cung cấp. Một lệnh để tìm những gì chạy được trên phần cứng của bạn.
★ 34.759+265Thay đổi số sao trong 7 ngày qua - #2★ 25.859+113Thay đổi số sao trong 7 ngày qua
- #3
⚡ Công cụ suy luận WebGPU thuần Rust — tương thích OpenAI-API, gốc GGUF, chạy trên mọi GPU. Không Python. Không llama.cpp. File nhị phân đơn.
★ 5.816+6Thay đổi số sao trong 7 ngày qua - #4
Tinh chỉnh LLMs chỉ từ một YAML. Layer streaming đào tạo mô hình 8B trên GPU laptop 4 GB.
★ 4.929+1.365Thay đổi số sao trong 7 ngày qua - #5
Bộ công cụ đa năng cho AI ngoại tuyến. Trò chuyện, xem, nói chuyện và tạo hình ảnh trên điện thoại hoặc Mac — GGUF LLMs, thị giác máy tính, chuyển giọng nói thành văn bản Whisper, Stable Diffusion, gọi công cụ và máy chủ mạng nội bộ. Chạy trên CPU, GPU hoặc NPU của bạn. Không tài khoản, không khóa API, dữ liệu không rời khỏi thiết bị của bạn.
★ 3.038+17Thay đổi số sao trong 7 ngày qua - #6
Maid là một ứng dụng mã nguồn mở và miễn phí để giao tiếp với các mô hình llama.cpp cục bộ, và với các mô hình Anthropic, DeepSeek, Ollama, Mistral và OpenAI từ xa.
★ 2.656+1Thay đổi số sao trong 7 ngày qua - #7
Học thực hành Ollama, chạy triển khai LLM trên CPU, địa chỉ đọc trực tuyến: https://datawhalechina.github.io/handy-ollama/
★ 2.516+3Thay đổi số sao trong 7 ngày qua - #8
AI Agent ưu tiên cục bộ. Được tối ưu hóa cho các mô hình AI chạy trên thiết bị. Cửa sổ ngữ cảnh dài. Hỗ trợ gọi công cụ chính xác. Hoạt động riêng tư trên thiết bị của bạn.
★ 2.452+0Thay đổi số sao trong 7 ngày qua - #9
Framework LLM Agent trong ComfyUI bao gồm máy chủ MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 và các node nhắc lệnh FLUX, truy cập Feishu, discord, và tương thích với mọi LLM có giao diện tương tự OpenAI / aisuite như o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi, doubao. Tương thích với các LLM, VLM, GGUF chạy cục bộ như llama-3.3 Janus-Pro, Linkage graphRAG
★ 2.348+5Thay đổi số sao trong 7 ngày qua - #10
Chạy các mô hình AI cục bộ trên máy của bạn với node.js bindings cho llama.cpp. Áp đặt JSON schema lên đầu ra của mô hình ở cấp độ tạo văn bản.
★ 2.170+4Thay đổi số sao trong 7 ngày qua - #11
Suy luận chuyển giọng nói thành văn bản bằng ggml cho hơn 16 họ mô hình
★ 1.872+19Thay đổi số sao trong 7 ngày qua - #12★ 1.835-1Thay đổi số sao trong 7 ngày qua
- #13
Thuật toán lượng tử hóa SOTA cho suy luận LLM low-bit độ chính xác cao, được tối ưu hóa liền mạch cho CPU/XPU/CUDA, hỗ trợ đa kiểu dữ liệu và tương thích hoàn toàn với vLLM, SGLang và Transformers.
★ 1.599+8Thay đổi số sao trong 7 ngày qua - #14
Dòng mô hình ASR dựa trên LLM mã nguồn mở cho tiếng Trung, phương ngữ, tiếng địa phương và giọng nói đa ngôn ngữ, với các thời gian chạy FunASR, vLLM, streaming và llama.cpp.
★ 1.512+10Thay đổi số sao trong 7 ngày qua - #15★ 1.437+0Thay đổi số sao trong 7 ngày qua
- #16
Ứng dụng AI cục bộ và công cụ suy luận cho các tác nhân. Chạy các LLM mã nguồn mở cục bộ — riêng tư, 100% ngoại tuyến trên máy tính của bạn.
★ 1.413+20Thay đổi số sao trong 7 ngày qua - #17
Một công cụ DevOps mã nguồn mở từ CNCF dùng để đóng gói và quản lý phiên bản cho các mô hình AI/ML, tập dữ liệu, mã nguồn và cấu hình thành một OCI Artifact.
★ 1.409+0Thay đổi số sao trong 7 ngày qua - #18
Studio AI cục bộ cắm và chạy: trò chuyện không kiểm duyệt, tạo hình ảnh & video, tác nhân lập trình. Chạy các LLM đã loại bỏ kiểm duyệt + ComfyUI ngoại tuyến 100%. Một trình cài đặt duy nhất, không cần Docker, không cần đám mây.
★ 1.351+185Thay đổi số sao trong 7 ngày qua - #19
Máy chủ suy luận LLM gốc cho Apple Silicon. Tương thích với API OpenAI và Anthropic. Không sử dụng Python. Bao gồm ứng dụng MLX Core trên macOS với tính năng trò chuyện, chế độ đại lý và gọi công cụ.
★ 1.115+245Thay đổi số sao trong 7 ngày qua - #20
Giao diện dòng lệnh (CLI) để ước tính dung lượng bộ nhớ suy luận cho các mô hình Hugging Face, viết bằng Python.
★ 939+0Thay đổi số sao trong 7 ngày qua - #21
LLM.swift là một thư viện đơn giản và dễ đọc cho phép bạn tương tác cục bộ với các mô hình ngôn ngữ lớn trên macOS, iOS, watchOS, tvOS và visionOS.
★ 874+3Thay đổi số sao trong 7 ngày qua - #22
Suy luận Llama 3+ bằng Java thuần.
★ 816+0Thay đổi số sao trong 7 ngày qua - #23
Bộ công cụ AI phía máy khách (client-side) hoạt động hoàn toàn ngoại tuyến tiên tiến nhất trên Android hiện nay.
★ 803+15Thay đổi số sao trong 7 ngày qua - #24
Công cụ dịch màn hình Android thời gian thực mã nguồn mở không cần ROOT, phù hợp cho trò chơi, tiểu thuyết hình ảnh và manga. Hỗ trợ OCR trên thiết bị và đám mây, LLM ngoại tuyến, nhiều dịch vụ dịch thuật, hiển thị bản dịch trên màn hình và chuyển văn bản thành giọng nói (TTS).
★ 768+71Thay đổi số sao trong 7 ngày qua - #25
Go với trí tuệ của riêng bạn - Các ứng dụng Go tích hợp trực tiếp llama.cpp để suy luận cục bộ sử dụng tăng tốc phần cứng.
★ 589+14Thay đổi số sao trong 7 ngày qua - #26
Các node ComfyUI dành cho mô hình ngôn ngữ - thị giác: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Cùng với khả năng phát hiện từ vựng mở, phân đoạn SAM2/SAM3, suy luận thời gian trong video, GGUF qua llama.cpp và các API LLM/VLM được lưu trữ.
★ 588-1Thay đổi số sao trong 7 ngày qua - #27★ 559+0Thay đổi số sao trong 7 ngày qua
- #28
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543—Thay đổi số sao trong 7 ngày qua - #29
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501+7Thay đổi số sao trong 7 ngày qua