qwen
Các kho mã nguồn mở đang theo dõi được gắn thẻ qwen, sắp xếp theo số sao.
- #91
Kho lưu trữ chính thức của SINQ! Một phương pháp lượng tử hóa mới, nhanh và chất lượng cao được thiết kế để làm cho bất kỳ Large Language Model nào nhỏ hơn trong khi vẫn duy trì độ chính xác [ICML 2026].
★ 630+1Thay đổi số sao trong 7 ngày qua - #92
Swiftlet là môi trường thực thi Swift và Metal cho phép chạy cục bộ các mô hình Qwen Mixture-of-Experts lớn trên thiết bị Apple bằng cách truyền tải trọng số chuyên gia từ bộ nhớ, giúp các mô hình 35B và 80B có thể chạy với dung lượng RAM thấp, bao gồm cả trên iPhone.
★ 628+58Thay đổi số sao trong 7 ngày qua - #93
ComfyUI DyPE+SEGA, cho phép tạo ảnh 4K+ không bị nhiễu: Z-Image, Qwen, Flux, Krea2
★ 622+7Thay đổi số sao trong 7 ngày qua - #94
Tinh chỉnh LLM dễ dàng và hiệu quả (Hỗ trợ LLama, LLama2, LLama3, Qwen, Baichuan, GLM, Falcon)
★ 621+0Thay đổi số sao trong 7 ngày qua - #95★ 605+2Thay đổi số sao trong 7 ngày qua
- #96
🔴 DANH SÁCH CÔNG CỤ AI CỰC LỚN! 🔴 Danh sách các công cụ AI được tuyển chọn - Cập nhật năm 2026
★ 577+5Thay đổi số sao trong 7 ngày qua - #97
Mẫu nguyên mẫu MVP web cho Chat Bot đơn vòng, có thể tùy chỉnh. Được xây dựng dựa trên Vue 3, Vite8, TypeScript, Naive UI, Pinia(v3), UnoCSS. Tích hợp API mô hình lớn, hỗ trợ SSE streaming, markdown-it, Mermaid/KaTex/LaTex, hỗ trợ các mô hình như Deepseek V4/V3/R1, tương thích với thẻ <think>.
★ 575+1Thay đổi số sao trong 7 ngày qua - #98
Dự án thực hành cho sinh viên, hướng dẫn tự xây dựng khung suy luận mô hình lớn hỗ trợ LLama2/3 và Qwen2.5 từ con số không.
★ 573+1Thay đổi số sao trong 7 ngày qua - #99
Chạy Qwen3-TTS chuyển văn bản thành giọng nói cục bộ trên Mac (M1/M2/M3/M4). Hỗ trợ nhân bản giọng nói, thiết kế giọng nói, giọng nói tùy chỉnh. Hoạt động 100% ngoại tuyến bằng MLX.
★ 561+4Thay đổi số sao trong 7 ngày qua - #100★ 559+0Thay đổi số sao trong 7 ngày qua
- #101★ 555+3Thay đổi số sao trong 7 ngày qua
- #102
FlashRT là công cụ suy luận thời gian thực hiệu năng cao cho các tác vụ AI có độ trễ thấp và batch nhỏ. Tích hợp chủ đạo bao gồm điều khiển VLA sản xuất cho Pi0, Pi0.5, GROOT N1.6 và Pi0-FAST. Ngoài ra còn hỗ trợ LLM như qwen3.6-27B
★ 553+18Thay đổi số sao trong 7 ngày qua - #103★ 549—Thay đổi số sao trong 7 ngày qua
- #104
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 548—Thay đổi số sao trong 7 ngày qua - #105
CLI-first orchestration for AI coding agents: run selected agents and models in parallel, compare raw answers, and coordinate review or implementation workflows.
★ 514+8Thay đổi số sao trong 7 ngày qua - #106
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 507—Thay đổi số sao trong 7 ngày qua - #107
A curated list of awesome tools, extensions, and resources for Gemini CLI.
★ 503—Thay đổi số sao trong 7 ngày qua