qwen
Repositori open source terpantau bertanda qwen, diurutkan berdasarkan bintang.
- #91
Selamat datang di repositori resmi SINQ! Metode kuantisasi baru, cepat, dan berkualitas tinggi yang dirancang untuk membuat Large Language Model apa pun menjadi lebih kecil dengan tetap menjaga akurasi [ICML 2026]
★ 630+1Perubahan bintang dalam 7 hari terakhir - #92
Swiftlet adalah runtime Swift dan Metal yang menjalankan model Qwen Mixture-of-Experts secara lokal di perangkat Apple dengan melakukan streaming bobot expert dari penyimpanan, memungkinkan model 35B dan 80B berjalan dengan RAM rendah, termasuk di iPhone.
★ 628+54Perubahan bintang dalam 7 hari terakhir - #93
ComfyUI DyPE+SEGA, memungkinkan pembuatan gambar 4K+ bebas artefak: Z-Image, Qwen, Flux, Krea2
★ 622+7Perubahan bintang dalam 7 hari terakhir - #94
Finetuning LLM yang mudah dan efisien. (Mendukung LLama, LLama2, LLama3, Qwen, Baichuan, GLM, Falcon) Pelatihan dan deployment kuantisasi efisien untuk model bahasa besar.
★ 621+0Perubahan bintang dalam 7 hari terakhir - #95★ 605+2Perubahan bintang dalam 7 hari terakhir
- #96
🔴 DAFTAR ALAT AI YANG SANGAT LENGKAP! 🔴 Daftar kurasi alat AI - Diperbarui tahun 2026.
★ 577+5Perubahan bintang dalam 7 hari terakhir - #97
💭 一个可二次开发 Chat Bot 单轮对话 Web 端 MVP 原型模板, 基于 Vue 3, Vite8, TypeScript, Naive UI, Pinia(v3), UnoCSS 等主流技术构建, 🧤简单集成大模型 API, 采用单轮 AI 问答对话模式, 每次提问独立响应, 无需上下文, 支持 SSE 打字机效果流式输出, 集成 markdown-it Mermaid/KaTex/LaTex 公式高亮预览, 星火, 智谱, 硅基流动, Deepseek V4/V3/R1 深度思考推理模型预览, 兼容 <think> 标签, 包含蒸馏 skill 💼 易于定制和快速搭建 Chat 类大语言模型产品 (附示例截图)
★ 575+0Perubahan bintang dalam 7 hari terakhir - #98
Proyek bagus untuk rekrutmen kampus, rekrutmen musim gugur, musim semi, dan magang, membimbing Anda membangun kerangka kerja inferensi model besar dari awal yang mendukung LLama2/3 dan Qwen2.5.
★ 573+1Perubahan bintang dalam 7 hari terakhir - #99
Jalankan konversi teks-ke-suara Qwen3-TTS secara lokal di Mac (M1/M2/M3/M4). Kloning suara, desain suara, suara kustom. 100% offline menggunakan MLX.
★ 561+4Perubahan bintang dalam 7 hari terakhir - #100★ 559+0Perubahan bintang dalam 7 hari terakhir
- #101★ 555+2Perubahan bintang dalam 7 hari terakhir
- #102
FlashRT adalah mesin inferensi waktu nyata berkinerja tinggi untuk beban kerja AI batch kecil yang sensitif terhadap latensi. Integrasi utamanya adalah kontrol VLA produksi untuk Pi0, Pi0.5, GROOT N1.6, dan Pi0-FAST. Juga mendukung LLM seperti qwen3.6-27B
★ 553+15Perubahan bintang dalam 7 hari terakhir - #103
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 548—Perubahan bintang dalam 7 hari terakhir - #104★ 526—Perubahan bintang dalam 7 hari terakhir
- #105
CLI-first orchestration for AI coding agents: run selected agents and models in parallel, compare raw answers, and coordinate review or implementation workflows.
★ 514+8Perubahan bintang dalam 7 hari terakhir - #106
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 507—Perubahan bintang dalam 7 hari terakhir - #107
A curated list of awesome tools, extensions, and resources for Gemini CLI.
★ 503—Perubahan bintang dalam 7 hari terakhir