qwen
Repositórios de código aberto acompanhados marcados com qwen, ordenados por estrelas.
- #91
Bem-vindo ao repositório oficial do SINQ! Um método de quantização inovador, rápido e de alta qualidade projetado para tornar qualquer Large Language Model menor, preservando a precisão [ICML 2026]
★ 630+1Variação de estrelas nos últimos 7 dias - #92
Swiftlet é um runtime Swift e Metal que executa grandes modelos Qwen Mixture-of-Experts localmente em dispositivos Apple, transmitindo pesos de especialistas do armazenamento, permitindo que modelos de 35B e 80B rodem com pouca RAM, inclusive no iPhone.
★ 628+58Variação de estrelas nos últimos 7 dias - #93
ComfyUI DyPE+SEGA, permitindo geração de imagens 4K+ sem artefatos: Z-Image, Qwen, Flux, Krea2
★ 623+7Variação de estrelas nos últimos 7 dias - #94
Fine-tuning fácil e eficiente de LLMs. (Suporta LLaMA, LLaMA2, LLaMA3, Qwen, Baichuan, GLM, Falcon). Treinamento e implantação eficientes de quantização para grandes modelos.
★ 621+0Variação de estrelas nos últimos 7 dias - #95★ 605+2Variação de estrelas nos últimos 7 dias
- #96
🔴 LISTA MUITO GRANDE DE FERRAMENTAS DE IA! 🔴 Lista com curadoria de ferramentas de IA - Atualizado em 2026
★ 578+5Variação de estrelas nos últimos 7 dias - #97
💭 一个可二次开发 Chat Bot 单轮对话 Web 端 MVP 原型模板, 基于 Vue 3, Vite8, TypeScript, Naive UI, Pinia(v3), UnoCSS 等主流技术构建, 🧤简单集成大模型 API, 采用单轮 AI 问答对话模式, 每次提问独立响应, 无需上下文, 支持 SSE 打字机效果流式输出, 集成 markdown-it Mermaid/KaTex/LaTex 公式高亮预览, 星火, 智谱, 硅基流动, Deepseek V4/V3/R1 深度思考推理模型预览, 兼容 <think> 标签, 包含蒸馏 skill 💼 易于定制和快速搭建 Chat 类大语言模型产品 (附示例截图)
★ 575+1Variação de estrelas nos últimos 7 dias - #98
Projeto para recrutamento e estágios, guiando você na implementação do zero de um framework de inferência de LLM com suporte a Llama2/3 e Qwen2.5.
★ 573+1Variação de estrelas nos últimos 7 dias - #99
Execute o Qwen3-TTS localmente no Mac (M1/M2/M3/M4). Clonagem de voz, design de voz e vozes personalizadas. 100% offline usando MLX.
★ 561+4Variação de estrelas nos últimos 7 dias - #100
Mini motor de inferência estático e suckless para qwen3-0.6B, lote único (single batch) e exclusivo para CUDA.
★ 559+0Variação de estrelas nos últimos 7 dias - #101★ 555+3Variação de estrelas nos últimos 7 dias
- #102
FlashRT é um motor de inferência em tempo real de alto desempenho para cargas de trabalho de IA de lote pequeno e sensíveis à latência. A integração principal é o controle VLA de produção para Pi0, Pi0.5, GROOT N1.6 e Pi0-FAST. Também suporta LLM, por exemplo, qwen3.6-27B
★ 553+18Variação de estrelas nos últimos 7 dias - #103★ 552—Variação de estrelas nos últimos 7 dias
- #104
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 549—Variação de estrelas nos últimos 7 dias - #105
CLI-first orchestration for AI coding agents: run selected agents and models in parallel, compare raw answers, and coordinate review or implementation workflows.
★ 514+8Variação de estrelas nos últimos 7 dias - #106
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 507—Variação de estrelas nos últimos 7 dias - #107
A curated list of awesome tools, extensions, and resources for Gemini CLI.
★ 503—Variação de estrelas nos últimos 7 dias