Pular para o conteúdo principal
buildradar
Sign in
Tópico · qwen

qwen

Repositórios de código aberto acompanhados marcados com qwen, ordenados por estrelas.

107 repositórios
  • SINQ@huawei-csl

    Bem-vindo ao repositório oficial do SINQ! Um método de quantização inovador, rápido e de alta qualidade projetado para tornar qualquer Large Language Model menor, preservando a precisão [ICML 2026]

    630+1Variação de estrelas nos últimos 7 dias
  • Swiftlet@leonickson1

    Swiftlet é um runtime Swift e Metal que executa grandes modelos Qwen Mixture-of-Experts localmente em dispositivos Apple, transmitindo pesos de especialistas do armazenamento, permitindo que modelos de 35B e 80B rodem com pouca RAM, inclusive no iPhone.

    628+58Variação de estrelas nos últimos 7 dias
  • ComfyUI-DyPE@wildminder

    ComfyUI DyPE+SEGA, permitindo geração de imagens 4K+ sem artefatos: Z-Image, Qwen, Flux, Krea2

    623+7Variação de estrelas nos últimos 7 dias
  • LLamaTuner@jianzhnie

    Fine-tuning fácil e eficiente de LLMs. (Suporta LLaMA, LLaMA2, LLaMA3, Qwen, Baichuan, GLM, Falcon). Treinamento e implantação eficientes de quantização para grandes modelos.

    621+0Variação de estrelas nos últimos 7 dias
  • harvester@wzdnzd

    Framework inteligente de aquisição de dados para GitHub e fontes da web

    605+2Variação de estrelas nos últimos 7 dias
  • 🔴 LISTA MUITO GRANDE DE FERRAMENTAS DE IA! 🔴 Lista com curadoria de ferramentas de IA - Atualizado em 2026

    578+5Variação de estrelas nos últimos 7 dias
  • 💭 一个可二次开发 Chat Bot 单轮对话 Web 端 MVP 原型模板, 基于 Vue 3, Vite8, TypeScript, Naive UI, Pinia(v3), UnoCSS 等主流技术构建, 🧤简单集成大模型 API, 采用单轮 AI 问答对话模式, 每次提问独立响应, 无需上下文, 支持 SSE 打字机效果流式输出, 集成 markdown-it Mermaid/KaTex/LaTex 公式高亮预览, 星火, 智谱, 硅基流动, Deepseek V4/V3/R1 深度思考推理模型预览, 兼容 <think> 标签, 包含蒸馏 skill 💼 易于定制和快速搭建 Chat 类大语言模型产品 (附示例截图)

    575+1Variação de estrelas nos últimos 7 dias
  • KuiperLLama@zjhellofss

    Projeto para recrutamento e estágios, guiando você na implementação do zero de um framework de inferência de LLM com suporte a Llama2/3 e Qwen2.5.

    573+1Variação de estrelas nos últimos 7 dias
  • Execute o Qwen3-TTS localmente no Mac (M1/M2/M3/M4). Clonagem de voz, design de voz e vozes personalizadas. 100% offline usando MLX.

    561+4Variação de estrelas nos últimos 7 dias
  • qwen600@yassa9

    Mini motor de inferência estático e suckless para qwen3-0.6B, lote único (single batch) e exclusivo para CUDA.

    559+0Variação de estrelas nos últimos 7 dias
  • MARTI@TsinghuaC3I

    Um framework para treinamento reforçado e inferência multiagente baseado em LLM

    555+3Variação de estrelas nos últimos 7 dias
  • FlashRT@flashrt-project

    FlashRT é um motor de inferência em tempo real de alto desempenho para cargas de trabalho de IA de lote pequeno e sensíveis à latência. A integração principal é o controle VLA de produção para Pi0, Pi0.5, GROOT N1.6 e Pi0-FAST. Também suporta LLM, por exemplo, qwen3.6-27B

    553+18Variação de estrelas nos últimos 7 dias
  • eLLM@lucienhuangfu

    eLLM: Run Long-Horizon Inference Faster on CPUs Than on GPUs

    552Variação de estrelas nos últimos 7 dias
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    549Variação de estrelas nos últimos 7 dias
  • mco@mco-org

    CLI-first orchestration for AI coding agents: run selected agents and models in parallel, compare raw answers, and coordinate review or implementation workflows.

    514+8Variação de estrelas nos últimos 7 dias
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    507Variação de estrelas nos últimos 7 dias
  • A curated list of awesome tools, extensions, and resources for Gemini CLI.

    503Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos