qwen3
Repositórios de código aberto acompanhados marcados com qwen3, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de qwen3 no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com qwen3.
- #1
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1.191 - #2
Qwen3.8-27B (bf16) on a free Kaggle TPU: OpenAI-compatible endpoint, 262k context, ~130 tok/s, works with Claude Code, Codex, Opencode and Pi.
★ 142
- #1
Um mecanismo de inferência e atendimento de alto rendimento e eficiente em memória para LLMs
★ 90.817+402Variação de estrelas nos últimos 7 dias - #2
🔥 MaxKB é uma plataforma de código aberto para construir agentes de nível empresarial. Plataforma de agentes de nível empresarial poderosa e fácil de usar de código aberto.
★ 22.699+52Variação de estrelas nos últimos 7 dias - #3
Use PEFT ou Full-parameter para CPT/SFT/DPO/GRPO em mais de 600 LLMs (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) e mais de 300 MLLMs (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) (AAAI 2025).
★ 15.488+88Variação de estrelas nos últimos 7 dias - #4
Agent Reinforcement Trainer: treine agentes de múltiplas etapas para tarefas do mundo real usando GRPO. Dê aos seus agentes treinamento prático. Aprendizado por reforço para Qwen3.6, GPT-OSS, Llama e muito mais!
★ 10.689+10Variação de estrelas nos últimos 7 dias - #5
Execute LLMs e VLMs de ponta localmente em dispositivos Qualcomm via NPU, GPU e CPU com poucas linhas de código
★ 8.347+9Variação de estrelas nos últimos 7 dias - #6
Alternativa de código aberto para pesquisa profunda, raciocínio e busca em dados privados. Escrito em Python.
★ 8.251+20Variação de estrelas nos últimos 7 dias - #7
📚 Uma lista curada de artigos incríveis sobre inferência de LLM/VLM com código: Flash-Attention, Paged-Attention, WINT8/4, paralelismo, etc. 🎉
★ 5.482+3Variação de estrelas nos últimos 7 dias - #8
Um aplicativo nativo para macOS que permite aos usuários conversar com um LLM local, capaz de responder com informações de arquivos, pastas e sites no seu Mac sem instalar nenhum software adicional. Desenvolvido com llama.cpp.
★ 3.312-2Variação de estrelas nos últimos 7 dias - #9
Gerador de legendas ASR/STT. Utiliza Qwen3-ASR, LLM local, Whisper e TEN-VAD. Robusto contra ruído para JAV.
★ 2.196+17Variação de estrelas nos últimos 7 dias - #10
kubewall - Painel de controle Kubernetes de binário único com gerenciamento multi-cluster e integração de IA. (OpenAI / Claude 4 / Gemini / DeepSeek / OpenRouter / Ollama / Qwen / LMStudio)
★ 1.933+3Variação de estrelas nos últimos 7 dias - #11
O Chat2API permite acesso de custo zero aos principais modelos de IA aproveitando as UIs web oficiais. Suporta provedores como DeepSeek, GLM, Kimi, MiniMax, Qwen e Z.ai, integrando-se perfeitamente com ferramentas como openlcaw, Cline e Roo-Code.
★ 1.560+16Variação de estrelas nos últimos 7 dias - #12
Fale com seu Mac, consulte seus documentos, sem necessidade de nuvem. IA de voz e RAG executados localmente no dispositivo.
★ 1.542+0Variação de estrelas nos últimos 7 dias - #13
Ferramenta baseada em IA para triagem eficiente de resumos e PDFs em revisões sistemáticas.
★ 1.328+0Variação de estrelas nos últimos 7 dias - #14
Framework totalmente aberto para treinamento multimodal democratizado
★ 1.195+1Variação de estrelas nos últimos 7 dias - #15
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1.191+285Variação de estrelas nos últimos 7 dias - #16
🎬 Gere imagens a partir de qualquer ponto de vista da câmera via controle interativo 3D. Arraste a câmera no espaço 3D ou use os seletores para definir azimute/elevação/distância e gere a imagem. Desenvolvido com Three.js + Gradio, interface bilíngue ZH/EN.
★ 942+188Variação de estrelas nos últimos 7 dias - #17
Gateway de API para grandes modelos de IA: um sistema de gerenciamento e distribuição agregada de interfaces de IA. Converte diversos modelos em uma interface unificada compatível com OpenAI, Claude e Gemini. Ideal para gestão interna e distribuição de chaves (key management) para indivíduos ou empresas. Suporta modelos como Gemini, Claude, Qwen3, Kimi-K2, Doubao, entre outros. Oferece executável único, imagem Docker, implantação com um clique, pronto para uso e totalmente open source. Baseado em New-API e One-API, integra todas as funcionalidades e diversos plugins de terceiros.
★ 916+8Variação de estrelas nos últimos 7 dias - #18
Biblioteca de treinamento distribuído nativo em PyTorch para LLMs/VLMs com suporte imediato ao Hugging Face.
★ 906+24Variação de estrelas nos últimos 7 dias - #19★ 855+15Variação de estrelas nos últimos 7 dias
- #20
🚀🚀🚀Uma coleção de projetos públicos incríveis sobre Modelos de Linguagem de Grande Escala (LLM), Modelos de Visão e Linguagem (VLM), Visão, Linguagem e Ação (VLA), Conteúdo Gerado por IA (AIGC), além de conjuntos de dados e aplicativos relacionados.
★ 815+1Variação de estrelas nos últimos 7 dias - #21
MimikaStudio - Um aplicativo local-first para macOS (Apple Silicon) + Suporte a MCP Agêntico
★ 731+0Variação de estrelas nos últimos 7 dias - #22
Mecanismo de inferência de LLM em Pure Rust + CUDA — sem PyTorch, compatível com OpenAI, serve de Qwen3 a Kimi-K2
★ 677+14Variação de estrelas nos últimos 7 dias - #23
Mini motor de inferência estático e suckless para qwen3-0.6B, lote único (single batch) e exclusivo para CUDA.
★ 559+0Variação de estrelas nos últimos 7 dias - #24★ 513+7Variação de estrelas nos últimos 7 dias