qwen3
Dépôts open source suivis étiquetés qwen3, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de qwen3 sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés qwen3.
- #1
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1 251 - #2
Qwen3.8-27B (bf16) on a free Kaggle TPU: OpenAI-compatible endpoint, 262k context, ~130 tok/s, works with Claude Code, Codex, Opencode and Pi.
★ 146
- #1
Un moteur d'inférence et de service à haut débit et économe en mémoire pour les LLM
★ 90 817+0Évolution des étoiles sur les 7 derniers jours - #2
MaxKB est une plateforme open source pour la création d'agents de niveau entreprise.
★ 22 699+0Évolution des étoiles sur les 7 derniers jours - #3
Utilisez PEFT ou le paramétrage complet pour CPT/SFT/DPO/GRPO sur plus de 600 LLM et 300 MLLM (AAAI 2025).
★ 15 488+0Évolution des étoiles sur les 7 derniers jours - #4
Agent Reinforcement Trainer : entraînez des agents multi-étapes pour des tâches réelles via GRPO. Offrez une formation en cours d'emploi à vos agents. Apprentissage par renforcement pour Qwen3.6, GPT-OSS, Llama et plus encore.
★ 10 689+0Évolution des étoiles sur les 7 derniers jours - #5
Exécutez des LLM et VLM de pointe localement sur des appareils Qualcomm via NPU, GPU et CPU avec quelques lignes de code.
★ 8 347+0Évolution des étoiles sur les 7 derniers jours - #6
Alternative open source de recherche approfondie à Reason, permettant d'effectuer des recherches sur des données privées. Écrit en Python.
★ 8 251+0Évolution des étoiles sur les 7 derniers jours - #7
Liste organisée d'articles de recherche sur l'inférence LLM/VLM avec code : Flash-Attention, Paged-Attention, WINT8/4, parallélisme, etc.
★ 5 482+0Évolution des étoiles sur les 7 derniers jours - #8
Une application macOS native permettant de discuter avec un LLM local capable de répondre à partir de fichiers, dossiers et sites web sur votre Mac sans installation supplémentaire. Propulsé par llama.cpp.
★ 3 312+0Évolution des étoiles sur les 7 derniers jours - #9
Générateur de sous-titres ASR/STT. Utilise Qwen3-ASR, LLM local, Whisper et TEN-VAD. Robuste face au bruit pour JAV.
★ 2 196+0Évolution des étoiles sur les 7 derniers jours - #10
kubewall - Tableau de bord Kubernetes en binaire unique avec gestion multi-cluster et intégration IA (OpenAI / Claude 4 / Gemini / DeepSeek / OpenRouter / Ollama / Qwen / LMStudio).
★ 1 933+0Évolution des étoiles sur les 7 derniers jours - #11
Chat2API permet un accès sans coût aux principaux modèles d'IA en exploitant les interfaces web officielles. Il prend en charge des fournisseurs tels que DeepSeek, GLM, Kimi, MiniMax, Qwen et Z.ai, et s'intègre parfaitement à des outils comme openlcaw, Cline et Roo-Code.
★ 1 560+0Évolution des étoiles sur les 7 derniers jours - #12
Interagissez avec votre Mac et interrogez vos documents sans cloud. IA vocale locale et RAG sur appareil.
★ 1 542+0Évolution des étoiles sur les 7 derniers jours - #13
Outil alimenté par l'IA pour le filtrage efficace des résumés et des PDF dans les revues systématiques.
★ 1 328+0Évolution des étoiles sur les 7 derniers jours - #14
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1 251+164Évolution des étoiles sur les 7 derniers jours - #15
Framework entièrement ouvert pour la démocratisation de l'entraînement multimodal.
★ 1 195+0Évolution des étoiles sur les 7 derniers jours - #16
🎬 Générez des images à partir de n'importe quel point de vue de caméra via un contrôle interactif 3D. Glissez la caméra dans l'espace 3D ou utilisez des curseurs pour définir l'azimut, l'élévation et la distance, puis générez. Construit avec Three.js et Gradio, interface bilingue ZH/EN.
★ 982+161Évolution des étoiles sur les 7 derniers jours - #17
Bibliothèque d'entraînement distribué native PyTorch pour LLM/VLM avec prise en charge immédiate de Hugging Face.
★ 912+18Évolution des étoiles sur les 7 derniers jours - #18★ 855+5Évolution des étoiles sur les 7 derniers jours
- #19
Collection de projets publics remarquables sur les LLM, VLM, VLA, AIGC, ainsi que les jeux de données et applications associés.
★ 813-1Évolution des étoiles sur les 7 derniers jours - #20
Passerelle API pour grands modèles de langage (LLM) : un système de gestion et de distribution d'interfaces IA. Il permet de convertir divers modèles en interfaces compatibles OpenAI, Claude ou Gemini, facilitant la gestion centralisée des clés et la distribution pour les particuliers ou les entreprises. Supporte les principaux modèles (Gemini, Claude, Qwen3, Kimi-k2, Doubao, etc.). Fourni sous forme d'exécutable unique ou d'image Docker, prêt à l'emploi, open source et autonome. Basé sur New-API et One-API, il intègre toutes leurs fonctionnalités ainsi que de nombreux plugins tiers.
★ 770-141Évolution des étoiles sur les 7 derniers jours - #21
MimikaStudio - Une application locale pour macOS (Apple Silicon) avec prise en charge d'agents MCP.
★ 735+4Évolution des étoiles sur les 7 derniers jours - #22
Moteur d'inférence LLM en Rust pur et CUDA — sans PyTorch, compatible avec OpenAI, servant Qwen3 vers Kimi-K2.
★ 678+9Évolution des étoiles sur les 7 derniers jours - #23
Moteur de mini-inférence statique, suckless, mono-lot (single batch) et exclusivement CUDA pour qwen3-0.6B
★ 560+0Évolution des étoiles sur les 7 derniers jours - #24★ 514+5Évolution des étoiles sur les 7 derniers jours