qwen
Dépôts open source suivis étiquetés qwen, triés par étoiles.
- #91
Bienvenue sur le dépôt officiel de SINQ ! Une méthode de quantification novatrice, rapide et de haute qualité conçue pour réduire la taille de n'importe quel Grand Modèle de Langage (LLM) tout en préservant sa précision [ICML 2026]
★ 630+0Évolution des étoiles sur les 7 derniers jours - #92
Fine-tuning simple et efficace de LLM (prise en charge de LLaMA, LLaMA2, LLaMA3, Qwen, Baichuan, GLM, Falcon). Entraînement et déploiement de quantification efficace pour grands modèles.
★ 621+0Évolution des étoiles sur les 7 derniers jours - #93
ComfyUI DyPE+SEGA, permettant une génération d'images 4K+ sans artéfact : Z-Image, Qwen, Flux, Krea2.
★ 621+9Évolution des étoiles sur les 7 derniers jours - #94
Swiftlet est un runtime Swift et Metal qui exécute localement de grands modèles Qwen Mixture-of-Experts sur les appareils Apple en diffusant les poids des experts depuis le stockage, permettant aux modèles 35B et 80B de fonctionner avec peu de RAM, y compris sur iPhone.
★ 618+22Évolution des étoiles sur les 7 derniers jours - #95★ 604+1Évolution des étoiles sur les 7 derniers jours
- #96
🔴 TRÈS GRANDE LISTE D'OUTILS IA ! 🔴 Liste sélective d'outils d'IA - Mis à jour en 2026
★ 577+3Évolution des étoiles sur les 7 derniers jours - #97
Modèle MVP pour une interface Web de chatbot à tour unique, basé sur Vue 3, Vite 8, TypeScript, Naive UI, Pinia et UnoCSS. Intègre facilement des API LLM, supporte le streaming SSE, le rendu Markdown/Mermaid/KaTex, et les modèles de raisonnement comme DeepSeek R1 (avec support des balises <think>).
★ 574+1Évolution des étoiles sur les 7 derniers jours - #98
Un excellent projet pour le recrutement universitaire, d'automne, de printemps et les stages, vous guidant pour implémenter à partir de zéro un framework d'inférence de grands modèles prenant en charge LLama2/3 et Qwen2.5.
★ 573+2Évolution des étoiles sur les 7 derniers jours - #99
Exécutez Qwen3-TTS text-to-speech localement sur Mac (M1/M2/M3/M4). Clonage de voix, design vocal, voix personnalisées. 100 % hors ligne via MLX.
★ 561+3Évolution des étoiles sur les 7 derniers jours - #100
Moteur de mini-inférence statique, suckless, mono-lot (single batch) et exclusivement CUDA pour qwen3-0.6B
★ 559+0Évolution des étoiles sur les 7 derniers jours - #101
Un framework pour l'entraînement et l'inférence multi-agents basés sur les LLM par renforcement
★ 554+4Évolution des étoiles sur les 7 derniers jours - #102
FlashRT est un moteur d'inférence haute performance en temps réel pour les charges de travail IA à faible lot et sensibles à la latence. L'intégration phare concerne le contrôle VLA en production pour Pi0, Pi0.5, GROOT N1.6 et Pi0-FAST. Il prend également en charge les LLM tels que qwen3.6-27B.
★ 546+9Évolution des étoiles sur les 7 derniers jours - #103
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 542—Évolution des étoiles sur les 7 derniers jours - #104
CLI-first orchestration for AI coding agents: run selected agents and models in parallel, compare raw answers, and coordinate review or implementation workflows.
★ 513—Évolution des étoiles sur les 7 derniers jours - #105
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 505—Évolution des étoiles sur les 7 derniers jours - #106
A curated list of awesome tools, extensions, and resources for Gemini CLI.
★ 503—Évolution des étoiles sur les 7 derniers jours