qwen
Erfasste Open-Source-Repos mit dem Tag qwen, sortiert nach Sternen.
- #91
Willkommen im offiziellen Repository von SINQ! Eine neuartige, schnelle und hochwertige Quantisierungsmethode, die entwickelt wurde, um jedes Large Language Model kleiner zu machen und gleichzeitig die Genauigkeit zu erhalten [ICML 2026]
★ 630+0Sterne-Änderung der letzten 7 Tage - #92
Einfaches und effizientes Finetuning von LLMs. (Unterstützt LLama, LLama2, LLama3, Qwen, Baichuan, GLM, Falcon)
★ 621+0Sterne-Änderung der letzten 7 Tage - #93
ComfyUI DyPE+SEGA für artefaktfreie 4K+-Bildgenerierung: Z-Image, Qwen, Flux, Krea2
★ 621+9Sterne-Änderung der letzten 7 Tage - #94
Swiftlet ist eine Swift- und Metal-Laufzeitumgebung, die große Qwen Mixture-of-Experts-Modelle lokal auf Apple-Geräten ausführt, indem Expert-Gewichte vom Speicher gestreamt werden. Dies ermöglicht den Betrieb von 35B- und 80B-Modellen mit geringem RAM-Verbrauch, auch auf dem iPhone.
★ 618+22Sterne-Änderung der letzten 7 Tage - #95★ 604+1Sterne-Änderung der letzten 7 Tage
- #96
🔴 SEHR GROSSE KI-TOOL-LISTE! 🔴 Kuratierte Liste von KI-Tools - Stand 2026
★ 577+3Sterne-Änderung der letzten 7 Tage - #97
Ein erweiterbares MVP-Prototyp-Template für einen Chat-Bot mit Single-Turn-Dialogen, basierend auf Vue 3, Vite8, TypeScript, Naive UI, Pinia(v3) und UnoCSS. Unterstützt LLM-API-Integration, SSE-Streaming, Markdown-Vorschau (Mermaid/KaTex/LaTex) sowie verschiedene Modelle wie Deepseek, Spark und Zhipu.
★ 574+1Sterne-Änderung der letzten 7 Tage - #98
Ein Projekt für Praktika und Berufseinstieg, das Sie Schritt für Schritt bei der Implementierung eines LLM-Inferenz-Frameworks mit Unterstützung für Llama2/3 und Qwen2.5 anleitet.
★ 573+2Sterne-Änderung der letzten 7 Tage - #99
Lokale Ausführung von Qwen3-TTS Text-to-Speech auf dem Mac (M1/M2/M3/M4). Stimmenklonierung, Stimmendesign und benutzerdefinierte Stimmen. 100 % offline mittels MLX.
★ 561+3Sterne-Änderung der letzten 7 Tage - #100
Statische, minimalistische Single-Batch-Inferenz-Engine für qwen3-0.6B, ausschließlich für CUDA
★ 559+0Sterne-Änderung der letzten 7 Tage - #101★ 554+4Sterne-Änderung der letzten 7 Tage
- #102
FlashRT ist eine leistungsstarke Echtzeit-Inferenz-Engine für KI-Workloads mit kleinen Batches und geringer Latenz. Die Hauptintegration umfasst die VLA-Steuerung für Pi0, Pi0.5, GROOT N1.6 und Pi0-FAST sowie Unterstützung für LLMs wie Qwen3.6-27B.
★ 546+9Sterne-Änderung der letzten 7 Tage - #103
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 542—Sterne-Änderung der letzten 7 Tage - #104
CLI-first orchestration for AI coding agents: run selected agents and models in parallel, compare raw answers, and coordinate review or implementation workflows.
★ 513—Sterne-Änderung der letzten 7 Tage - #105
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 505—Sterne-Änderung der letzten 7 Tage - #106
A curated list of awesome tools, extensions, and resources for Gemini CLI.
★ 503—Sterne-Änderung der letzten 7 Tage