sglang
Erfasste Open-Source-Repos mit dem Tag sglang, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit sglang am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit sglang getaggt wurden.
- #1
Ein 10-wöchiger, 30 Minuten pro Tag umfassender Fahrplan für LLM-Inferenz-Serving und -Optimierung. vLLM, SGLang, Quantisierung, spekulatives Decoding, Benchmarking.
★ 881 - #2
面向大模型开发者的 SGLang 系统化开源教程:从推理基础与环境搭建开始,逐步学习模型部署、结构化生成、服务开发和性能优化, 结合实战案例带你从 0 到 1 掌握 SGLang,构建高性能 LLM 推理应用
★ 377
- #1
Ersetzen Sie GPT durch ein beliebiges LLM, indem Sie nur eine einzige Codezeile ändern. Mit Xinference können Sie Open-Source-, Sprach- und multimodale Modelle in der Cloud, on-premise oder auf Ihrem Laptop ausführen – alles über eine einheitliche, produktionsbereite Inferenz-API.
★ 9.537+9Sterne-Änderung der letzten 7 Tage - #2★ 7.952+44Sterne-Änderung der letzten 7 Tage
- #3
Mooncake ist die Serving-Plattform für Kimi, einen führenden LLM-Dienst von Moonshot AI.
★ 6.470+40Sterne-Änderung der letzten 7 Tage - #4
OpenClaw-RL: Trainieren Sie jeden Agenten einfach durch Sprache
★ 5.665+7Sterne-Änderung der letzten 7 Tage - #5
Ein GPU-Cluster-Manager für hochleistungsfähiges KI-Modell-Serving (vLLM, SGLang) und bedarfsgesteuerte GPU-Instanzen mit SSH-Zugang.
★ 5.593+21Sterne-Änderung der letzten 7 Tage - #6
Steuerungs-Panel für VLLM, Sglang, llama.cpp, exllamav3
★ 1.749+7Sterne-Änderung der letzten 7 Tage - #7
Open-Source-Forschungsplattform für kontinuierliche Inferenz-Benchmarks — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & bald™ TPUv6e/v7/Trainium2/3
★ 1.613+33Sterne-Änderung der letzten 7 Tage - #8
Ein SOTA-Quantisierungsalgorithmus für hochpräzise Low-Bit-LLM-Inferenz, nahtlos optimiert für CPU/XPU/CUDA, mit Unterstützung für mehrere Datentypen und voller Kompatibilität mit vLLM, SGLang und Transformers.
★ 1.599+8Sterne-Änderung der letzten 7 Tage - #9
MOSS-TTSD is ein Modell zur Generierung gesprochener Dialoge, das für die ausdrucksstarke Synthese mehrerer Sprecher entwickelt wurde. Es bietet Long-Context-Modellierung, flexible Sprechersteuerung und mehrsprachige Unterstützung und ermöglicht gleichzeitig Zero-Shot-Stimmenklonen aus kurzen Audio-Referenzen.
★ 1.394+4Sterne-Änderung der letzten 7 Tage - #10★ 1.275+130Sterne-Änderung der letzten 7 Tage
- #11
LLM-Modell-Quantisierungs- (Kompprimierungs-) Toolkit mit Hardware-Beschleunigungsunterstützung für Nvidia-, AMD-, Intel-GPUs und Intel/AMD/Apple-CPUs über HF, vLLM und SGLang.
★ 1.248+0Sterne-Änderung der letzten 7 Tage - #12
Trainieren Sie spekulative Dekodierungsmodelle mühelos und portieren Sie sie reibungslos auf das SGLang-Serving.
★ 1.144+14Sterne-Änderung der letzten 7 Tage - #13
SGLang-Omni ermöglicht hochleistungsfähiges Serving für TTS-, ASR-, Sprach- und Omni-Modelle.
★ 1.118+130Sterne-Änderung der letzten 7 Tage - #14★ 1.110+3Sterne-Änderung der letzten 7 Tage
- #15
UniRL ist ein Framework für das Reinforcement Learning multimodaler Einheitsmodelle
★ 935+15Sterne-Änderung der letzten 7 Tage - #16
Ein 10-wöchiger, 30 Minuten pro Tag umfassender Fahrplan für LLM-Inferenz-Serving und -Optimierung. vLLM, SGLang, Quantisierung, spekulatives Decoding, Benchmarking.
★ 881+76Sterne-Änderung der letzten 7 Tage - #17
Bietet hochwertige chinesische Sprachsynthese und Stimmklon-Dienste auf Basis von Modellen wie SparkTTS und OrpheusTTS.
★ 613+1Sterne-Änderung der letzten 7 Tage - #18
Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.
★ 510—Sterne-Änderung der letzten 7 Tage - #19
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 506—Sterne-Änderung der letzten 7 Tage