sglang
Repositori open source terpantau bertanda sglang, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan sglang di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda sglang.
- #1
Roadmap 10 minggu, 30 menit per hari untuk inferensi dan pengoptimalan penyajian LLM. vLLM, SGLang, kuantisasi, decoding spekulatif, benchmarking.
★ 880
- #1
Ganti GPT dengan LLM apa pun hanya dengan mengubah satu baris kode. Xinference memungkinkan Anda menjalankan model open-source, ucapan, dan multimodal di cloud, on-premise, atau laptop Anda — semuanya melalui satu API inferensi terpadu yang siap untuk produksi.
★ 9.537+9Perubahan bintang dalam 7 hari terakhir - #2★ 7.952+44Perubahan bintang dalam 7 hari terakhir
- #3
Mooncake adalah platform layanan untuk Kimi, layanan LLM terkemuka yang disediakan oleh Moonshot AI.
★ 6.470+40Perubahan bintang dalam 7 hari terakhir - #4
OpenClaw-RL: Latih agen apa pun hanya dengan berbicara
★ 5.665+7Perubahan bintang dalam 7 hari terakhir - #5
Manajer klaster GPU untuk penyajian model AI berkinerja tinggi (vLLM, SGLang) dan instans GPU yang dapat diakses via SSH sesuai permintaan.
★ 5.593+21Perubahan bintang dalam 7 hari terakhir - #6
Panel kontrol untuk VLLM, Sglang, llama.cpp, exllamav3
★ 1.749+7Perubahan bintang dalam 7 hari terakhir - #7
Platform Riset Benchmark Inferensi Berkelanjutan Open Source — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & segera hadir™ TPUv6e/v7/Trainium2/3 | Platform riset benchmark inferensi berkelanjutan open-source — Kimi K2.7-Code, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72, segera hadir™ TPUv6e/v7/Trainium2/3
★ 1.613+33Perubahan bintang dalam 7 hari terakhir - #8
Algoritma kuantisasi SOTA untuk inferensi LLM bit-rendah dengan akurasi tinggi, dioptimalkan secara mulus untuk CPU/XPU/CUDA, dengan dukungan berbagai tipe data dan kompatibilitas penuh dengan vLLM, SGLang, dan Transformers.
★ 1.599+8Perubahan bintang dalam 7 hari terakhir - #9
MOSS-TTSD adalah model pembuatan dialog lisan yang dirancang untuk sintesis multi-pembicara yang ekspresif. Model ini memiliki fitur pemodelan konteks panjang, kontrol pembicara yang fleksibel, dan dukungan multibahasa, sekaligus memungkinkan kloning suara zero-shot dari referensi audio pendek.
★ 1.394+4Perubahan bintang dalam 7 hari terakhir - #10★ 1.275+130Perubahan bintang dalam 7 hari terakhir
- #11
Toolkit kuantisasi (kompresi) model LLM dengan dukungan akselerasi HW untuk GPU Nvidia, AMD, Intel, dan CPU Intel/AMD/Apple melalui HF, vLLM, dan SGLang.
★ 1.248+0Perubahan bintang dalam 7 hari terakhir - #12
Latih model speculative decoding dengan mudah dan transfer dengan lancar ke layanan SGLang.
★ 1.144+14Perubahan bintang dalam 7 hari terakhir - #13★ 1.108+3Perubahan bintang dalam 7 hari terakhir
- #14
SGLang-Omni mendukung penyajian berkinerja tinggi untuk model TTS, ASR, ucapan, dan omni.
★ 1.105+130Perubahan bintang dalam 7 hari terakhir - #15★ 933+15Perubahan bintang dalam 7 hari terakhir
- #16
Roadmap 10 minggu, 30 menit per hari untuk inferensi dan pengoptimalan penyajian LLM. vLLM, SGLang, kuantisasi, decoding spekulatif, benchmarking.
★ 880+76Perubahan bintang dalam 7 hari terakhir - #17
Berdasarkan model seperti SparkTTS dan OrpheusTTS, menyediakan layanan sintesis suara Tiongkok dan kloning suara berkualitas tinggi.
★ 613+1Perubahan bintang dalam 7 hari terakhir - #18
Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.
★ 509—Perubahan bintang dalam 7 hari terakhir - #19
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 506—Perubahan bintang dalam 7 hari terakhir