Lompat ke konten utama
buildradar
Sign in
Topik · sglang

sglang

Repositori open source terpantau bertanda sglang, diurutkan berdasarkan bintang.

Repositori
19
Total bintang
50.817
Rata-rata bintang
2.675
Porsi
0,00%

Topik yang sering muncul berdampingan dengan sglang di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda sglang.

  • Roadmap 10 minggu, 30 menit per hari untuk inferensi dan pengoptimalan penyajian LLM. vLLM, SGLang, kuantisasi, decoding spekulatif, benchmarking.

    880
  • inference@xorbitsai

    Ganti GPT dengan LLM apa pun hanya dengan mengubah satu baris kode. Xinference memungkinkan Anda menjalankan model open-source, ucapan, dan multimodal di cloud, on-premise, atau laptop Anda — semuanya melalui satu API inferensi terpadu yang siap untuk produksi.

    9.537+9Perubahan bintang dalam 7 hari terakhir
  • dynamo@ai-dynamo

    Kerangka Kerja Layanan Inferensi Terdistribusi Skala Pusat Data

    7.952+44Perubahan bintang dalam 7 hari terakhir
  • Mooncake@kvcache-ai

    Mooncake adalah platform layanan untuk Kimi, layanan LLM terkemuka yang disediakan oleh Moonshot AI.

    6.470+40Perubahan bintang dalam 7 hari terakhir
  • OpenClaw-RL@Gen-Verse

    OpenClaw-RL: Latih agen apa pun hanya dengan berbicara

    5.665+7Perubahan bintang dalam 7 hari terakhir
  • gpustack@gpustack

    Manajer klaster GPU untuk penyajian model AI berkinerja tinggi (vLLM, SGLang) dan instans GPU yang dapat diakses via SSH sesuai permintaan.

    5.593+21Perubahan bintang dalam 7 hari terakhir
  • local-studio@sybil-solutions

    Panel kontrol untuk VLLM, Sglang, llama.cpp, exllamav3

    1.749+7Perubahan bintang dalam 7 hari terakhir
  • InferenceX@SemiAnalysisAI

    Platform Riset Benchmark Inferensi Berkelanjutan Open Source — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & segera hadir™ TPUv6e/v7/Trainium2/3 | Platform riset benchmark inferensi berkelanjutan open-source — Kimi K2.7-Code, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72, segera hadir™ TPUv6e/v7/Trainium2/3

    1.613+33Perubahan bintang dalam 7 hari terakhir
  • auto-round@intel

    Algoritma kuantisasi SOTA untuk inferensi LLM bit-rendah dengan akurasi tinggi, dioptimalkan secara mulus untuk CPU/XPU/CUDA, dengan dukungan berbagai tipe data dan kompatibilitas penuh dengan vLLM, SGLang, dan Transformers.

    1.599+8Perubahan bintang dalam 7 hari terakhir
  • MOSS-TTSD@OpenMOSS

    MOSS-TTSD adalah model pembuatan dialog lisan yang dirancang untuk sintesis multi-pembicara yang ekspresif. Model ini memiliki fitur pemodelan konteks panjang, kontrol pembicara yang fleksibel, dan dukungan multibahasa, sekaligus memungkinkan kloning suara zero-shot dari referensi audio pendek.

    1.394+4Perubahan bintang dalam 7 hari terakhir
  • kvcached@ovg-project

    KV Cache Elastis Tervirtualisasi untuk Berbagi GPU Dinamis dan Lebih Jauh Lagi

    1.275+130Perubahan bintang dalam 7 hari terakhir
  • GPTQModel@ModelCloud

    Toolkit kuantisasi (kompresi) model LLM dengan dukungan akselerasi HW untuk GPU Nvidia, AMD, Intel, dan CPU Intel/AMD/Apple melalui HF, vLLM, dan SGLang.

    1.248+0Perubahan bintang dalam 7 hari terakhir
  • SpecForge@sgl-project

    Latih model speculative decoding dengan mudah dan transfer dengan lancar ke layanan SGLang.

    1.144+14Perubahan bintang dalam 7 hari terakhir
  • MOVA@OpenMOSS

    MOVA: Menuju Pembuatan Video-Audio yang Dapat Diskalakan dan Disinkronkan.

    1.108+3Perubahan bintang dalam 7 hari terakhir
  • sglang-omni@sgl-project

    SGLang-Omni mendukung penyajian berkinerja tinggi untuk model TTS, ASR, ucapan, dan omni.

    1.105+130Perubahan bintang dalam 7 hari terakhir
  • UniRL@Tencent-Hunyuan

    UniRL adalah framework untuk Reinforcement Learning Model Multimodal Terpadu

    933+15Perubahan bintang dalam 7 hari terakhir
  • Roadmap 10 minggu, 30 menit per hari untuk inferensi dan pengoptimalan penyajian LLM. vLLM, SGLang, kuantisasi, decoding spekulatif, benchmarking.

    880+76Perubahan bintang dalam 7 hari terakhir
  • FlashTTS@HuiResearch

    Berdasarkan model seperti SparkTTS dan OrpheusTTS, menyediakan layanan sintesis suara Tiongkok dan kloning suara berkualitas tinggi.

    613+1Perubahan bintang dalam 7 hari terakhir
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    509Perubahan bintang dalam 7 hari terakhir
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    506Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik