Zum Hauptinhalt springen
buildradar
Sign in
Thema · sglang

sglang

Erfasste Open-Source-Repos mit dem Tag sglang, sortiert nach Sternen.

Repos
19
Sterne gesamt
50.817
Sterne im Schnitt
2.675
Anteil
0,00%

Themen, die häufig gemeinsam mit sglang am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit sglang getaggt wurden.

  • Ein 10-wöchiger, 30 Minuten pro Tag umfassender Fahrplan für LLM-Inferenz-Serving und -Optimierung. vLLM, SGLang, Quantisierung, spekulatives Decoding, Benchmarking.

    881
  • zero-to-sglang@datawhalechina

    面向大模型开发者的 SGLang 系统化开源教程:从推理基础与环境搭建开始,逐步学习模型部署、结构化生成、服务开发和性能优化, 结合实战案例带你从 0 到 1 掌握 SGLang,构建高性能 LLM 推理应用

    377
  • inference@xorbitsai

    Ersetzen Sie GPT durch ein beliebiges LLM, indem Sie nur eine einzige Codezeile ändern. Mit Xinference können Sie Open-Source-, Sprach- und multimodale Modelle in der Cloud, on-premise oder auf Ihrem Laptop ausführen – alles über eine einheitliche, produktionsbereite Inferenz-API.

    9.537+9Sterne-Änderung der letzten 7 Tage
  • dynamo@ai-dynamo

    Ein verteiltes Inference-Serving-Framework auf Rechenzentrumsebene

    7.952+44Sterne-Änderung der letzten 7 Tage
  • Mooncake@kvcache-ai

    Mooncake ist die Serving-Plattform für Kimi, einen führenden LLM-Dienst von Moonshot AI.

    6.470+40Sterne-Änderung der letzten 7 Tage
  • OpenClaw-RL@Gen-Verse

    OpenClaw-RL: Trainieren Sie jeden Agenten einfach durch Sprache

    5.665+7Sterne-Änderung der letzten 7 Tage
  • gpustack@gpustack

    Ein GPU-Cluster-Manager für hochleistungsfähiges KI-Modell-Serving (vLLM, SGLang) und bedarfsgesteuerte GPU-Instanzen mit SSH-Zugang.

    5.593+21Sterne-Änderung der letzten 7 Tage
  • local-studio@sybil-solutions

    Steuerungs-Panel für VLLM, Sglang, llama.cpp, exllamav3

    1.749+7Sterne-Änderung der letzten 7 Tage
  • InferenceX@SemiAnalysisAI

    Open-Source-Forschungsplattform für kontinuierliche Inferenz-Benchmarks — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & bald™ TPUv6e/v7/Trainium2/3

    1.613+33Sterne-Änderung der letzten 7 Tage
  • auto-round@intel

    Ein SOTA-Quantisierungsalgorithmus für hochpräzise Low-Bit-LLM-Inferenz, nahtlos optimiert für CPU/XPU/CUDA, mit Unterstützung für mehrere Datentypen und voller Kompatibilität mit vLLM, SGLang und Transformers.

    1.599+8Sterne-Änderung der letzten 7 Tage
  • MOSS-TTSD@OpenMOSS

    MOSS-TTSD is ein Modell zur Generierung gesprochener Dialoge, das für die ausdrucksstarke Synthese mehrerer Sprecher entwickelt wurde. Es bietet Long-Context-Modellierung, flexible Sprechersteuerung und mehrsprachige Unterstützung und ermöglicht gleichzeitig Zero-Shot-Stimmenklonen aus kurzen Audio-Referenzen.

    1.394+4Sterne-Änderung der letzten 7 Tage
  • kvcached@ovg-project

    Virtualisierter Elastic KV Cache für dynamisches GPU-Sharing und mehr

    1.275+130Sterne-Änderung der letzten 7 Tage
  • GPTQModel@ModelCloud

    LLM-Modell-Quantisierungs- (Kompprimierungs-) Toolkit mit Hardware-Beschleunigungsunterstützung für Nvidia-, AMD-, Intel-GPUs und Intel/AMD/Apple-CPUs über HF, vLLM und SGLang.

    1.248+0Sterne-Änderung der letzten 7 Tage
  • SpecForge@sgl-project

    Trainieren Sie spekulative Dekodierungsmodelle mühelos und portieren Sie sie reibungslos auf das SGLang-Serving.

    1.144+14Sterne-Änderung der letzten 7 Tage
  • sglang-omni@sgl-project

    SGLang-Omni ermöglicht hochleistungsfähiges Serving für TTS-, ASR-, Sprach- und Omni-Modelle.

    1.118+130Sterne-Änderung der letzten 7 Tage
  • MOVA@OpenMOSS

    MOVA: Auf dem Weg zu skalierbarer und synchronisierter Video-Audio-Generierung

    1.110+3Sterne-Änderung der letzten 7 Tage
  • UniRL@Tencent-Hunyuan

    UniRL ist ein Framework für das Reinforcement Learning multimodaler Einheitsmodelle

    935+15Sterne-Änderung der letzten 7 Tage
  • Ein 10-wöchiger, 30 Minuten pro Tag umfassender Fahrplan für LLM-Inferenz-Serving und -Optimierung. vLLM, SGLang, Quantisierung, spekulatives Decoding, Benchmarking.

    881+76Sterne-Änderung der letzten 7 Tage
  • FlashTTS@HuiResearch

    Bietet hochwertige chinesische Sprachsynthese und Stimmklon-Dienste auf Basis von Modellen wie SparkTTS und OrpheusTTS.

    613+1Sterne-Änderung der letzten 7 Tage
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    510Sterne-Änderung der letzten 7 Tage
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    506Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen