sglang
sglang 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 sglang 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 sglang 태그가 달린 리포지토리예요.
- #1
LLM 추론 서빙 및 최적화를 위한 10주간, 하루 30분 로드맵. vLLM, SGLang, 양자화, 투기적 디코딩, 벤치마킹.
★ 880
- #1
코드 한 줄만 바꾸면 GPT를 어떤 LLM으로든 교체할 수 있습니다. Xinference를 사용하면 클라우드, 온프레미스, 노트북에서 오픈소스, 음성, 멀티모달 모델을 단일 프로덕션용 통합 추론 API로 실행할 수 있습니다.
★ 9,537+9최근 7일 스타 변화 - #2★ 7,952+44최근 7일 스타 변화
- #3★ 6,470+40최근 7일 스타 변화
- #4
OpenClaw-RL: 대화만으로 모든 에이전트 학습
★ 5,665+7최근 7일 스타 변화 - #5★ 5,593+21최근 7일 스타 변화
- #6
VLLM, Sglang, llama.cpp, exllamav3 제어판
★ 1,749+7최근 7일 스타 변화 - #7
오픈 소스 지속적 추론 벤치마크 연구 플랫폼 — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 및 곧 출시될™ TPUv6e/v7/Trainium2/3
★ 1,613+33최근 7일 스타 변화 - #8
고정밀 저비트 LLM 추론을 위한 SOTA 양자화 알고리즘. CPU/XPU/CUDA에 최적화되었으며, 다양한 데이터 타입을 지원하고 vLLM, SGLang, Transformers와 완벽히 호환됩니다.
★ 1,599+8최근 7일 스타 변화 - #9
MOSS-TTSD는 표현력이 풍부한 다중 화자 합성을 위해 설계된 음성 대화 생성 모델입니다. 긴 문맥 모델링, 유연한 화자 제어, 다국어 지원을 제공하며 짧은 오디오 레퍼런스만으로 제로샷 음성 복제를 구현합니다.
★ 1,394+4최근 7일 스타 변화 - #10★ 1,275+130최근 7일 스타 변화
- #11
HF, vLLM, SGLang을 통해 Nvidia, AMD, Intel GPU 및 Intel/AMD/Apple CPU의 하드웨어 가속을 지원하는 LLM 모델 양자화(압축) 툴킷.
★ 1,248+0최근 7일 스타 변화 - #12★ 1,144+14최근 7일 스타 변화
- #13★ 1,108+3최근 7일 스타 변화
- #14
SGLang-Omni는 TTS, ASR, 음성 및 옴니 모델을 위한 고성능 서빙을 지원합니다.
★ 1,105+130최근 7일 스타 변화 - #15★ 933+15최근 7일 스타 변화
- #16
LLM 추론 서빙 및 최적화를 위한 10주간, 하루 30분 로드맵. vLLM, SGLang, 양자화, 투기적 디코딩, 벤치마킹.
★ 880+76최근 7일 스타 변화 - #17★ 613+1최근 7일 스타 변화
- #18
Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.
★ 508—최근 7일 스타 변화 - #19
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 506—최근 7일 스타 변화