본문으로 건너뛰기
buildradar
Sign in
토픽 · sglang

sglang

sglang 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
19
총 스타
50,817
평균 스타
2,675
비중
0.00%

같은 리포지토리에 sglang 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 sglang 태그가 달린 리포지토리예요.

  • LLM 추론 서빙 및 최적화를 위한 10주간, 하루 30분 로드맵. vLLM, SGLang, 양자화, 투기적 디코딩, 벤치마킹.

    880
  • inference@xorbitsai

    코드 한 줄만 바꾸면 GPT를 어떤 LLM으로든 교체할 수 있습니다. Xinference를 사용하면 클라우드, 온프레미스, 노트북에서 오픈소스, 음성, 멀티모달 모델을 단일 프로덕션용 통합 추론 API로 실행할 수 있습니다.

    9,537+9최근 7일 스타 변화
  • dynamo@ai-dynamo

    데이터센터 규모의 분산 추론 서빙 프레임워크

    7,952+44최근 7일 스타 변화
  • Mooncake@kvcache-ai

    Mooncake은 Moonshot AI가 제공하는 선도적인 LLM 서비스 Kimi의 서빙 플랫폼입니다.

    6,470+40최근 7일 스타 변화
  • OpenClaw-RL@Gen-Verse

    OpenClaw-RL: 대화만으로 모든 에이전트 학습

    5,665+7최근 7일 스타 변화
  • gpustack@gpustack

    고성능 AI 모델 서빙(vLLM, SGLang) 및 온디맨드 SSH 접근 가능 GPU 인스턴스를 위한 GPU 클러스터 관리자

    5,593+21최근 7일 스타 변화
  • local-studio@sybil-solutions

    VLLM, Sglang, llama.cpp, exllamav3 제어판

    1,749+7최근 7일 스타 변화
  • InferenceX@SemiAnalysisAI

    오픈 소스 지속적 추론 벤치마크 연구 플랫폼 — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 및 곧 출시될™ TPUv6e/v7/Trainium2/3

    1,613+33최근 7일 스타 변화
  • auto-round@intel

    고정밀 저비트 LLM 추론을 위한 SOTA 양자화 알고리즘. CPU/XPU/CUDA에 최적화되었으며, 다양한 데이터 타입을 지원하고 vLLM, SGLang, Transformers와 완벽히 호환됩니다.

    1,599+8최근 7일 스타 변화
  • MOSS-TTSD@OpenMOSS

    MOSS-TTSD는 표현력이 풍부한 다중 화자 합성을 위해 설계된 음성 대화 생성 모델입니다. 긴 문맥 모델링, 유연한 화자 제어, 다국어 지원을 제공하며 짧은 오디오 레퍼런스만으로 제로샷 음성 복제를 구현합니다.

    1,394+4최근 7일 스타 변화
  • kvcached@ovg-project

    동적 GPU 공유 등을 위한 가상화된 일래스틱 KV 캐시

    1,275+130최근 7일 스타 변화
  • GPTQModel@ModelCloud

    HF, vLLM, SGLang을 통해 Nvidia, AMD, Intel GPU 및 Intel/AMD/Apple CPU의 하드웨어 가속을 지원하는 LLM 모델 양자화(압축) 툴킷.

    1,248+0최근 7일 스타 변화
  • SpecForge@sgl-project

    추측 디코딩(speculative decoding) 모델을 손쉽게 학습하고 SGLang 서빙으로 원활하게 포팅

    1,144+14최근 7일 스타 변화
  • MOVA@OpenMOSS

    MOVA: 확장 가능하고 동기화된 비디오-오디오 생성을 향하여

    1,108+3최근 7일 스타 변화
  • sglang-omni@sgl-project

    SGLang-Omni는 TTS, ASR, 음성 및 옴니 모델을 위한 고성능 서빙을 지원합니다.

    1,105+130최근 7일 스타 변화
  • UniRL@Tencent-Hunyuan

    통합 멀티모달 모델 강화 학습을 위한 프레임워크 UniRL

    933+15최근 7일 스타 변화
  • LLM 추론 서빙 및 최적화를 위한 10주간, 하루 30분 로드맵. vLLM, SGLang, 양자화, 투기적 디코딩, 벤치마킹.

    880+76최근 7일 스타 변화
  • FlashTTS@HuiResearch

    SparkTTS, OrpheusTTS 등의 모델을 기반으로 고품질 중국어 음성 합성 및 음성 복제 서비스를 제공합니다.

    613+1최근 7일 스타 변화
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    508최근 7일 스타 변화
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    506최근 7일 스타 변화
← 토픽 목록으로