sglang
Các kho mã nguồn mở đang theo dõi được gắn thẻ sglang, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng sglang trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ sglang.
- #1
Lộ trình 10 tuần, mỗi ngày 30 phút về suy luận và tối ưu hóa LLM, bao gồm vLLM, SGLang, lượng tử hóa, giải mã suy đoán và đo điểm chuẩn.
★ 880
- #1
Thay thế GPT bằng bất kỳ LLM nào chỉ với một dòng mã. Xinference cho phép bạn chạy các mô hình mã nguồn mở, giọng nói và đa phương thức trên đám mây, tại chỗ hoặc trên máy tính xách tay — tất cả thông qua một API suy luận thống nhất, sẵn sàng cho môi trường sản xuất.
★ 9.537+9Thay đổi số sao trong 7 ngày qua - #2★ 7.952+44Thay đổi số sao trong 7 ngày qua
- #3
Mooncake là nền tảng phục vụ cho Kimi, một dịch vụ LLM hàng đầu được cung cấp bởi Moonshot AI.
★ 6.470+40Thay đổi số sao trong 7 ngày qua - #4
OpenClaw-RL: Huấn luyện bất kỳ tác nhân nào chỉ bằng cách trò chuyện.
★ 5.665+7Thay đổi số sao trong 7 ngày qua - #5
Trình quản lý cụm GPU dành cho việc phục vụ mô hình AI hiệu năng cao (vLLM, SGLang) và các instance GPU có thể truy cập SSH theo yêu cầu.
★ 5.593+21Thay đổi số sao trong 7 ngày qua - #6
Bảng điều khiển cho VLLM, Sglang, llama.cpp, exllamav3
★ 1.749+7Thay đổi số sao trong 7 ngày qua - #7
Nền tảng nghiên cứu benchmark suy luận liên tục mã nguồn mở — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & sắp ra mắt™ TPUv6e/v7/Trainium2/3 | Nền tảng nghiên cứu benchmark suy luận liên tục mã nguồn mở — Kimi K2.7-Code, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72, sắp ra mắt™ TPUv6e/v7/Trainium2/3
★ 1.613+33Thay đổi số sao trong 7 ngày qua - #8
Thuật toán lượng tử hóa SOTA cho suy luận LLM low-bit độ chính xác cao, được tối ưu hóa liền mạch cho CPU/XPU/CUDA, hỗ trợ đa kiểu dữ liệu và tương thích hoàn toàn với vLLM, SGLang và Transformers.
★ 1.599+8Thay đổi số sao trong 7 ngày qua - #9
MOSS-TTSD là một mô hình tạo hội thoại giọng nói được thiết kế để tổng hợp biểu cảm đa người nói. Nó có tính năng mô hình hóa ngữ cảnh dài, điều khiển người nói linh hoạt và hỗ trợ đa ngôn ngữ, đồng thời cho phép nhân bản giọng nói zero-shot từ các tệp âm thanh tham chiếu ngắn.
★ 1.394+4Thay đổi số sao trong 7 ngày qua - #10★ 1.275+130Thay đổi số sao trong 7 ngày qua
- #11
Bộ công cụ lượng tử hóa (nén) mô hình LLM hỗ trợ tăng tốc phần cứng cho GPU Nvidia, AMD, Intel và CPU Intel/AMD/Apple thông qua HF, vLLM và SGLang.
★ 1.248+0Thay đổi số sao trong 7 ngày qua - #12
Huấn luyện các mô hình giải mã suy đoán một cách dễ dàng và chuyển chúng một cách mượt mà sang dịch vụ SGLang.
★ 1.144+14Thay đổi số sao trong 7 ngày qua - #13★ 1.108+3Thay đổi số sao trong 7 ngày qua
- #14
SGLang-Omni hỗ trợ phục vụ hiệu suất cao cho TTS, ASR, các mô hình giọng nói và đa năng (omni).
★ 1.105+130Thay đổi số sao trong 7 ngày qua - #15
UniRL là một framework dành cho Học tăng cường mô hình đa phương thức thống nhất
★ 933+15Thay đổi số sao trong 7 ngày qua - #16
Lộ trình 10 tuần, mỗi ngày 30 phút về suy luận và tối ưu hóa LLM, bao gồm vLLM, SGLang, lượng tử hóa, giải mã suy đoán và đo điểm chuẩn.
★ 880+76Thay đổi số sao trong 7 ngày qua - #17
Dựa trên các mô hình như SparkTTS, OrpheusTTS, cung cấp dịch vụ tổng hợp giọng nói và nhân bản giọng nói tiếng Trung chất lượng cao.
★ 613+1Thay đổi số sao trong 7 ngày qua - #18
Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.
★ 510—Thay đổi số sao trong 7 ngày qua - #19
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 506—Thay đổi số sao trong 7 ngày qua