Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · llm-serving

llm-serving

Các kho mã nguồn mở đang theo dõi được gắn thẻ llm-serving, sắp xếp theo số sao.

Kho mã
25
Tổng số sao
244.794
Số sao trung bình
9.792
Tỷ trọng
0,01%

Những chủ đề thường xuất hiện cùng llm-serving trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ llm-serving.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • vllm@vllm-project

    Engine suy luận và phục vụ hiệu suất cao, tối ưu bộ nhớ cho các LLM

    90.817+402Thay đổi số sao trong 7 ngày qua
  • ray@ray-project

    Ray là một công cụ tính toán AI. Ray bao gồm một runtime phân tán cốt lõi và một bộ thư viện AI để tăng tốc khối lượng công việc ML.

    43.688+41Thay đổi số sao trong 7 ngày qua
  • llm-action@liguodongiot

    Dự án này nhằm chia sẻ các nguyên lý kỹ thuật liên quan đến LLM và kinh nghiệm thực chiến (kỹ thuật hóa LLM, ứng dụng thực tế của LLM).

    24.995+21Thay đổi số sao trong 7 ngày qua
  • TensorRT-LLM@NVIDIA

    TensorRT LLM cung cấp cho người dùng một API Python dễ sử dụng để định nghĩa các Mô hình Ngôn ngữ Lớn (LLM) và hỗ trợ các tối ưu hóa tiên tiến nhất để thực thi suy luận hiệu quả trên GPU NVIDIA. TensorRT LLM cũng bao gồm các thành phần để tạo môi trường thực thi (runtime) Python và C++ giúp điều phối quá trình thực thi suy luận đạt hiệu suất cao.

    14.536+38Thay đổi số sao trong 7 ngày qua
  • OpenLLM@bentoml

    Chạy bất kỳ LLM mã nguồn mở nào, chẳng hạn như DeepSeek và Llama, như một điểm cuối API tương thích với OpenAI trên đám mây.

    12.524+1Thay đổi số sao trong 7 ngày qua
  • skypilot@skypilot-org

    Nền tảng tính toán AI dành cho các nhóm tiên phong. SkyPilot biến các tài nguyên tính toán AI rời rạc thành một siêu máy tính AI duy nhất, giúp các nhóm AI tiên phong xây dựng trí tuệ tùy chỉnh nhanh hơn.

    10.550+16Thay đổi số sao trong 7 ngày qua
  • BentoML@bentoml

    Cách dễ nhất để cung cấp các ứng dụng và mô hình AI - Xây dựng API suy luận mô hình, hàng đợi tác vụ, ứng dụng LLM, pipeline đa mô hình, v.v.!

    8.817+4Thay đổi số sao trong 7 ngày qua
  • gpustack@gpustack

    Trình quản lý cụm GPU dành cho việc phục vụ mô hình AI hiệu năng cao (vLLM, SGLang) và các instance GPU có thể truy cập SSH theo yêu cầu.

    5.593+21Thay đổi số sao trong 7 ngày qua
  • superduper@superduper-io

    Superduper: Framework end-to-end để xây dựng các ứng dụng và agent AI tùy chỉnh.

    5.318+1Thay đổi số sao trong 7 ngày qua
  • lorax@predibase

    Máy chủ suy luận Multi-LoRA mở rộng quy mô đến hàng nghìn LLM được tinh chỉnh

    3.827+1Thay đổi số sao trong 7 ngày qua
  • FastDeploy@PaddlePaddle

    Bộ công cụ suy luận và triển khai hiệu năng cao cho LLM và VLM dựa trên PaddlePaddle

    3.714+3Thay đổi số sao trong 7 ngày qua
  • chitu@thu-pacman

    Framework suy luận hiệu năng cao cho các mô hình ngôn ngữ lớn, tập trung vào hiệu quả, tính linh hoạt và khả năng sẵn sàng.

    2.997-1Thay đổi số sao trong 7 ngày qua
  • vllm-ascend@vllm-project

    Plugin phần cứng do cộng đồng duy trì cho vLLM trên Ascend

    2.749+19Thay đổi số sao trong 7 ngày qua
  • MoBA@MoonshotAI

    MoBA: Mixture of Block Attention dành cho các LLM ngữ cảnh dài (Long-Context LLMs)

    2.174+1Thay đổi số sao trong 7 ngày qua
  • aici@microsoft

    AICI: Prompt dưới dạng chương trình (Wasm)

    2.076+0Thay đổi số sao trong 7 ngày qua
  • InferenceX@SemiAnalysisAI

    Nền tảng nghiên cứu benchmark suy luận liên tục mã nguồn mở — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & sắp ra mắt™ TPUv6e/v7/Trainium2/3 | Nền tảng nghiên cứu benchmark suy luận liên tục mã nguồn mở — Kimi K2.7-Code, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72, sắp ra mắt™ TPUv6e/v7/Trainium2/3

    1.613+33Thay đổi số sao trong 7 ngày qua
  • parallax@GradientHQ

    Parallax là một framework phân phối mô hình phục vụ giúp bạn xây dựng cụm AI của riêng mình ở bất kỳ đâu

    1.372+4Thay đổi số sao trong 7 ngày qua
  • rtp-llm@alibaba

    RTP-LLM: Công cụ suy luận LLM hiệu suất cao của Alibaba cho các ứng dụng đa dạng.

    1.325+6Thay đổi số sao trong 7 ngày qua
  • kvcached@ovg-project

    Bộ nhớ đệm KV đàn hồi ảo hóa để chia sẻ GPU động và hơn thế nữa

    1.275+130Thay đổi số sao trong 7 ngày qua
  • Nanoflow@efeslab

    Một framework phục vụ LLM hiệu năng cao, hướng đến thông lượng

    975+1Thay đổi số sao trong 7 ngày qua
  • ZhiLight@zhihu

    Một công cụ tăng tốc suy luận LLM được tối ưu hóa cao cho Llama và các biến thể của nó.

    908+0Thay đổi số sao trong 7 ngày qua
  • mosec@mosecorg

    Framework phục vụ mô hình ML hiệu năng cao, cung cấp tính năng xử lý theo lô động và đường ống CPU/GPU để khai thác tối đa máy tính của bạn

    902+0Thay đổi số sao trong 7 ngày qua
  • helix@helixml

    Đội ngũ tác nhân riêng tư với Spec Coding. Mỗi tác nhân có máy tính để bàn tăng tốc GPU riêng. Chạy Claude, Codex, Gemini và các mô hình mở trên một AI Stack riêng tư hoàn chỉnh

    805+1Thay đổi số sao trong 7 ngày qua
  • pegainfer@pegainfer-project

    Công cụ suy luận LLM bằng Rust thuần + CUDA — không cần PyTorch, tương thích với OpenAI, hỗ trợ từ Qwen3 đến Kimi-K2.

    677+14Thay đổi số sao trong 7 ngày qua
  • LLM-FineTuning-Large-Language-Models@rohan-paul

    Tinh chỉnh (Fine-Tuning) mô hình ngôn ngữ lớn (LLM).

    579+1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề