Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · vllm

vllm

Các kho mã nguồn mở đang theo dõi được gắn thẻ vllm, sắp xếp theo số sao.

52 kho mã
  • prometheus-eval@prometheus-eval

    Đánh giá phản hồi LLM của bạn với Prometheus và GPT4 💯

    1.111+4Thay đổi số sao trong 7 ngày qua
  • tiny-vllm@jmaczan

    Xây dựng công cụ suy luận LLM hiệu suất cao của riêng bạn bằng C++ và CUDA - một phiên bản nhỏ hơn của vLLM

    1.094+15Thay đổi số sao trong 7 ngày qua
  • verl-omni@verl-project

    Khung huấn luyện RL đa phương thức cho các mô hình diffusion và omni

    968+73Thay đổi số sao trong 7 ngày qua
  • UniRL@Tencent-Hunyuan

    UniRL là một framework dành cho Học tăng cường mô hình đa phương thức thống nhất

    936+18Thay đổi số sao trong 7 ngày qua
  • llm_note@harleyszhang

    Ghi chú về LLM, bao gồm suy luận mô hình, cấu trúc mô hình transformer và ghi chú phân tích mã nguồn framework LLM.

    890+2Thay đổi số sao trong 7 ngày qua
  • Lộ trình 10 tuần, mỗi ngày 30 phút về suy luận và tối ưu hóa LLM, bao gồm vLLM, SGLang, lượng tử hóa, giải mã suy đoán và đo điểm chuẩn.

    882+78Thay đổi số sao trong 7 ngày qua
  • local_ai_ocr@th1nhhdk

    Phần mềm OCR cục bộ, ngoại tuyến (sau khi thiết lập ban đầu), di động có khả năng xử lý hình ảnh và tệp PDF, sử dụng AI DeepSeek-OCR-2 (chạy trực tiếp trên máy của bạn).

    874+4Thay đổi số sao trong 7 ngày qua
  • llm-server-docs@varunvasudeva1

    Tài liệu toàn diện để thiết lập máy chủ LLM cục bộ và hoàn toàn riêng tư trên Debian. Được trang bị tính năng trò chuyện, tìm kiếm web, RAG, quản lý mô hình, máy chủ MCP, tạo hình ảnh và TTS.

    834-2Thay đổi số sao trong 7 ngày qua
  • llmcord@jakobdylanc

    Biến Discord thành giao diện LLM của bạn - Hỗ trợ bất kỳ API tương thích OpenAI nào (OpenRouter, Ollama và hơn thế nữa).

    830+5Thay đổi số sao trong 7 ngày qua
  • BambooAI@pgalko

    Một thư viện Python được hỗ trợ bởi các Mô hình Ngôn ngữ Lớn (LLM) để khám phá và phân tích dữ liệu hội thoại.

    787+1Thay đổi số sao trong 7 ngày qua
  • LightCompress@ModelTC

    [EMNLP 2024 & AAAI 2026] Bộ công cụ mạnh mẽ để nén các mô hình lớn bao gồm LLM, VLM và các mô hình tạo video

    747+4Thay đổi số sao trong 7 ngày qua
  • pegainfer@pegainfer-project

    Công cụ suy luận LLM bằng Rust thuần + CUDA — không cần PyTorch, tương thích với OpenAI, hỗ trợ từ Qwen3 đến Kimi-K2.

    678+17Thay đổi số sao trong 7 ngày qua
  • vidur@microsoft

    Trình mô phỏng chính xác, quy mô lớn và có khả năng mở rộng cho các hệ thống suy luận LLM

    673+5Thay đổi số sao trong 7 ngày qua
  • efficientsam3@SimonZeng7108

    EfficientSAM3 nén SAM3 thành các mô hình nhẹ, thân thiện với thiết bị biên thông qua chưng cất tri thức lũy tiến để phân đoạn và theo dõi khái niệm nhanh chóng.

    668+9Thay đổi số sao trong 7 ngày qua
  • FlashTTS@HuiResearch

    Dựa trên các mô hình như SparkTTS, OrpheusTTS, cung cấp dịch vụ tổng hợp giọng nói và nhân bản giọng nói tiếng Trung chất lượng cao.

    614+1Thay đổi số sao trong 7 ngày qua
  • RoboBrain@FlagOpen

    [CVPR 2025] RoboBrain: Mô hình não bộ thống nhất cho thao tác robot từ trừu tượng đến cụ thể. Kho lưu trữ chính thức.

    563+0Thay đổi số sao trong 7 ngày qua
  • crater@raids-lab

    Crater là nền tảng huấn luyện và suy luận AI dựa trên đám mây.

    554+2Thay đổi số sao trong 7 ngày qua
  • vllm-playground@micytao

    Giao diện web hiện đại để quản lý và tương tác với các máy chủ vLLM (www.github.com/vllm-project/vllm). Hỗ trợ cả chế độ GPU và CPU, với các tối ưu hóa đặc biệt cho macOS Apple Silicon và triển khai doanh nghiệp trên OpenShift/Kubernetes.

    531+9Thay đổi số sao trong 7 ngày qua
  • taOS@jaylfc

    Self-hosted AI agent OS. Your memory, chat, agents, and files stay on hardware you own, offline by default, cloud by choice. Offline AI memory (taOSmd), self-hosted multi-framework group chat, a full web desktop + app store, and auto-clustering across the consumer hardware you already have (Orange/Raspberry Pi, Mac mini, gaming PC).

    521+17Thay đổi số sao trong 7 ngày qua
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    514Thay đổi số sao trong 7 ngày qua
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    507Thay đổi số sao trong 7 ngày qua
  • vllm-cli@Chen-zexi

    Công cụ giao diện dòng lệnh để phục vụ LLM sử dụng vLLM

    505-1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề