Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · inference

inference

Các kho mã nguồn mở đang theo dõi được gắn thẻ inference, sắp xếp theo số sao.

120 kho mã
  • ai-gateway@envoyproxy

    Quản lý quyền truy cập thống nhất vào các dịch vụ Generative AI được xây dựng trên Envoy Gateway

    1.990+16Thay đổi số sao trong 7 ngày qua
  • picolm@RightNow-AI

    Chạy một LLM 1 tỷ tham số trên bo mạch 10 USD với RAM 256MB

    1.927+4Thay đổi số sao trong 7 ngày qua
  • agibot_x1_infer@AgibotTech

    Mô-đun suy luận cho AgiBot X1.

    1.835+1Thay đổi số sao trong 7 ngày qua
  • NNPACK@Maratyszcza

    Gói tăng tốc cho mạng neural trên CPU đa nhân

    1.711+1Thay đổi số sao trong 7 ngày qua
  • Máy chủ suy luận CPU/GPU hiệu quả, có khả năng mở rộng và đạt chuẩn doanh nghiệp cho các mô hình transformer của 🤗 Hugging Face 🚀

    1.690+0Thay đổi số sao trong 7 ngày qua
  • uzu@trymirai

    Công cụ suy luận hiệu suất cao cho các mô hình AI

    1.687+4Thay đổi số sao trong 7 ngày qua
  • InferenceX@SemiAnalysisAI

    Nền tảng nghiên cứu benchmark suy luận liên tục mã nguồn mở — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & sắp ra mắt™ TPUv6e/v7/Trainium2/3 | Nền tảng nghiên cứu benchmark suy luận liên tục mã nguồn mở — Kimi K2.7-Code, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72, sắp ra mắt™ TPUv6e/v7/Trainium2/3

    1.613+33Thay đổi số sao trong 7 ngày qua
  • llmgateway@theopenco

    Định tuyến, quản lý và phân tích các yêu cầu LLM của bạn trên nhiều nhà cung cấp với một giao diện API thống nhất.

    1.594+8Thay đổi số sao trong 7 ngày qua
  • xllm@xLLM-AI

    Một công cụ suy luận hiệu năng cao cho các mô hình LLM, VLM, DiT và REC, được tối ưu hóa cho nhiều bộ tăng tốc AI khác nhau. Được lưu trữ tại OpenAtom Foundation.

    1.552+11Thay đổi số sao trong 7 ngày qua
  • Runtime nhanh và thân thiện với người dùng dành cho suy luận transformer (Bert, Albert, GPT2, Decoders, v.v.) trên CPU và GPU.

    1.550+1Thay đổi số sao trong 7 ngày qua
  • Nvidia GPU exporter cho prometheus sử dụng tệp nhị phân nvidia-smi HOẶC sử dụng NVML

    1.550+4Thay đổi số sao trong 7 ngày qua
  • budgetml@ebhy

    Triển khai dịch vụ suy luận ML với ngân sách hạn hẹp trong chưa đầy 10 dòng mã.

    1.343+0Thay đổi số sao trong 7 ngày qua
  • rtp-llm@alibaba

    RTP-LLM: Công cụ suy luận LLM hiệu suất cao của Alibaba cho các ứng dụng đa dạng.

    1.325+6Thay đổi số sao trong 7 ngày qua
  • EmbedAnything@StarlightSearch

    Hiệu suất cao, dạng mô-đun, an toàn bộ nhớ và sẵn sàng cho môi trường production với các tính năng suy luận, thu thập và lập chỉ mục được xây dựng bằng Rust 🦀

    1.305-1Thay đổi số sao trong 7 ngày qua
  • CausalDiscoveryToolbox@FenTechSolutions

    Gói suy luận nhân quả trong đồ thị và thiết lập theo cặp. Bao gồm các công cụ khôi phục cấu trúc đồ thị và phụ thuộc.

    1.237+0Thay đổi số sao trong 7 ngày qua
  • kubetorch@run-house

    Phân phối và chạy các workload AI trên Kubernetes một cách kỳ diệu bằng Python, giống như PyTorch cho cơ sở hạ tầng ML.

    1.224+0Thay đổi số sao trong 7 ngày qua
  • kvpress@NVIDIA

    Làm cho việc nén bộ nhớ đệm KV của LLM trở nên dễ dàng

    1.201+5Thay đổi số sao trong 7 ngày qua
  • ai-hub-models@qualcomm

    Qualcomm® AI Hub Models là bộ sưu tập các mô hình học máy tiên tiến được tối ưu hóa về hiệu suất (độ trễ, bộ nhớ, v.v.) và sẵn sàng triển khai trên các thiết bị Qualcomm®.

    1.195+1Thay đổi số sao trong 7 ngày qua
  • sglang-omni@sgl-project

    SGLang-Omni hỗ trợ phục vụ hiệu suất cao cho TTS, ASR, các mô hình giọng nói và đa năng (omni).

    1.118+143Thay đổi số sao trong 7 ngày qua
  • mlx-serve@ddalcu

    Máy chủ suy luận LLM gốc cho Apple Silicon. Tương thích với API OpenAI và Anthropic. Không sử dụng Python. Bao gồm ứng dụng MLX Core trên macOS với tính năng trò chuyện, chế độ đại lý và gọi công cụ.

    1.115+245Thay đổi số sao trong 7 ngày qua
  • tiny-vllm@jmaczan

    Xây dựng công cụ suy luận LLM hiệu suất cao của riêng bạn bằng C++ và CUDA - một phiên bản nhỏ hơn của vLLM

    1.094+15Thay đổi số sao trong 7 ngày qua
  • Nanoflow@efeslab

    Một framework phục vụ LLM hiệu năng cao, hướng đến thông lượng

    975+1Thay đổi số sao trong 7 ngày qua
  • mlxstudio@jjang-ai

    MLX Studio - Nơi của JANG_Q - Tạo/Chỉnh sửa Ảnh + Trò chuyện/Mã nguồn Tất cả trong một - + OpenClaw (Anthropic API)

    964+6Thay đổi số sao trong 7 ngày qua
  • bolt@huawei-noah

    Bolt là một thư viện học sâu có hiệu suất cao và tính linh hoạt không đồng nhất.

    957+0Thay đổi số sao trong 7 ngày qua
  • ims@OpenIntroStat

    📚 Giới thiệu về Thống kê Hiện đại - Sách giáo khoa mã nguồn mở cấp đại học với phương pháp tiếp cận hiện đại, làm nổi bật các mối quan hệ đa biến và suy luận dựa trên mô phỏng.

    944+1Thay đổi số sao trong 7 ngày qua
  • neuropod@uber

    Một giao diện đồng nhất để chạy các mô hình học sâu từ nhiều framework

    943+0Thay đổi số sao trong 7 ngày qua
  • model_server@openvinotoolkit

    Một máy chủ suy luận có khả năng mở rộng cho các mô hình được tối ưu hóa bằng OpenVINO™

    927+5Thay đổi số sao trong 7 ngày qua
  • bark.cpp@PABannier

    Mô hình Bark của Suno AI viết bằng C/C++ để tạo văn bản thành giọng nói tốc độ cao

    867+1Thay đổi số sao trong 7 ngày qua
  • pipeless@pipeless-ai

    Một framework thị giác máy tính mã nguồn mở để xây dựng và triển khai ứng dụng trong vài phút

    851-1Thay đổi số sao trong 7 ngày qua
  • pytriton@triton-inference-server

    PyTriton là giao diện giống Flask/FastAPI giúp đơn giản hóa việc triển khai Triton trong môi trường Python.

    848+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề