inference
标记 inference 主题、收录中的开源项目,按星标数排序。
- #61
管理构建于 Envoy Gateway 之上的生成式 AI 服务统一访问
★ 1,990+0近 7 天星标变化 - #62★ 1,927+0近 7 天星标变化
- #63
AgiBot X1 的推理模块。
★ 1,835+0近 7 天星标变化 - #64★ 1,711+0近 7 天星标变化
- #65
高效、可扩展且具备企业级水准的 CPU/GPU 推理服务器,适用于 🤗 Hugging Face transformer 模型 🚀
★ 1,690+0近 7 天星标变化 - #66★ 1,687+0近 7 天星标变化
- #67
开源持续推理基准研究平台 — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & 即将推出™ TPUv6e/v7/Trainium2/3
★ 1,613+0近 7 天星标变化 - #68
通过统一的 API 接口,跨多个供应商路由、管理和分析您的 LLM 请求。
★ 1,594+0近 7 天星标变化 - #69★ 1,552+0近 7 天星标变化
- #70
使用 nvidia-smi 二进制文件或 NVML 的 Prometheus Nvidia GPU 导出器
★ 1,550+0近 7 天星标变化 - #71
用于 CPU 与 GPU 上 transformer 推理(Bert、Albert、GPT2、Decoders 等)的快速且使用者友善的执行环境。
★ 1,550+0近 7 天星标变化 - #72★ 1,343+0近 7 天星标变化
- #73★ 1,325+0近 7 天星标变化
- #74
采用 Rust 构建的高性能、模块化、内存安全且生产就绪的推理、摄取和索引工具 🦀
★ 1,305+0近 7 天星标变化 - #75
用于图形与成对设置中因果推断的软件包。包含图形结构恢复与依赖性工具。
★ 1,237+0近 7 天星标变化 - #76★ 1,224+0近 7 天星标变化
- #77★ 1,201+0近 7 天星标变化
- #78
Qualcomm® AI Hub Models 是我们针对性能(延迟、内存等)优化并可随时部署至 Qualcomm® 设备的最先进机器学习模型集合。
★ 1,195+0近 7 天星标变化 - #79
SGLang-Omni 为 TTS、ASR、语音与全能模型提供高性能服务。
★ 1,118+56近 7 天星标变化 - #80
适用于 Apple Silicon 的原生 LLM 推理服务器。兼容 OpenAI + Anthropic API。无 Python。包含带聊天、agent 模式和工具调用功能的 MLX Core macOS 应用。
★ 1,115+39近 7 天星标变化 - #81★ 1,100+10近 7 天星标变化
- #82★ 975+1近 7 天星标变化
- #83★ 967+7近 7 天星标变化
- #84★ 957+0近 7 天星标变化
- #85★ 944+1近 7 天星标变化
- #86★ 943+0近 7 天星标变化
- #87
为使用 OpenVINO™ 优化之模型所设计的可扩展推理服务器
★ 928+4近 7 天星标变化 - #88★ 922+783近 7 天星标变化
- #89★ 868+2近 7 天星标变化
- #90★ 851-1近 7 天星标变化