llm-inference
标记 llm-inference 主题、收录中的开源项目,按星标数排序。
- #31
分散式 LLM 推理。将家用设备连接成强大集群,加速 LLM 推理。设备越多,推理越快
★ 3,050+0近 7 天星标变化 - #32★ 2,771+0近 7 天星标变化
- #33★ 2,521+0近 7 天星标变化
- #34★ 2,439+0近 7 天星标变化
- #35
PHP 生态系统的 Agentic 框架,用于构建可投入生产的 AI 驱动应用程序。将组件(LLMs、工具、向量数据库、内存)连接到与您的数据和 UI 交互的 Agent。
★ 2,086+0近 7 天星标变化 - #36★ 2,076+0近 7 天星标变化
- #37
在任何地方(Linux/Windows/Mac)通过 GPU 或 CPU 结合 gradio UI 在本地运行任何 Llama 2。使用 `llama2-wrapper` 作为生成式代理/应用程序的本地 llama2 后端。
★ 1,936+0近 7 天星标变化 - #38★ 1,764+0近 7 天星标变化
- #39
借助 ExecuTorch 在 React Native 设备端以声明式方式运行 AI 模型。
★ 1,707+0近 7 天星标变化 - #40
开源持续推理基准研究平台 — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & 即将推出™ TPUv6e/v7/Trainium2/3
★ 1,613+0近 7 天星标变化 - #41★ 1,552+0近 7 天星标变化
- #42
通过点数、补助金与资源在印度推动 AI 发展的非营利组织
★ 1,461+0近 7 天星标变化 - #43★ 1,449+0近 7 天星标变化
- #44
允许通过 AI 辅助进行网络搜索的软件清单:https://hf.co/spaces/felladrin/awesome-ai-web-search
★ 1,426+0近 7 天星标变化 - #45
供 Agent 使用的本地 AI 应用与推理引擎。在你的电脑上私密、100% 离线运行开放权重 LLM。欢迎加入我们的 Discord:https://discord.com/invite/8wGSsvmg4V
★ 1,413+0近 7 天星标变化 - #46
《How To Scale Your Model》的主页,这本短篇博客风格教材介绍了如何在 TPU 上扩展 LLM
★ 1,396+0近 7 天星标变化 - #47
跨多个领域的顶级渗透测试工具与生产力实用程序精选集合。加入我们以探索、贡献并增强您的黑客工具箱!
★ 1,383+0近 7 天星标变化 - #48
在 Lean 中作为定理证明 Copilot 的 LLM
★ 1,318+0近 7 天星标变化 - #49★ 1,275+0近 7 天星标变化
- #50
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1,266+197近 7 天星标变化 - #51
通过低代码方式简化开发者与非技术用户的 Prompt 设计。
★ 1,154+0近 7 天星标变化 - #52★ 1,100+10近 7 天星标变化
- #53
OpenAlpha_Evolve 是一个开源 Python 框架,灵感来自于 DeepMind AlphaEvolve 等自主编码代理的突破性研究。
★ 1,050-1近 7 天星标变化 - #54
“AI-Compass”将为社区指引在 AI 技术海洋中航行的方向,无论你是初学者还是进阶开发者,都能在这里找到通往 AI 各大方向的路径。旨在帮助开发者系统性地了解 AI 的核心概念、主流技术、前沿趋势,并通过实践掌握从理论到落地的全过程。
★ 937+7近 7 天星标变化 - #55
按最低方案价格排序的 awesome 主机清单
★ 926+2近 7 天星标变化 - #56
用于在计算机上进行实时聊天的多个模型的纯 C++ 实现(支持 CPU 和 GPU)
★ 925+3近 7 天星标变化 - #57★ 908+0近 7 天星标变化
- #58★ 890+1近 7 天星标变化
- #59
为期 10 周、每天 30 分钟的 LLM 推理服务与优化学习蓝图。包含 vLLM、SGLang、量化、推测解码、性能评测。
★ 887+21近 7 天星标变化 - #60★ 874+1近 7 天星标变化