llm-inference
標記 llm-inference 主題、收錄中的開源專案,依星數排序。
- #31
分散式 LLM 推理。將家用裝置連接成強大叢集,加速 LLM 推理。裝置越多,推理越快
★ 3,050+0近 7 天星數變化 - #32★ 2,771+0近 7 天星數變化
- #33★ 2,521+0近 7 天星數變化
- #34★ 2,439+0近 7 天星數變化
- #35
PHP 生態系統的 Agentic 框架,用於建構可投入生產的 AI 驅動應用程式。將元件(LLMs、工具、向量資料庫、記憶體)連接到與您的資料和 UI 互動的 Agent。
★ 2,086+0近 7 天星數變化 - #36★ 2,076+0近 7 天星數變化
- #37
在任何地方(Linux/Windows/Mac)透過 GPU 或 CPU 結合 gradio UI 在本地執行任何 Llama 2。使用 `llama2-wrapper` 作為生成式代理/應用程式的本地 llama2 後端。
★ 1,936+0近 7 天星數變化 - #38★ 1,764+0近 7 天星數變化
- #39
透過 ExecuTorch 在 React Native 裝置端以宣告式方式執行 AI 模型。
★ 1,707+0近 7 天星數變化 - #40
開源持續推論基準研究平台 — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & 即將推出™ TPUv6e/v7/Trainium2/3
★ 1,613+0近 7 天星數變化 - #41★ 1,552+0近 7 天星數變化
- #42
透過點數、補助金與資源在印度推動 AI 發展的非營利組織
★ 1,461+0近 7 天星數變化 - #43★ 1,449+0近 7 天星數變化
- #44
允許透過 AI 輔助進行網路搜尋的軟體清單:https://hf.co/spaces/felladrin/awesome-ai-web-search
★ 1,426+0近 7 天星數變化 - #45
供 Agent 使用的本地 AI 應用程式與推論引擎。在你的電腦上私密、100% 離線運行開放權重 LLM。歡迎加入我們的 Discord:https://discord.com/invite/8wGSsvmg4V
★ 1,413+0近 7 天星數變化 - #46
《How To Scale Your Model》的主頁,這本短篇部落格風格教材介紹了如何在 TPU 上擴充 LLM
★ 1,396+0近 7 天星數變化 - #47
跨多領域的頂級滲透測試工具與生產力公用程式精選集合。加入我們以探索、貢獻並強化您的駭客工具箱!
★ 1,383+0近 7 天星數變化 - #48
在 Lean 中作為定理證明 Copilot 的 LLM
★ 1,318+0近 7 天星數變化 - #49★ 1,275+0近 7 天星數變化
- #50
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1,266+197近 7 天星數變化 - #51
透過低程式碼方式簡化開發者與非技術使用者的 Prompt 設計。
★ 1,154+0近 7 天星數變化 - #52★ 1,100+10近 7 天星數變化
- #53
OpenAlpha_Evolve 是一個開源 Python 框架,靈感來自於 DeepMind AlphaEvolve 等自主編碼代理的突破性研究。
★ 1,050-1近 7 天星數變化 - #54
「AI-Compass」將為社群指引在 AI 技術海洋中航行的方向,無論你是初學者還是進階開發者,都能在這裡找到通往 AI 各大方向的路徑。旨在幫助開發者系統性地了解 AI 的核心概念、主流技術、前沿趨勢,並透過實踐掌握從理論到落地的全過程。
★ 937+7近 7 天星數變化 - #55
按最低方案價格排序的 awesome 主機清單
★ 926+2近 7 天星數變化 - #56
用於在電腦上進行即時聊天的多個模型的純 C++ 實作(支援 CPU 與 GPU)
★ 925+3近 7 天星數變化 - #57★ 908+0近 7 天星數變化
- #58★ 890+1近 7 天星數變化
- #59
為期 10 週、每天 30 分鐘的 LLM 推論服務與最佳化學習藍圖。包含 vLLM、SGLang、量化、推測解碼、效能評測。
★ 887+21近 7 天星數變化 - #60
LLM.swift 是一個簡單易讀的函式庫,讓您能在 macOS、iOS、watchOS、tvOS 和 visionOS 上輕鬆地在本地端與大型語言模型互動。
★ 874+1近 7 天星數變化