跳到主要內容
buildradar
登入
主題 · llm-inference

llm-inference

標記 llm-inference 主題、收錄中的開源專案,依星數排序。

共 84 個專案
  • 分散式 LLM 推理。將家用裝置連接成強大叢集,加速 LLM 推理。裝置越多,推理越快

    3,050+0近 7 天星數變化
  • Medusa@FasterDecoding

    Medusa:透過多個解碼頭加速 LLM 生成的簡單框架

    2,771+0近 7 天星數變化
  • EAGLE@SafeAILab

    EAGLE-1 (ICML'24)、EAGLE-2 (EMNLP'24) 與 EAGLE-3 (NeurIPS'25) 的官方實作。

    2,521+0近 7 天星數變化
  • nanocoder@Nano-Collective

    一個適用於終端機的開源編碼代理程式,由社群集體打造而非單一公司。自備模型、將程式碼保留在本地電腦上,且不欠任何人任何東西。

    2,439+0近 7 天星數變化
  • neuron-ai@neuron-core

    PHP 生態系統的 Agentic 框架,用於建構可投入生產的 AI 驅動應用程式。將元件(LLMs、工具、向量資料庫、記憶體)連接到與您的資料和 UI 互動的 Agent。

    2,086+0近 7 天星數變化
  • aici@microsoft

    AICI:將提示詞作為 (Wasm) 程式

    2,076+0近 7 天星數變化
  • llama2-webui@liltom-eth

    在任何地方(Linux/Windows/Mac)透過 GPU 或 CPU 結合 gradio UI 在本地執行任何 Llama 2。使用 `llama2-wrapper` 作為生成式代理/應用程式的本地 llama2 後端。

    1,936+0近 7 天星數變化
  • beta9@beam-cloud

    超高速無伺服器 GPU 推論、沙箱與背景工作

    1,764+0近 7 天星數變化
  • react-native-executorch@software-mansion

    透過 ExecuTorch 在 React Native 裝置端以宣告式方式執行 AI 模型。

    1,707+0近 7 天星數變化
  • InferenceX@SemiAnalysisAI

    開源持續推論基準研究平台 — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & 即將推出™ TPUv6e/v7/Trainium2/3

    1,613+0近 7 天星數變化
  • xllm@xLLM-AI

    針對 LLM、VLM、DiT 與 REC 模型的高效能推論引擎,針對各種 AI 加速器進行最佳化。託管於 OpenAtom Foundation。

    1,552+0近 7 天星數變化
  • aigrantsindia@aigrantsindia

    透過點數、補助金與資源在印度推動 AI 發展的非營利組織

    1,461+0近 7 天星數變化
  • BrowserAI@sauravpanda

    在瀏覽器中執行本機 LLM,例如 llama、deepseek-distill、kokoro 等

    1,449+0近 7 天星數變化
  • 允許透過 AI 輔助進行網路搜尋的軟體清單:https://hf.co/spaces/felladrin/awesome-ai-web-search

    1,426+0近 7 天星數變化
  • Atomic-Chat@AtomicBot-ai

    供 Agent 使用的本地 AI 應用程式與推論引擎。在你的電腦上私密、100% 離線運行開放權重 LLM。歡迎加入我們的 Discord:https://discord.com/invite/8wGSsvmg4V

    1,413+0近 7 天星數變化
  • scaling-book@jax-ml

    《How To Scale Your Model》的主頁,這本短篇部落格風格教材介紹了如何在 TPU 上擴充 LLM

    1,396+0近 7 天星數變化
  • 跨多領域的頂級滲透測試工具與生產力公用程式精選集合。加入我們以探索、貢獻並強化您的駭客工具箱!

    1,383+0近 7 天星數變化
  • LeanCopilot@lean-dojo

    在 Lean 中作為定理證明 Copilot 的 LLM

    1,318+0近 7 天星數變化
  • kvcached@ovg-project

    用於動態 GPU 共用及更高應用的虛擬化彈性 KV 快取

    1,275+0近 7 天星數變化
  • Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks

    1,266+197近 7 天星數變化
  • prompt-poet@character-ai

    透過低程式碼方式簡化開發者與非技術使用者的 Prompt 設計。

    1,154+0近 7 天星數變化
  • tiny-vllm@jmaczan

    使用 C++ 與 CUDA 建構你自己的高效能 LLM 推理引擎 - vLLM 的精簡版

    1,100+10近 7 天星數變化
  • OpenAlpha_Evolve@shyamsaktawat

    OpenAlpha_Evolve 是一個開源 Python 框架,靈感來自於 DeepMind AlphaEvolve 等自主編碼代理的突破性研究。

    1,050-1近 7 天星數變化
  • AI-Compass@tingaicompass

    「AI-Compass」將為社群指引在 AI 技術海洋中航行的方向,無論你是初學者還是進階開發者,都能在這裡找到通往 AI 各大方向的路徑。旨在幫助開發者系統性地了解 AI 的核心概念、主流技術、前沿趨勢,並透過實踐掌握從理論到落地的全過程。

    937+7近 7 天星數變化
  • 按最低方案價格排序的 awesome 主機清單

    926+2近 7 天星數變化
  • 用於在電腦上進行即時聊天的多個模型的純 C++ 實作(支援 CPU 與 GPU)

    925+3近 7 天星數變化
  • ZhiLight@zhihu

    針對 Llama 及其變體的高度最佳化 LLM 推論加速引擎。

    908+0近 7 天星數變化
  • llm_note@harleyszhang

    LLM 筆記,包含模型推論、Transformer 模型結構,以及 LLM 框架程式碼分析筆記。

    890+1近 7 天星數變化
  • 為期 10 週、每天 30 分鐘的 LLM 推論服務與最佳化學習藍圖。包含 vLLM、SGLang、量化、推測解碼、效能評測。

    887+21近 7 天星數變化
  • LLM.swift@eastriverlee

    LLM.swift 是一個簡單易讀的函式庫,讓您能在 macOS、iOS、watchOS、tvOS 和 visionOS 上輕鬆地在本地端與大型語言模型互動。

    874+1近 7 天星數變化
← 返回主題列表