跳到主要內容
buildradar
Sign in
主題 · llm-eval

llm-eval

標記 llm-eval 主題、收錄中的開源專案,依星數排序。

專案數
6
總星數
48,913
平均星數
8,152
佔比
0.00%

常跟 llm-eval 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 llm-eval 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • promptfoo@promptfoo

    測試你的提示、代理與檢索增強生成,進行 AI 紅隊/滲透測試/漏洞掃描。比較 GPT、Claude、Gemini、DeepSeek 等表現。使用簡潔宣告式設定,支援命令列與 CI/CD 整合。OpenAI 與 Anthropic 均有使用。

    24,767+103近 7 天星數變化
  • phoenix@Arize-ai

    AI 可觀測性與評估

    11,298+55近 7 天星數變化
  • giskard-oss@Giskard-AI

    🐢 開源的 LLM 代理評估與測試函式庫

    5,801+9近 7 天星數變化
  • trulens@truera

    LLM 實驗與 AI 代理的評估與追蹤

    3,530+2近 7 天星數變化
  • uptrain@uptrain-ai

    UpTrain 是一個開源的統一平台,用於評估和改善生成式 AI 應用程式。我們提供 20 多項預先設定檢查的評分(涵蓋語言、程式碼、嵌入使用案例),對失敗案例執行根本原因分析,並提供如何解決這些問題的見解。

    2,364+0近 7 天星數變化
  • tuui@AI-QL

    一款桌面端 MCP 客戶端,設計為工具單一公用程式整合,透過 Model Context Protocol (MCP) 加速 AI 採用,並支援跨供應商的 LLM API 編排。

    1,153+1近 7 天星數變化
← 返回主題列表