跳到主要內容
buildradar
Sign in
主題 · agent-evaluation

agent-evaluation

標記 agent-evaluation 主題、收錄中的開源專案,依星數排序。

專案數
9
總星數
32,319
平均星數
3,591
佔比
0.00%

常跟 agent-evaluation 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 agent-evaluation 主題的專案。

  • awesome-evals@benchflow-ai

    一個精選且無廢話的最佳 AI 代理建構與評估資源庫——論文、部落格、演講、工具、基準測試。由 BenchFlow 維護。

    864
  • iFixAi@ifixai-ai

    AI 代理的獨立審計。由人類或代理自行執行,以回答 AI 代理經濟中最關鍵的問題:代理是否在執行其應有的任務?使用 iFixAi,您可在 120 秒內得到答案。

    12,643+1,247近 7 天星數變化
  • giskard-oss@Giskard-AI

    🐢 開源的 LLM 代理評估與測試函式庫

    5,801+9近 7 天星數變化
  • coze-loop@coze-dev

    下一代 AI 代理優化平台:Cozeloop 提供從開發、除錯、評估到監控的全生命週期管理,解決 AI 代理開發挑戰。

    5,711+5近 7 天星數變化
  • trulens@truera

    LLM 實驗與 AI 代理的評估與追蹤

    3,530+2近 7 天星數變化
  • any-agent@mozilla-ai

    用於使用與評估不同 agent 框架的單一介面

    1,199+2近 7 天星數變化
  • intelligent-audit-system@Ricky-7-Yan

    AuditPilot:具備可稽核性的企業級 AI 代理,支援以證據為基礎的工作流程、受管工具、評估工具、人工審查與修復交付。

    1,166+0近 7 天星數變化
  • awesome-evals@benchflow-ai

    一個精選且無廢話的最佳 AI 代理建構與評估資源庫——論文、部落格、演講、工具、基準測試。由 BenchFlow 維護。

    864+17近 7 天星數變化
  • pandaprobe@chirpz-ai

    開源 agent 工程平台:用於除錯和改進 AI agent 的追蹤、評估與指標。整合了 LangGraph、CrewAI、Claude Agent SDK 等。

    783+1近 7 天星數變化
  • ClawBench@TIGER-AI-Lab

    用於瀏覽器 AI 代理日常任務的開源基準測試

    657+54近 7 天星數變化
← 返回主題列表