跳到主要内容
buildradar
Sign in
主题 · llm-eval

llm-eval

标记 llm-eval 主题、收录中的开源项目,按星标数排序。

项目数
6
总星标数
48,913
平均星标数
8,152
占比
0.00%

常跟 llm-eval 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 llm-eval 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • promptfoo@promptfoo

    测试你的提示、代理与检索增强生成,进行 AI 红队/渗透测试/漏洞扫描。比较 GPT、Claude、Gemini、DeepSeek 等表现。使用简洁声明式配置,支持命令行与 CI/CD 集成。OpenAI 与 Anthropic 均有使用。

    24,767+103近 7 天星标变化
  • phoenix@Arize-ai

    AI 可观测性与评估

    11,298+55近 7 天星标变化
  • giskard-oss@Giskard-AI

    🐢 开源的 LLM 代理评估与测试库

    5,801+9近 7 天星标变化
  • trulens@truera

    LLM 实验与 AI 代理的评估与追踪

    3,530+2近 7 天星标变化
  • uptrain@uptrain-ai

    UpTrain 是一个开源的统一平台,用于评估和改善生成式 AI 应用程序。我们提供 20 多项预先配置检查的评分(涵盖语言、代码、嵌入使用案例),对失败案例执行根本原因分析,并提供如何解决这些问题的见解。

    2,364+0近 7 天星标变化
  • tuui@AI-QL

    一款桌面端 MCP 客户端,设计为工具单一公用程序集成,通过 Model Context Protocol (MCP) 加速 AI 采用,并支持跨供应商的 LLM API 编排。

    1,153+1近 7 天星标变化
← 返回主题列表