主题 · llm-eval
llm-eval
标记 llm-eval 主题、收录中的开源项目,按星标数排序。
项目数
6
总星标数
48,913
平均星标数
8,152
占比
0.00%
相关主题
常跟 llm-eval 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 llm-eval 主题的项目。
近 90 天内还没有新项目标记这个主题。
- #1
测试你的提示、代理与检索增强生成,进行 AI 红队/渗透测试/漏洞扫描。比较 GPT、Claude、Gemini、DeepSeek 等表现。使用简洁声明式配置,支持命令行与 CI/CD 集成。OpenAI 与 Anthropic 均有使用。
★ 24,767+103近 7 天星标变化 - #2★ 11,298+55近 7 天星标变化
- #3
🐢 开源的 LLM 代理评估与测试库
★ 5,801+9近 7 天星标变化 - #4★ 3,530+2近 7 天星标变化
- #5
UpTrain 是一个开源的统一平台,用于评估和改善生成式 AI 应用程序。我们提供 20 多项预先配置检查的评分(涵盖语言、代码、嵌入使用案例),对失败案例执行根本原因分析,并提供如何解决这些问题的见解。
★ 2,364+0近 7 天星标变化 - #6
一款桌面端 MCP 客户端,设计为工具单一公用程序集成,通过 Model Context Protocol (MCP) 加速 AI 采用,并支持跨供应商的 LLM API 编排。
★ 1,153+1近 7 天星标变化