主题 · evaluation-metrics
evaluation-metrics
标记 evaluation-metrics 主题、收录中的开源项目,按星标数排序。
项目数
12
总星标数
39,801
平均星标数
3,317
占比
0.00%
相关主题
常跟 evaluation-metrics 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 evaluation-metrics 主题的项目。
- #1★ 18,063+110近 7 天星标变化
- #2
Python SDK,用于 AI 代理监控、LLM 成本追踪、基准测试等,集成多数 LLM 和代理框架,包括 CrewAI、Agno、OpenAI Agents SDK、Langchain、Autogen、AG2、CamelAI
★ 5,808+3近 7 天星标变化 - #3
《大模型白盒子构建指南》:一个全手搓的 Tiny-Universe
★ 5,040+9近 7 天星标变化 - #4★ 2,533+3近 7 天星标变化
- #5
分享我们在管理 Open LLM Leaderboard 与设计 lighteval 期间所积累关于 LLM 评估的实务见解与理论知识!
★ 2,143+2近 7 天星标变化 - #6★ 1,846+0近 7 天星标变化
- #7★ 928+2近 7 天星标变化
- #8★ 804+0近 7 天星标变化
- #9★ 778+1近 7 天星标变化
- #10★ 698+5近 7 天星标变化
- #11
:chart_with_upwards_trend: 实现八种用于评估两张图像相似度的评估指标。这八种指标分别为:RMSE、PSNR、SSIM、ISSM、FSIM、SRE、SAM 与 UIQ。
★ 647+0近 7 天星标变化 - #12
基于 LLM 应用程序的数据驱动评估
★ 517+1近 7 天星标变化