主題 · evaluation-metrics
evaluation-metrics
標記 evaluation-metrics 主題、收錄中的開源專案,依星數排序。
專案數
12
總星數
39,801
平均星數
3,317
佔比
0.00%
相關主題
常跟 evaluation-metrics 一起出現在同一個專案上的主題。
近期新秀
近 90 天內建立、標記 evaluation-metrics 主題的專案。
- #1★ 18,063+110近 7 天星數變化
- #2
Python SDK,用於 AI 代理監控、LLM 成本追蹤、效能基準測試等,支援多數 LLM 與代理框架,包括 CrewAI、Agno、OpenAI Agents SDK、Langchain、Autogen、AG2、CamelAI
★ 5,808+3近 7 天星數變化 - #3
《大模型白盒子构建指南》:一個全手搓的 Tiny-Universe
★ 5,040+9近 7 天星數變化 - #4★ 2,533+3近 7 天星數變化
- #5
分享我們在管理 Open LLM Leaderboard 與設計 lighteval 期間所累積關於 LLM 評估的實務見解與理論知識!
★ 2,143+2近 7 天星數變化 - #6★ 1,846+0近 7 天星數變化
- #7★ 928+2近 7 天星數變化
- #8★ 804+0近 7 天星數變化
- #9★ 778+1近 7 天星數變化
- #10★ 698+5近 7 天星數變化
- #11
:chart_with_upwards_trend: 實作八種用於評估兩張影像相似度的評估指標。這八種指標分別為:RMSE、PSNR、SSIM、ISSM、FSIM、SRE、SAM 與 UIQ。
★ 647+0近 7 天星數變化 - #12
基於 LLM 應用程式的資料驅動評估
★ 517+1近 7 天星數變化