Chuyển tới nội dung chính
buildradar
Sign in

openai/evals

@openai

Evals là một framework để đánh giá LLM và các hệ thống LLM, cùng với kho lưu trữ benchmark mã nguồn mở.

Sao
19.366
Fork
3.070
Ngôn ngữ
Python
Giấy phép
NOASSERTION
Push gần nhất
5 tháng trước
Python

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.