Chuyển tới nội dung chính
buildradar
Đăng nhập

sierra-research/tau2-bench

@sierra-research

τ-Bench: Một bộ benchmark cho tương tác Công cụ-Tác nhân-Người dùng trong các miền thực tế

Sao
1.938
Fork
489
Ngôn ngữ
Python
Giấy phép
MIT
Push gần nhất
1 tuần trước
Pythonaillmbenchmarkconversational-agentslanguage-model-agent

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.