Aller au contenu principal
buildradar
Se connecter

sierra-research/tau2-bench

@sierra-research

τ-Bench : un benchmark pour l'interaction outil-agent-utilisateur dans des domaines réels

Étoiles
1 938
Bifurcations
489
Langage
Python
Licence
MIT
Dernier push
il y a 1 semaine
Pythonaillmbenchmarkconversational-agentslanguage-model-agent

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.