Aller au contenu principal
buildradar
Se connecter
Sujet · agent-evaluation

agent-evaluation

Dépôts open source suivis étiquetés agent-evaluation, triés par étoiles.

Dépôts
9
Total d'étoiles
32 319
Étoiles en moyenne
3 591
Part
0,00%

Sujets qui apparaissent souvent aux côtés de agent-evaluation sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés agent-evaluation.

  • awesome-evals@benchflow-ai

    Une bibliothèque organisée et pragmatique des meilleures ressources pour construire et évaluer des agents IA : articles, blogs, conférences, outils et benchmarks. Maintenue par BenchFlow.

    870
  • iFixAi@ifixai-ai

    Audit indépendant d'agents IA. Exécuté par un humain ou par l'agent lui-même pour répondre à la question cruciale de l'économie des agents IA : l'agent fait-il ce qu'il est censé faire ? Avec iFixAi, obtenez cette réponse en moins de 120 secondes.

    12 643+0Évolution des étoiles sur les 7 derniers jours
  • giskard-oss@Giskard-AI

    Bibliothèque open source d'évaluation et de test pour les agents LLM

    5 801+0Évolution des étoiles sur les 7 derniers jours
  • coze-loop@coze-dev

    Plateforme d'optimisation d'agents IA de nouvelle génération : Cozeloop résout les défis du développement d'agents IA en offrant des capacités de gestion sur tout le cycle de vie, du développement au débogage, en passant par l'évaluation et la surveillance.

    5 711+0Évolution des étoiles sur les 7 derniers jours
  • trulens@truera

    Évaluation et suivi pour les expériences LLM et les agents IA.

    3 530+0Évolution des étoiles sur les 7 derniers jours
  • any-agent@mozilla-ai

    Une interface unique pour utiliser et évaluer différents frameworks d'agents.

    1 199+0Évolution des étoiles sur les 7 derniers jours
  • intelligent-audit-system@Ricky-7-Yan

    AuditPilot : agents IA d'entreprise auditables pour des flux de travail basés sur des preuves, des outils gouvernés, des bancs d'essai d'évaluation, la revue humaine et la remédiation.

    1 166+0Évolution des étoiles sur les 7 derniers jours
  • awesome-evals@benchflow-ai

    Une bibliothèque organisée et pragmatique des meilleures ressources pour construire et évaluer des agents IA : articles, blogs, conférences, outils et benchmarks. Maintenue par BenchFlow.

    870+15Évolution des étoiles sur les 7 derniers jours
  • pandaprobe@chirpz-ai

    Plateforme d'ingénierie d'agents open source : traces, évaluations et métriques pour déboguer et améliorer vos agents IA. S'intègre avec LangGraph, CrewAI, Claude Agent SDK, et plus encore.

    783+0Évolution des étoiles sur les 7 derniers jours
  • ClawBench@TIGER-AI-Lab

    Benchmark open source pour agents IA de navigateur sur des tâches quotidiennes.

    691+60Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets