Aller au contenu principal
buildradar
Sign in
Sujet · evaluation-framework

evaluation-framework

Dépôts open source suivis étiquetés evaluation-framework, triés par étoiles.

Dépôts
10
Total d'étoiles
70 407
Étoiles en moyenne
7 041
Part
0,00%

Sujets qui apparaissent souvent aux côtés de evaluation-framework sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés evaluation-framework.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • promptfoo@promptfoo

    Testez vos prompts, agents et RAG. Red teaming, pentesting et analyse de vulnérabilités pour l'IA. Comparez les performances de GPT, Claude, Gemini, DeepSeek et plus encore. Configurations déclaratives simples avec intégration en ligne de commande et CI/CD. Utilisé par OpenAI et Anthropic.

    24 664+215Évolution des étoiles sur les 7 derniers jours
  • deepeval@confident-ai

    Le framework d'évaluation pour LLM.

    17 953+184Évolution des étoiles sur les 7 derniers jours
  • lm-evaluation-harness@EleutherAI

    Un framework pour l'évaluation few-shot des modèles de langage.

    13 827+89Évolution des étoiles sur les 7 derniers jours
  • Kiln@Kiln-AI

    Construisez, évaluez et optimisez des systèmes d'IA. Inclut des évaluations, RAG, agents, fine-tuning, génération de données synthétiques, gestion de jeux de données, MCP, et plus encore.

    5 037+7Évolution des étoiles sur les 7 derniers jours
  • lighteval@huggingface

    Lighteval est votre boîte à outils tout-en-un pour évaluer les LLM sur plusieurs backends.

    2 530+8Évolution des étoiles sur les 7 derniers jours
  • EvalAI@Cloud-CV

    Évaluation de l'état de l'art en IA

    2 037-2Évolution des étoiles sur les 7 derniers jours
  • future-agi@future-agi

    Plateforme open-source de bout en bout pour évaluer, observer et améliorer les applications LLM et agents IA. Tracing, évaluations, simulations, jeux de données, passerelle, garde-fous. Auto-hébergeable. Licence Apache 2.0.

    1 873+89Évolution des étoiles sur les 7 derniers jours
  • ai-agents-the-definitive-guide@Nicolepcx

    Dépôt pour le guide définitif des agents IA

    1 386+422Évolution des étoiles sur les 7 derniers jours
  • AgentLab@ServiceNow

    AgentLab : Cadre open-source de développement, de test et d'évaluation d'agents web sur des tâches variées, conçu pour la scalabilité et la reproductibilité.

    627+2Évolution des étoiles sur les 7 derniers jours
  • continuous-eval@relari-ai

    Évaluation basée sur les données pour les applications propulsées par LLM.

    517+1Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets