メインコンテンツへスキップ
buildradar
Sign in
トピック · agent-evaluation

agent-evaluation

agent-evaluation がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
9
総スター数
32,319
平均スター数
3,591
シェア
0.00%

agent-evaluation と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、agent-evaluation がタグ付けされたリポジトリ。

  • awesome-evals@benchflow-ai

    AIエージェントの構築と評価に最適なリソース(論文、ブログ、講演、ツール、ベンチマーク)を集めた、無駄のない厳選ライブラリ。BenchFlowが保守しています。

    865
  • iFixAi@ifixai-ai

    AIエージェントの独立監査。人間またはエージェント自身が実行し、AIエージェント経済における最も重要な問いに答えます。エージェントは意図した通りに動作しているか?iFixAiを使えば、120秒未満でこの答えを得られます。

    12,643+1,247直近 7 日のスター増減
  • giskard-oss@Giskard-AI

    🐢 LLMエージェント向けのオープンソースの評価・テストライブラリ

    5,801+9直近 7 日のスター増減
  • coze-loop@coze-dev

    次世代AIエージェント最適化プラットフォーム:Cozeloopは、開発、デバッグ、評価から監視に至るまでのライフサイクル全体管理機能を提供することで、AIエージェント開発の課題に対処します。

    5,711+5直近 7 日のスター増減
  • trulens@truera

    LLM 実験および AI エージェント向けの評価と追跡フレームワーク

    3,530+2直近 7 日のスター増減
  • any-agent@mozilla-ai

    さまざまなエージェントフレームワークを使用および評価するための単一インターフェース

    1,199+2直近 7 日のスター増減
  • intelligent-audit-system@Ricky-7-Yan

    AuditPilot:根拠に基づいたワークフロー、ガバナンス付きツール、評価ハーネス、人間によるレビュー、修正配信を実現する、監査可能なエンタープライズAIエージェント

    1,166+0直近 7 日のスター増減
  • awesome-evals@benchflow-ai

    AIエージェントの構築と評価に最適なリソース(論文、ブログ、講演、ツール、ベンチマーク)を集めた、無駄のない厳選ライブラリ。BenchFlowが保守しています。

    865+18直近 7 日のスター増減
  • pandaprobe@chirpz-ai

    オープンソースのAIエージェントエンジニアリングプラットフォーム:AIエージェントのデバッグと改善のためのトレース、評価、メトリクスを提供。LangGraph、CrewAI、Claude Agent SDKなどと統合可能。

    783+1直近 7 日のスター増減
  • ClawBench@TIGER-AI-Lab

    日常タスクにおけるブラウザ AI エージェントのオープンソースベンチマーク。

    664+61直近 7 日のスター増減
← トピック一覧に戻る