メインコンテンツへスキップ
buildradar
Sign in
トピック · evaluation-framework

evaluation-framework

evaluation-framework がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
10
総スター数
70,407
平均スター数
7,041
シェア
0.00%

evaluation-framework と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、evaluation-framework がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • promptfoo@promptfoo

    プロンプト、エージェント、RAGをテスト。AI向けのレッドチーミング/ペネトレーションテスト/脆弱性スキャン。GPT、Claude、Gemini、DeepSeekなどのパフォーマンスを比較。コマンドラインおよびCI/CD統合を備えたシンプルな宣言的設定。OpenAIおよびAnthropicによって使用されています。

    24,664+215直近 7 日のスター増減
  • deepeval@confident-ai

    LLM評価フレームワーク

    17,953+184直近 7 日のスター増減
  • lm-evaluation-harness@EleutherAI

    言語モデルのFew-shot評価のためのフレームワーク。

    13,827+89直近 7 日のスター増減
  • Kiln@Kiln-AI

    AIシステムの構築、評価、最適化。evals、RAG、エージェント、ファインチューニング、合成データ生成、データセット管理、MCPなどを含む。

    5,040+7直近 7 日のスター増減
  • lighteval@huggingface

    Lighteval は、複数のバックエンドで LLM を評価するためのオールインワンツールキットです。

    2,533+8直近 7 日のスター増減
  • EvalAI@Cloud-CV

    :cloud: :rocket: :bar_chart: :chart_with_upwards_trend: AI の最先端技術の評価

    2,037-2直近 7 日のスター増減
  • future-agi@future-agi

    LLM および AI エージェントアプリケーションの評価、モニタリング、改善のためのオープンソースのエンドツーエンドプラットフォーム。トレーシング、評価、シミュレーション、データセット、ゲートウェイ、ガードレールに対応。セルフホスト可能。Apache 2.0。

    1,890+89直近 7 日のスター増減
  • ai-agents-the-definitive-guide@Nicolepcx

    AI エージェントのための決定版ガイドリポジトリ

    1,528+422直近 7 日のスター増減
  • AgentLab@ServiceNow

    AgentLab: 多様なタスクでWebエージェントの開発、テスト、ベンチマークを行うためのオープンソースフレームワーク。スケーラビリティと再現性を重視して設計されています。

    627+2直近 7 日のスター増減
  • continuous-eval@relari-ai

    LLMを活用したアプリケーション向けのデータ駆動型評価

    517+1直近 7 日のスター増減
← トピック一覧に戻る