トピック · evaluation-framework
evaluation-framework
evaluation-framework がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
リポジトリ
10
総スター数
70,407
平均スター数
7,041
シェア
0.00%
関連トピック
evaluation-framework と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、evaluation-framework がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1
プロンプト、エージェント、RAGをテスト。AI向けのレッドチーミング/ペネトレーションテスト/脆弱性スキャン。GPT、Claude、Gemini、DeepSeekなどのパフォーマンスを比較。コマンドラインおよびCI/CD統合を備えたシンプルな宣言的設定。OpenAIおよびAnthropicによって使用されています。
★ 24,664+215直近 7 日のスター増減 - #2★ 17,953+184直近 7 日のスター増減
- #3
言語モデルのFew-shot評価のためのフレームワーク。
★ 13,827+89直近 7 日のスター増減 - #4★ 5,040+7直近 7 日のスター増減
- #5★ 2,533+8直近 7 日のスター増減
- #6★ 2,037-2直近 7 日のスター増減
- #7
LLM および AI エージェントアプリケーションの評価、モニタリング、改善のためのオープンソースのエンドツーエンドプラットフォーム。トレーシング、評価、シミュレーション、データセット、ゲートウェイ、ガードレールに対応。セルフホスト可能。Apache 2.0。
★ 1,890+89直近 7 日のスター増減 - #8
AI エージェントのための決定版ガイドリポジトリ
★ 1,528+422直近 7 日のスター増減 - #9
AgentLab: 多様なタスクでWebエージェントの開発、テスト、ベンチマークを行うためのオープンソースフレームワーク。スケーラビリティと再現性を重視して設計されています。
★ 627+2直近 7 日のスター増減 - #10
LLMを活用したアプリケーション向けのデータ駆動型評価
★ 517+1直近 7 日のスター増減