メインコンテンツへスキップ
buildradar
Sign in
トピック · evaluation-metrics

evaluation-metrics

evaluation-metrics がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
12
総スター数
39,801
平均スター数
3,317
シェア
0.00%

evaluation-metrics と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、evaluation-metrics がタグ付けされたリポジトリ。

  • eval@frontier-harness-eval

    Public results and task definitions for FrontierHarness Eval

    151
  • deepeval@confident-ai

    LLM評価フレームワーク

    18,063+110直近 7 日のスター増減
  • agentops@AgentOps-AI

    AIエージェントの監視、LLMコスト追跡、ベンチマークなどを行うためのPython SDK。CrewAI、Agno、OpenAI Agents SDK、Langchain、Autogen、AG2、CamelAIなど、ほとんどのLLMおよびエージェントフレームワークと統合可能です。

    5,808+3直近 7 日のスター増減
  • tiny-universe@datawhalechina

    『大規模モデルのホワイトボックス構築ガイド』:完全に手作りしたTiny-Universe

    5,040+9直近 7 日のスター増減
  • lighteval@huggingface

    Lighteval は、複数のバックエンドで LLM を評価するためのオールインワンツールキットです。

    2,533+3直近 7 日のスター増減
  • evaluation-guidebook@huggingface

    Open LLM Leaderboard の管理や lighteval の設計を通じて得た、LLM 評価に関する実践的な知見と理論的知識の共有

    2,143+2直近 7 日のスター増減
  • AB3DMOT@xinshuoweng

    (IROS 2020, ECCVW 2020) 「3D Multi-Object Tracking: A Baseline and New Evaluation Metrics」の公式 Python 実装

    1,846+0直近 7 日のスター増減
  • jiwer@jitsi

    単語誤り率(WER)などの類似度指標を使用して音声認識システムを評価する

    927+1直近 7 日のスター増減
  • OCTIS@MIND-Lab

    OCTIS: トピックモデルの比較が簡単に行える Python パッケージ (EACL2021 デモトラック採択)

    804+0直近 7 日のスター増減
  • COMET@Unbabel

    機械翻訳(MT)評価のためのニューラルフレームワーク

    778+1直近 7 日のスター増減
  • ranx@AmenRa

    ⚡️ランキング評価、比較、融合のための超高速なPythonライブラリ 🐍

    697+4直近 7 日のスター増減
  • 2つの画像間の類似性を評価する8つの評価指標の実装。指標:RMSE、PSNR、SSIM、ISSM、FSIM、SRE、SAM、UIQ

    647+0直近 7 日のスター増減
  • continuous-eval@relari-ai

    LLMを活用したアプリケーション向けのデータ駆動型評価

    517+1直近 7 日のスター増減
← トピック一覧に戻る