Lompat ke konten utama
buildradar
Sign in
Topik · evaluation-metrics

evaluation-metrics

Repositori open source terpantau bertanda evaluation-metrics, diurutkan berdasarkan bintang.

Repositori
12
Total bintang
39.801
Rata-rata bintang
3.317
Porsi
0,00%

Topik yang sering muncul berdampingan dengan evaluation-metrics di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda evaluation-metrics.

  • eval@frontier-harness-eval

    Public results and task definitions for FrontierHarness Eval

    160
  • deepeval@confident-ai

    Kerangka kerja evaluasi LLM

    18.063+110Perubahan bintang dalam 7 hari terakhir
  • agentops@AgentOps-AI

    SDK Python untuk pemantauan agen AI, pelacakan biaya LLM, benchmarking, dan lainnya. Terintegrasi dengan sebagian besar LLM dan kerangka kerja agen termasuk CrewAI, Agno, OpenAI Agents SDK, Langchain, Autogen, AG2, dan CamelAI.

    5.808+3Perubahan bintang dalam 7 hari terakhir
  • tiny-universe@datawhalechina

    Panduan Membangun White Box Model Bahasa Besar: Tiny-Universe yang dibuat sepenuhnya dari nol

    5.040+9Perubahan bintang dalam 7 hari terakhir
  • lighteval@huggingface

    Lighteval adalah perangkat lengkap Anda untuk mengevaluasi LLM di berbagai backend

    2.533+3Perubahan bintang dalam 7 hari terakhir
  • evaluation-guidebook@huggingface

    Berbagi wawasan praktis dan pengetahuan teoretis tentang evaluasi LLM yang kami kumpulkan saat mengelola Open LLM Leaderboard dan merancang lighteval!

    2.143+2Perubahan bintang dalam 7 hari terakhir
  • AB3DMOT@xinshuoweng

    (IROS 2020, ECCVW 2020) Implementasi Python resmi untuk "3D Multi-Object Tracking: A Baseline and New Evaluation Metrics".

    1.846+0Perubahan bintang dalam 7 hari terakhir
  • jiwer@jitsi

    Evaluasi sistem speech-to-text Anda dengan ukuran kemiripan seperti word error rate (WER)

    928+2Perubahan bintang dalam 7 hari terakhir
  • OCTIS@MIND-Lab

    OCTIS: Membandingkan Model Topik itu Mudah! Paket python untuk mengoptimalkan dan mengevaluasi model topik (diterima di jalur demo EACL2021)

    804+0Perubahan bintang dalam 7 hari terakhir
  • COMET@Unbabel

    Kerangka kerja saraf untuk evaluasi MT

    778+1Perubahan bintang dalam 7 hari terakhir
  • ranx@AmenRa

    ⚡️Pustaka Python yang sangat cepat untuk evaluasi, perbandingan, dan fusi peringkat 🐍

    697+4Perubahan bintang dalam 7 hari terakhir
  • :chart_with_upwards_trend: Implementasi delapan metrik evaluasi untuk menilai kemiripan antara dua gambar. Kedelapan metrik tersebut adalah: RMSE, PSNR, SSIM, ISSM, FSIM, SRE, SAM, dan UIQ.

    647+0Perubahan bintang dalam 7 hari terakhir
  • continuous-eval@relari-ai

    Evaluasi Berbasis Data untuk Aplikasi Bertenaga LLM

    517+1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik