Saltar al contenido principal
buildradar
Sign in
Tema · evaluation-metrics

evaluation-metrics

Repositorios de código abierto monitorizados etiquetados con evaluation-metrics, ordenados por estrellas.

Repositorios
12
Estrellas totales
39.801
Estrellas de media
3317
Proporción
0,00%

Temas que aparecen con frecuencia junto a evaluation-metrics en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con evaluation-metrics.

  • eval@frontier-harness-eval

    Public results and task definitions for FrontierHarness Eval

    160
  • deepeval@confident-ai

    El marco de evaluación para LLM

    18.063+110Variación de estrellas de los últimos 7 días
  • agentops@AgentOps-AI

    SDK de Python para la monitorización de agentes de IA, seguimiento de costes de LLM, pruebas comparativas y más. Se integra con la mayoría de LLMs y frameworks de agentes, incluidos CrewAI, Agno, OpenAI Agents SDK, Langchain, Autogen, AG2 y CamelAI.

    5808+3Variación de estrellas de los últimos 7 días
  • tiny-universe@datawhalechina

    "Guía de construcción de caja blanca para LLM": un Tiny-Universe completamente hecho a mano

    5040+9Variación de estrellas de los últimos 7 días
  • lighteval@huggingface

    Lighteval es tu caja de herramientas todo en uno para evaluar LLMs en múltiples backends

    2533+3Variación de estrellas de los últimos 7 días
  • evaluation-guidebook@huggingface

    ¡Compartiendo conocimientos prácticos y teóricos sobre la evaluación de LLM que recopilamos mientras gestionábamos la Open LLM Leaderboard y diseñábamos lighteval!

    2143+2Variación de estrellas de los últimos 7 días
  • AB3DMOT@xinshuoweng

    (IROS 2020, ECCVW 2020) Implementación oficial en Python para "3D Multi-Object Tracking: A Baseline and New Evaluation Metrics"

    1846+0Variación de estrellas de los últimos 7 días
  • jiwer@jitsi

    Evalúe su sistema de conversión de voz a texto con medidas de similitud como la tasa de error de palabras (WER)

    928+1Variación de estrellas de los últimos 7 días
  • OCTIS@MIND-Lab

    OCTIS: ¡Comparar modelos de temas es sencillo! Un paquete de Python para optimizar y evaluar modelos de temas (aceptado en la pista de demostración de EACL2021).

    804+0Variación de estrellas de los últimos 7 días
  • COMET@Unbabel

    Un marco neuronal para la evaluación de traducción automática (MT)

    778+1Variación de estrellas de los últimos 7 días
  • ranx@AmenRa

    ⚡️ Una biblioteca de Python ultrarrápida para evaluación, comparación y fusión de rankings 🐍

    697+4Variación de estrellas de los últimos 7 días
  • Implementación de ocho métricas de evaluación para medir la similitud entre dos imágenes: RMSE, PSNR, SSIM, ISSM, FSIM, SRE, SAM y UIQ.

    647+0Variación de estrellas de los últimos 7 días
  • continuous-eval@relari-ai

    Evaluación basada en datos para aplicaciones impulsadas por LLM.

    517+1Variación de estrellas de los últimos 7 días
← Volver a temas