evaluation-metrics
Repositorios de código abierto monitorizados etiquetados con evaluation-metrics, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a evaluation-metrics en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con evaluation-metrics.
- #1★ 18.063+110Variación de estrellas de los últimos 7 días
- #2
SDK de Python para la monitorización de agentes de IA, seguimiento de costes de LLM, pruebas comparativas y más. Se integra con la mayoría de LLMs y frameworks de agentes, incluidos CrewAI, Agno, OpenAI Agents SDK, Langchain, Autogen, AG2 y CamelAI.
★ 5808+3Variación de estrellas de los últimos 7 días - #3
"Guía de construcción de caja blanca para LLM": un Tiny-Universe completamente hecho a mano
★ 5040+9Variación de estrellas de los últimos 7 días - #4
Lighteval es tu caja de herramientas todo en uno para evaluar LLMs en múltiples backends
★ 2533+3Variación de estrellas de los últimos 7 días - #5
¡Compartiendo conocimientos prácticos y teóricos sobre la evaluación de LLM que recopilamos mientras gestionábamos la Open LLM Leaderboard y diseñábamos lighteval!
★ 2143+2Variación de estrellas de los últimos 7 días - #6
(IROS 2020, ECCVW 2020) Implementación oficial en Python para "3D Multi-Object Tracking: A Baseline and New Evaluation Metrics"
★ 1846+0Variación de estrellas de los últimos 7 días - #7
Evalúe su sistema de conversión de voz a texto con medidas de similitud como la tasa de error de palabras (WER)
★ 928+1Variación de estrellas de los últimos 7 días - #8
OCTIS: ¡Comparar modelos de temas es sencillo! Un paquete de Python para optimizar y evaluar modelos de temas (aceptado en la pista de demostración de EACL2021).
★ 804+0Variación de estrellas de los últimos 7 días - #9★ 778+1Variación de estrellas de los últimos 7 días
- #10
⚡️ Una biblioteca de Python ultrarrápida para evaluación, comparación y fusión de rankings 🐍
★ 697+4Variación de estrellas de los últimos 7 días - #11
Implementación de ocho métricas de evaluación para medir la similitud entre dos imágenes: RMSE, PSNR, SSIM, ISSM, FSIM, SRE, SAM y UIQ.
★ 647+0Variación de estrellas de los últimos 7 días - #12
Evaluación basada en datos para aplicaciones impulsadas por LLM.
★ 517+1Variación de estrellas de los últimos 7 días