evaluation-metrics
Repositórios de código aberto acompanhados marcados com evaluation-metrics, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de evaluation-metrics no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com evaluation-metrics.
- #1★ 18.063+110Variação de estrelas nos últimos 7 dias
- #2
Python SDK para monitoramento de agentes de IA, rastreamento de custos de LLM, benchmarking e muito mais. Integra-se com a maioria das LLMs e frameworks de agentes, incluindo CrewAI, Agno, OpenAI Agents SDK, Langchain, Autogen, AG2 e CamelAI
★ 5.808+3Variação de estrelas nos últimos 7 dias - #3
Guia de construção de caixa branca para grandes modelos: um Tiny-Universe feito inteiramente à mão.
★ 5.040+9Variação de estrelas nos últimos 7 dias - #4
Lighteval é o seu kit de ferramentas completo para avaliar LLMs em múltiplos backends
★ 2.533+3Variação de estrelas nos últimos 7 dias - #5
Compartilhando insights práticos e conhecimento teórico sobre avaliação de LLM que reunimos ao gerenciar o Open LLM Leaderboard e projetar o lighteval!
★ 2.143+2Variação de estrelas nos últimos 7 dias - #6
(IROS 2020, ECCVW 2020) Implementação oficial em Python para "3D Multi-Object Tracking: A Baseline and New Evaluation Metrics".
★ 1.846+0Variação de estrelas nos últimos 7 dias - #7
Avalie seu sistema de conversão de fala em texto com medidas de similaridade como a taxa de erro de palavras (WER)
★ 928+2Variação de estrelas nos últimos 7 dias - #8
OCTIS: Comparar modelos de tópicos é simples! Um pacote Python para otimizar e avaliar modelos de tópicos (aceito na trilha de demonstração do EACL2021)
★ 804+0Variação de estrelas nos últimos 7 dias - #9★ 778+1Variação de estrelas nos últimos 7 dias
- #10
⚡️Uma biblioteca Python extremamente rápida para avaliação, comparação e fusão de ranqueamento 🐍
★ 698+5Variação de estrelas nos últimos 7 dias - #11
Implementação de oito métricas de avaliação para acessar a similaridade entre duas imagens. As oito métricas são as seguintes: RMSE, PSNR, SSIM, ISSM, FSIM, SRE, SAM e UIQ.
★ 647+0Variação de estrelas nos últimos 7 dias - #12
Avaliação orientada a dados para aplicações baseadas em LLM
★ 517+1Variação de estrelas nos últimos 7 dias