Pular para o conteúdo principal
buildradar
Sign in
Tópico · evaluation-metrics

evaluation-metrics

Repositórios de código aberto acompanhados marcados com evaluation-metrics, ordenados por estrelas.

Repositórios
12
Total de estrelas
39.801
Média de estrelas
3.317
Participação
0,00%

Tópicos que aparecem com frequência ao lado de evaluation-metrics no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com evaluation-metrics.

  • eval@frontier-harness-eval

    Public results and task definitions for FrontierHarness Eval

    160
  • deepeval@confident-ai

    O framework de avaliação de LLM.

    18.063+110Variação de estrelas nos últimos 7 dias
  • agentops@AgentOps-AI

    Python SDK para monitoramento de agentes de IA, rastreamento de custos de LLM, benchmarking e muito mais. Integra-se com a maioria das LLMs e frameworks de agentes, incluindo CrewAI, Agno, OpenAI Agents SDK, Langchain, Autogen, AG2 e CamelAI

    5.808+3Variação de estrelas nos últimos 7 dias
  • tiny-universe@datawhalechina

    Guia de construção de caixa branca para grandes modelos: um Tiny-Universe feito inteiramente à mão.

    5.040+9Variação de estrelas nos últimos 7 dias
  • lighteval@huggingface

    Lighteval é o seu kit de ferramentas completo para avaliar LLMs em múltiplos backends

    2.533+3Variação de estrelas nos últimos 7 dias
  • evaluation-guidebook@huggingface

    Compartilhando insights práticos e conhecimento teórico sobre avaliação de LLM que reunimos ao gerenciar o Open LLM Leaderboard e projetar o lighteval!

    2.143+2Variação de estrelas nos últimos 7 dias
  • AB3DMOT@xinshuoweng

    (IROS 2020, ECCVW 2020) Implementação oficial em Python para "3D Multi-Object Tracking: A Baseline and New Evaluation Metrics".

    1.846+0Variação de estrelas nos últimos 7 dias
  • jiwer@jitsi

    Avalie seu sistema de conversão de fala em texto com medidas de similaridade como a taxa de erro de palavras (WER)

    928+2Variação de estrelas nos últimos 7 dias
  • OCTIS@MIND-Lab

    OCTIS: Comparar modelos de tópicos é simples! Um pacote Python para otimizar e avaliar modelos de tópicos (aceito na trilha de demonstração do EACL2021)

    804+0Variação de estrelas nos últimos 7 dias
  • COMET@Unbabel

    Uma Estrutura Neural para Avaliação de MT

    778+1Variação de estrelas nos últimos 7 dias
  • ranx@AmenRa

    ⚡️Uma biblioteca Python extremamente rápida para avaliação, comparação e fusão de ranqueamento 🐍

    698+5Variação de estrelas nos últimos 7 dias
  • Implementação de oito métricas de avaliação para acessar a similaridade entre duas imagens. As oito métricas são as seguintes: RMSE, PSNR, SSIM, ISSM, FSIM, SRE, SAM e UIQ.

    647+0Variação de estrelas nos últimos 7 dias
  • continuous-eval@relari-ai

    Avaliação orientada a dados para aplicações baseadas em LLM

    517+1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos