Pular para o conteúdo principal
buildradar
Sign in
Tópico · agent-evaluation

agent-evaluation

Repositórios de código aberto acompanhados marcados com agent-evaluation, ordenados por estrelas.

Repositórios
9
Total de estrelas
31.017
Média de estrelas
3.446
Participação
0,00%

Tópicos que aparecem com frequência ao lado de agent-evaluation no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com agent-evaluation.

  • awesome-evals@benchflow-ai

    Uma biblioteca curada e direta dos melhores recursos para construir e avaliar agentes de IA — artigos, blogs, palestras, ferramentas e benchmarks. Mantida pela BenchFlow.

    849
  • iFixAi@ifixai-ai

    Auditoria independente de agentes de IA. Executada por humanos ou pelo próprio agente para responder à pergunta mais crucial na economia de agentes de IA: o agente está fazendo o que deveria fazer? Com o iFixAi, você obtém essa resposta em menos de 120 segundos.

    11.396+209Variação de estrelas nos últimos 7 dias
  • giskard-oss@Giskard-AI

    🐢 Biblioteca de código aberto para avaliação e teste de agentes de LLM

    5.792+31Variação de estrelas nos últimos 7 dias
  • coze-loop@coze-dev

    Plataforma de otimização de agentes de IA de próxima geração: o Cozeloop aborda desafios no desenvolvimento de agentes de IA, oferecendo recursos de gerenciamento de ciclo de vida completo, desde desenvolvimento, depuração e avaliação até monitoramento.

    5.706+7Variação de estrelas nos últimos 7 dias
  • trulens@truera

    Avaliação e rastreamento para experimentos de LLM e agentes de IA.

    3.528+10Variação de estrelas nos últimos 7 dias
  • any-agent@mozilla-ai

    Uma interface única para usar e avaliar diferentes frameworks de agentes

    1.197+3Variação de estrelas nos últimos 7 dias
  • intelligent-audit-system@Ricky-7-Yan

    AuditPilot: agentes de IA corporativos auditáveis para fluxos de trabalho baseados em evidências, ferramentas governadas, estruturas de avaliação, revisão humana e entrega de remediação.

    1.166+0Variação de estrelas nos últimos 7 dias
  • awesome-evals@benchflow-ai

    Uma biblioteca curada e direta dos melhores recursos para construir e avaliar agentes de IA — artigos, blogs, palestras, ferramentas e benchmarks. Mantida pela BenchFlow.

    849+10Variação de estrelas nos últimos 7 dias
  • pandaprobe@chirpz-ai

    Plataforma de engenharia de agentes de código aberto: rastreamentos, avaliações e métricas para depurar e melhorar seus agentes de IA. Integra-se com LangGraph, CrewAI, Claude Agent SDK e muito mais.

    783+28Variação de estrelas nos últimos 7 dias
  • ClawBench@TIGER-AI-Lab

    Benchmark de código aberto para agentes de IA de navegador em tarefas diárias.

    611+31Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos