Saltar al contenido principal
buildradar
Sign in
Tema · agent-evaluation

agent-evaluation

Repositorios de código abierto monitorizados etiquetados con agent-evaluation, ordenados por estrellas.

Repositorios
9
Estrellas totales
32.319
Estrellas de media
3591
Proporción
0,00%

Temas que aparecen con frecuencia junto a agent-evaluation en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con agent-evaluation.

  • awesome-evals@benchflow-ai

    Una biblioteca curada y sin rodeos con los mejores recursos para construir y evaluar agentes de IA: artículos, blogs, charlas, herramientas y benchmarks. Mantenida por BenchFlow.

    864
  • iFixAi@ifixai-ai

    Auditoría independiente de agentes de IA. Ejecutada por humanos o por el propio agente, para responder a la pregunta más crucial en la economía de los agentes de IA: ¿Está el agente haciendo lo que se supone que debe hacer? Con iFixAi puedes obtener esta respuesta en menos de 120 segundos.

    12.643+1247Variación de estrellas de los últimos 7 días
  • giskard-oss@Giskard-AI

    🐢 Biblioteca de pruebas y evaluación de código abierto para agentes LLM

    5801+9Variación de estrellas de los últimos 7 días
  • coze-loop@coze-dev

    Plataforma de optimización de agentes de IA de próxima generación: Cozeloop aborda los desafíos en el desarrollo de agentes de IA ofreciendo capacidades de gestión de ciclo de vida completo desde el desarrollo, depuración y evaluación hasta la supervisión.

    5711+5Variación de estrellas de los últimos 7 días
  • trulens@truera

    Evaluación y seguimiento para experimentos de LLM y agentes de IA

    3530+2Variación de estrellas de los últimos 7 días
  • any-agent@mozilla-ai

    Una interfaz única para utilizar y evaluar diferentes frameworks de agentes.

    1199+2Variación de estrellas de los últimos 7 días
  • intelligent-audit-system@Ricky-7-Yan

    AuditPilot: agentes de IA empresariales auditables para flujos de trabajo basados en evidencia, herramientas gobernadas, entornos de evaluación, revisión humana y entrega de remediaciones.

    1166+0Variación de estrellas de los últimos 7 días
  • awesome-evals@benchflow-ai

    Una biblioteca curada y sin rodeos con los mejores recursos para construir y evaluar agentes de IA: artículos, blogs, charlas, herramientas y benchmarks. Mantenida por BenchFlow.

    864+17Variación de estrellas de los últimos 7 días
  • pandaprobe@chirpz-ai

    Plataforma de ingeniería de agentes de código abierto: trazas, evaluaciones y métricas para depurar y mejorar sus agentes de IA. Se integra con LangGraph, CrewAI, Claude Agent SDK y más.

    783+1Variación de estrellas de los últimos 7 días
  • ClawBench@TIGER-AI-Lab

    Benchmark de código abierto para agentes de IA en navegadores para tareas diarias.

    664+54Variación de estrellas de los últimos 7 días
← Volver a temas