llm-eval
Repositorios de código abierto monitorizados etiquetados con llm-eval, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a llm-eval en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con llm-eval.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Prueba tus prompts, agentes y RAGs. Pruebas de penetración, análisis de vulnerabilidades y red teaming para IA. Compara el rendimiento de GPT, Claude, Gemini, DeepSeek y más. Configuraciones declarativas simples con integración para línea de comandos y CI/CD. Utilizado por OpenAI y Anthropic.
★ 24.767+159Variación de estrellas de los últimos 7 días - #2★ 11.298+92Variación de estrellas de los últimos 7 días
- #3
🐢 Biblioteca de pruebas y evaluación de código abierto para agentes LLM
★ 5801+27Variación de estrellas de los últimos 7 días - #4★ 3530+5Variación de estrellas de los últimos 7 días
- #5
UpTrain es una plataforma unificada de código abierto para evaluar y mejorar aplicaciones de IA generativa. Proporcionamos calificaciones para más de 20 comprobaciones preconfiguradas (que cubren casos de uso de lenguaje, código e incrustaciones), realizamos análisis de causa raíz en casos de falla y brindamos información sobre cómo resolverlos.
★ 2364+2Variación de estrellas de los últimos 7 días - #6
Un cliente MCP de escritorio diseñado como una utilidad de integración unitaria de herramientas, que acelera la adopción de IA a través del Model Context Protocol (MCP) y permite la orquestación de API de LLM entre diferentes proveedores.
★ 1153+0Variación de estrellas de los últimos 7 días