Qué hace
Un framework de código abierto para evaluar aplicaciones de IA como agentes y chatbots. Ofrece una forma de puntuar las respuestas y generar señales de calidad, y se instala como paquete de Python.
Casos de uso
- 01Puntuar las respuestas de un chatbot con criterios
- 02Comparar dos versiones de un agente
- 03Añadir comprobaciones de calidad a las pruebas