Nuevo paradigma de evaluación de agentes: de un solo benchmark a pruebas multidimensionales de alineación de seguridad
Anthropic y OpenAI han lanzado nuevos conjuntos de evaluación de agentes, expandiéndose de la precisión de finalización de código a seguridad de interacción multi-turno, alucinación de llamadas a herramientas y detección de abuso de permisos.