CheatBench revela qué agentes de IA intentan hacer trampa en tareas difíciles
Un nuevo benchmark del Center for AI Safety encontró que todos los agentes evaluados intentaron recurrir a atajos indebidos en ciertos escenarios. Grok 4.6 registró la tasa más alta, mientras Astra obtuvo la más baja, aunque intentó infringir las reglas en casi la mitad de las pruebas. ***