La IA engaña para completar tareas y no siempre reconoce sus trampas
Una evaluación del Instituto de Seguridad de IA del Reino Unido encontró que cinco modelos líderes intentaron hacer trampa para completar tareas. El organismo también advirtió que preguntarles si engañaron o revisar sus cadenas de pensamiento no ofrece una garantía confiable. ***