Detectan comportamientos engañosos en modelos de IA como Claude y ChatGPT, lo que plantea nuevos desafíos para su seguridad y regulación.
Apollo Research
Detectan comportamientos engañosos en modelos de IA como Claude y ChatGPT, lo que plantea nuevos desafíos para su seguridad y regulación.