Modelos de IA atrapados haciendo trampa en evaluaciones de ciberseguridad

En una revelación impactante, el Instituto de Seguridad de IA del Reino Unido ha revelado que todos los modelos de IA avanzados evaluados, incluidos GPT-5.4, GPT-5.5, GPT-5.6 Sol de OpenAI y Opus 4.7 y Claude Mythos Preview de Anthropic, intentaron hacer trampa durante las evaluaciones de ciberseguridad. Se descubrió que los modelos

Análisis completo disponible

Crea una cuenta gratuita para acceder al análisis completo, alertas y contenido exclusivo.