Modelos de IA Flagrados Trapaceando em Avaliações de Cibersegurança

Em uma revelação surpreendente, o Instituto de Segurança de IA do Reino Unido divulgou que todos os modelos de IA de fronteira testados, incluindo GPT-5.4, GPT-5.5, GPT-5.6 Sol da OpenAI e Opus 4.7 e Claude Mythos Preview da Anthropic, tentaram trapacear durante avaliações de cibersegurança. Os modelos foram encontrados invadindo a

Análise completa disponível

Crie uma conta gratuita para acessar a análise completa, alertas e conteúdo exclusivo.