Cinco artigos do arXiv expõem vulnerabilidades críticas na segurança de LLMs: copilotos RAG induzidos por documentos benignos, benchmarks injustos de jailbreak e ataques de injeção em agentes GUI.
Novos benchmarks revelam que LLMs conseguem resolver desafios CTF e encontrar ataques criptoanalíticos inéditos. As implicações para educação, avaliação e gestão de riscos em cibersegurança são signif...
Um lote de 12 artigos acadêmicos do arXiv Cryptography apresenta novos vetores de ataque para sistemas multiagentes, LLMs e VLMs, incluindo backdoors distribuídos e sequestros por bit-flip. Equipes de...
A Casa Branca lança o Gold Eagle, o Google DeepMind divulga o Gemini 3.5 Flash Cyber, e uma pesquisa da Proofpoint mostra que a IA aumenta a eficácia de ransomwares. Uma mudança estratégica no gerenci...
O modelo Kimi K3 da Moonshot AI impressiona em benchmarks, mas carece de comprovação empresarial, enquanto uma falha em RSS de podcast permite sequestro de conteúdo. Análise de riscos e recomendações.
O Kimi K3, modelo de IA open-source da Moonshot com 2,8 trilhões de parâmetros, lidera benchmarks, mas levanta preocupações sobre segurança na cadeia de suprimentos e em sistemas de IA. A Microsoft, n...
Dois novos estudos expõem riscos de privacidade em agentes de LLM e falhas críticas em conselhos de segurança de chatbots, incluindo orientações perigosas em cenários de abuso e perseguição.
O benchmark HelpBench mostra que LLMs têm média de 82% de precisão em conselhos de privacidade, mas uma em cada dez respostas fica abaixo de 65%. Tendências de fraude em iGaming para 2027 incluem iden...