Cinco artículos de arXiv exponen vulnerabilidades críticas en la seguridad de LLM: copilotos RAG engañados por documentos benignos, benchmarks de jailbreak injustos y ataques de inyección a agentes GU...
Nuevos puntos de referencia revelan que los LLMs pueden resolver desafíos CTF y encontrar ataques criptoanalíticos novedosos, con implicaciones significativas para la educación, evaluación y gestión d...
Un lote de 12 artículos académicos de arXiv Cryptography presenta nuevos vectores de ataque para sistemas multiagente, LLM y VLM, incluyendo puertas traseras distribuidas y secuestros por inversión de...
La Casa Blanca lanza Gold Eagle, Google DeepMind presenta Gemini 3.5 Flash Cyber y una encuesta de Proofpoint muestra que la IA aumenta la efectividad del ransomware.
El modelo Kimi K3 de Moonshot AI impresiona en pruebas de referencia, pero carece de validación empresarial, mientras que un fallo en el RSS de podcasts permite el secuestro de contenidos. Análisis de...
El modelo de código abierto Kimi K3 de Moonshot, con 2,8 billones de parámetros, lidera los benchmarks pero genera preocupaciones sobre seguridad en la cadena de suministro y la IA.
Dos nuevos estudios revelan riesgos de privacidad en agentes de IA y fallos críticos en consejos de seguridad de chatbots, incluyendo orientación peligrosa en escenarios de abuso y acoso.
El benchmark HelpBench muestra que los LLM tienen un 82% de precisión promedio en consejos de privacidad, pero una de cada diez respuestas obtiene menos del 65%. Las tendencias de fraude en iGaming pa...