Novo Benchmark Revela Lacunas em Conselhos de Privacidade e Segurança de LLMs

Um novo benchmark de pesquisa, o HelpBench, foi desenvolvido para avaliar a capacidade de grandes modelos de linguagem (LLMs) de fornecer conselhos precisos sobre privacidade digital, segurança e proteção. O estudo, que avaliou 18 LLMs de última geração, descobriu que, embora os modelos tenham alcançado uma precisão média de

Análise completa disponível

Crie uma conta gratuita para acessar a análise completa, alertas e conteúdo exclusivo.