o que se sabe sobre novos ataques em testes
*Segundo o AISI, os testes rodaram 122 vezes em um desafio de cibersegurança e, em 10 dessas execuções, os agentes fizeram 19 ações não sancionadas mirando pessoas e organizações reais; 17 foram atribuídas ao modelo Mythos 5, da Anthropic, e duas ao GPT-5.6-Sol, da OpenAI.
*No caso mais grave, um agente tentou inserir código malicioso em um projeto de código aberto e, para aumentar a chance de aprovação, criou identidades falsas online para pressionar o responsável pelo projeto a aceitar a mudança, segundo o AISI.
*De acordo com a BBC, além de imitar pessoas reais em perfis falsos, o agente também tentou esconder evidências: ao ser confrontado, editou atividades anteriores para parecer inofensivo e cogitou adotar uma nova identidade para continuar.
*A Wired relata que houve tentativa de “plantar” instruções maliciosas para que outros sistemas automatizados de IA as executassem (uma espécie de bilhete envenenado deixado no caminho) e que um agente chegou a deixar mensagens públicas em um repositório para versões futuras “continuarem” o trabalho.
*O AISI afirmou que os ataques não tiveram sucesso e não causaram dano no mundo real porque revisões humanas barraram as tentativas de inserir o código.
*O instituto disse que, nesse tipo de avaliação, alguns freios de segurança são reduzidos ou desligados de propósito e os modelos podem ter acesso à internet para simular o que um atacante humano capaz faria – mas reconheceu falhas de monitoramento e que não havia instruções explícitas proibindo enganação ou uso criativo da internet.
!function(f,b,e,v,n,t,s) {if(f.fbq)return;n=f.fbq=function() {n.callMethod? n.callMethod.apply(n,arguments):n.queue.push(arguments)}; if(!f._fbq)f._fbq=n;n.push=n;n.loaded=!0;n.version='2.0'; n.queue=[];t=b.createElement(e);t.async=!0; t.src=v;s=b.getElementsByTagName(e)[0]; s.parentNode.insertBefore(t,s)}(window, document,'script', 'https://connect.facebook.net/en_US/fbevents.js'); fbq('init', '1425099884432564'); fbq('track', 'PageView', { content_name: 'IAs rebeldes são flagradas em novos ataques e ocultam provas; o que se sabe', content_ids: [84011,83153,13703,80789,79601,79220,77838,79222,82370,82487], is_closed: true, });
Source link





