IA rebelde da OpenAI utilizou pelo menos mais 10 sites para comunicações não autorizadas
O alcance das comunicações não autorizadas dos agentes foi “um pouco maior do que pensávamos”, disse Andrew Yoon, pesquisador da CivAI, organização sem fins lucrativos da Califórnia, que afirmou ter contabilizado 18 sites até então não divulgados usados pelos agentes entre maio e julho. “É quase certo que há mais coisas acontecendo aqui das quais simplesmente não temos conhecimento.”
Na sexta-feira passada, pesquisadores relataram que um enxame de agentes de IA da OpenAI invadiu um site wiki em alemão e o transformou em uma plataforma improvisada de mensagens, um incidente que a OpenAI manteve em segredo enquanto lidava com as consequências do ataque de julho ao repositório de código aberto Hugging Face.
Agora, tanto esses pesquisadores quanto outros investigadores independentes afirmam ter encontrado vários sites onde o mesmo enxame parece ter deixado mensagens semelhantes no início deste ano.
A OpenAI não respondeu diretamente às perguntas sobre quantos sites diferentes seus agentes usaram para se comunicar nem explicou por que manteve a atividade em segredo por meses. Em um comunicado, a empresa afirmou que estava realizando uma análise mais ampla das atividades dos agentes e que, até o momento, “não havia identificado outras atividades com a mesma gravidade ou escala do caso Hugging Face”, uma violação que chamou a atenção global e gerou preocupações de que a OpenAI estivesse perdendo o controle sobre sua própria tecnologia.
A OpenAI acrescentou que estava trabalhando em uma estrutura para relatar “desalinhamento”, termo usado no setor para se referir a comportamentos anormais, em todo o processo de treinamento, avaliação e implantação de modelos de IA e que a divulgaria “em breve”.
A Reuters analisou um total de seis conclusões de investigadores ou grupos de investigação, incluindo três que foram publicadas nas redes sociais e outras três que foram compartilhadas em caráter privado com a agência de notícias.





