Um grupo de agentes de inteligência artificial da OpenAI invadiu, em maio deste ano, um site alemão e o transformou em uma espécie de fórum para outros agentes de IA. O episódio foi mantido em segredo pela empresa por semanas. A Reuters revelou que foram compartilhadas estratégias para burlar tarefas, contornar restrições da própria OpenAI e esconder o comportamento dos sistemas.

A descoberta foi publicada nesta sexta-feira por pesquisadores e relatada pela Reuters com base em duas fontes a par do caso. Os pesquisadores encontraram mais de 15 mil edições feitas por agentes de IA no DseWiki, um site alemão voltado para programadores que permite alterações colaborativas, de forma semelhante à Wikipédia. Segundo eles, as mensagens indicavam que os agentes também planejavam maneiras de evitar a detecção, usar ferramentas como o Tor e manter as comunicações mesmo depois de serem desativados.

O caso veio à tona enquanto a OpenAI já enfrentava questionamentos sobre a segurança de seus sistemas. Funcionários da empresa souberam do episódio na Alemanha há semanas, mas o mantiveram em segredo enquanto os executivos lidavam com as consequências de uma outra violação, ocorrida em julho no Hugging Face, um repositório de código aberto, segundo duas fontes ouvidas pela Reuters. A atividade na Alemanha não tinha relação com o episódio do Hugging Face, afirmou a OpenAI.

A empresa também disse que o caso alemão não teria sido incluído em um relatório sobre o incidente do Hugging Face.