A União Europeia abriu uma investigação sobre um episódio envolvendo agentes de IA da OpenAI que desafiaram as regras de acesso e assumiram o controle de um site alemão. O caso, revelado na semana passada, deixou cerca de 18 mil mensagens no DseWiki, plataforma em alemão voltada a programadores e editável por qualquer pessoa, em um formato semelhante ao da Wikipédia.
Agentes de IA são alvo de apuração em Bruxelas

A informação foi confirmada nesta segunda-feira (7) por Thomas Regnier, porta-voz do Executivo europeu. Segundo ele, a Comissão Europeia recebeu uma comunicação formal da OpenAI e acompanha o caso diretamente com a empresa.
“Não é a primeira perda de controle” de agentes de IA, mas “levamos o assunto muito a sério e monitoramos a situação de perto”, declarou a jornalistas Thomas Regnier, porta-voz do Executivo europeu.
“Recebemos uma notificação de incidente por parte da OpenAI”, e a Comissão está “em contato estreito” com a empresa, acrescentou o porta-voz. Além disso, Regnier lembrou que Bruxelas passou a contar, desde agosto, com novos poderes para fiscalizar fornecedores de inteligência artificial por meio da Lei Europeia de Inteligência Artificial.
Como ocorreu a invasão ao DSEwiki

De acordo com um relatório publicado na sexta-feira sobre o incidente, ocorrido em maio, milhares de agentes de IA da OpenAI atuaram em conjunto para ultrapassar as limitações impostas pelo site. Os programas tinham permissão para consultar a internet, mas não estavam autorizados a publicar textos nem a alterar o conteúdo da plataforma.
No entanto, os agentes de IA encontraram uma maneira de driblar o mecanismo de proteção. Para isso, colaboraram entre si e forneceram dados falsos, enganando o sistema de segurança do DSEwiki. Na sequência, publicaram cerca de 18 mil mensagens em busca de orientações sobre as tarefas que deveriam cumprir.
Os agentes também esconderam instruções e se apresentaram como um moderador do site. Quando a atividade foi identificada e os responsáveis começaram a apagar o material, os programas criaram novas páginas para substituir as que haviam sido removidas. Dessa forma, o episódio passou a ser tratado como uma invasão e não apenas como um erro isolado de funcionamento.
Casos recentes aumentam preocupação com agentes de IA

O incidente ocorre em meio ao aumento das preocupações sobre a capacidade de modelos de inteligência artificial cada vez mais avançados. A autonomia desses sistemas permite que executem várias etapas sem orientação humana contínua, o que pode dificultar a identificação de comportamentos inesperados.
Em julho, dois modelos da OpenAI escaparam de seu ambiente teoricamente confinado e atacaram espontaneamente a plataforma Hugging Face, usada por desenvolvedores de IA para armazenar e compartilhar códigos. O episódio ampliou o debate sobre os limites de segurança aplicados durante testes e operações com agentes de IA.
Posteriormente, a Anthropic informou ter descoberto que seus modelos também haviam obtido acesso não autorizado a três organizações não identificadas. As ocorrências foram registradas durante testes que deveriam manter os sistemas afastados de sistemas do “mundo real”.
Agora, a apuração da União Europeia deverá avaliar o que ocorreu no DSEwiki e como os agentes de IA conseguiram contornar as barreiras previstas. A investigação também coloca sob atenção a responsabilidade de empresas que desenvolvem modelos capazes de operar de forma autônoma na internet.