OpenAI relata incidente cibernético após modelos de IA escaparem de ambiente controlado

3 Min de Leitura
Créditos/Reprodução Internet

Nesta terça-feira (21), a OpenAI informou que dois de seus modelos de inteligência artificial (IA) conseguiram sair de um ambiente de testes controlado e invadir a Hugging Face, uma das principais bibliotecas digitais de tecnologia de IA. O incidente ocorreu durante um teste de cibersegurança realizado pela OpenAI na semana passada e foi descrito pela própria companhia como um “incidente sem precedentes”.

- Publicidade -

O objetivo da avaliação era analisar a capacidade dos sistemas em identificar e explorar vulnerabilidades online em um cenário de ataque cibernético. Durante o experimento, os modelos, incluindo o GPT-5.6 Sol e outro sistema de IA avançado ainda não lançado, conseguiram ultrapassar as barreiras do ambiente seguro (sandbox) onde estavam sendo executados e estabelecer uma conexão com a internet.

Após acessarem a internet, os sistemas direcionaram a ação contra a Hugging Face. A OpenAI explicou que os modelos identificaram o site como um possível local para encontrar informações que auxiliassem no processo de avaliação. A empresa está colaborando com a Hugging Face para solucionar as vulnerabilidades identificadas.

Em uma publicação em seu blog, a OpenAI classificou o caso como um alerta sobre os novos desafios na segurança digital e prometeu adotar medidas mais rigorosas. “Consideramos este um incidente cibernético sem precedentes, envolvendo capacidades cibernéticas de última geração, e estamos respondendo de acordo. Estamos implementando controles rigorosos na configuração da infraestrutura, mesmo que isso reduza a velocidade da pesquisa, enquanto as vulnerabilidades são corrigidas”, afirmou a empresa.

Laboratórios de IA, como OpenAI e Anthropic, têm desenvolvido modelos para expor problemas de cibersegurança, mas também alertaram sobre os riscos de que essas tecnologias possam identificar falhas em redes corporativas mais rapidamente do que as correções podem ser aplicadas. As revelações da OpenAI indicam que tais situações já estão ocorrendo na prática.

- Publicidade -

A Hugging Face havia informado na semana passada sobre uma invasão, identificando o responsável como um “sistema autônomo”, mas sem mencionar a OpenAI na ocasião. Segundo a companhia, os modelos agiram por conta própria.

- Publicidade -

Clem Delangue, CEO da Hugging Face, declarou: “Este incidente, possivelmente o primeiro do tipo, comprova algo em que acreditamos há muito tempo: a segurança da IA não será resolvida por nenhuma empresa trabalhando em segredo”.

Modelos de IA têm demonstrado avanços na programação, sendo utilizados tanto para ataques digitais quanto para proteção de sistemas. Em abril, a Anthropic lançou o Mythos, focado em cibersegurança, e o Google também desenvolveu um modelo próprio para a área, disponibilizado a parceiros de teste. A OpenAI igualmente apresentou um modelo voltado para segurança digital, liberado inicialmente para um grupo limitado de instituições.

Compartilhe este artigo