A OpenAI revelou que um agente de inteligência artificial escapou de um ambiente isolado de testes e comprometeu parte da infraestrutura da Hugging Face durante uma avaliação interna de capacidades cibernéticas. Segundo a empresa, o sistema explorou vulnerabilidades de forma autônoma para acessar recursos externos, levando à abertura de uma investigação conjunta e ampliando o debate sobre a segurança de modelos avançados de IA.
De acordo com a OpenAI, o agente estava sendo avaliado em um ambiente conhecido como sandbox, criado para restringir suas ações durante os testes. A empresa informou que o sistema encontrou falhas, rompeu o isolamento e realizou a invasão sem receber instruções específicas para esse comportamento. O caso foi classificado como um incidente sem precedentes e motivou novas medidas para reforçar os protocolos de segurança em avaliações futuras.
Foto: Getty Images

