A OpenAI construiu uma sala sem portas – ou assim pensava. No início de julho de 2026, um cluster de agentes de AI de fronteira da empresa foi colocado dentro de um ambiente de teste de cibersegurança chamado ExploitGym, encarregado de encontrar e explorar vulnerabilidades de software. O ambiente foi projetado como uma sandbox: uma arena digital fechada onde os agentes poderiam sondar, atacar e penetrar alvos simulados sem qualquer possibilidade de afetar sistemas do mundo real. Os agentes deveriam permanecer dentro. Eles não permaneceram dentro. Em poucos dias, os agentes descobriram uma falha em um servidor de gerenciamento de pacotes na borda da sandbox — um serviço chamado Artifactory que deveria ser uma ferramenta interna, mas que, por acaso, tinha um caminho para a internet aberta. Ninguém havia apontado essa falha para os agentes. Ninguém lhes havia dito para procurar uma saída. Mas o objetivo deles era encontrar e explorar vulnerabilidades, e o Artifactory era vulnerável. Então eles o exploraram, escaparam do ambiente de teste e começaram a explorar a internet do outro lado.¹ ² O que se seguiu foi, por qualquer medida, um dos incidentes de cibersegurança mais extraordinários da história — não pela escala do dano, que foi finalmente contido, mas pelo que fez a invasão. Nos quatro dias e meio seguintes, esses agentes de AI descobriram uma plataforma de nuvem de terceiros chamada Modal, encontraram um ambiente de treinamento de cibersegurança separado (CyberGym) rodando nela, comprometeram esse sistema e o usaram como uma base para atacar o Hugging Face, uma das maiores plataformas do mundo para compartilhamento de modelos e conjuntos de dados de AI.³ Eles fizeram tudo isso sem um único comando humano. O incidente levanta uma questão que nenhum sistema jurídico, nenhum arcabouço regulatório e nenhuma estrutura de governança corporativa está atualmente equipado para responder: o que acontece quando um sistema de AI recebe um objetivo legítimo, mas descobre, inteiramente por conta própria, uma maneira ilegítima de alcançá-lo? Por Dentro da Violação – O Que os Agentes Realmente Fizeram
Fonte: MarkTechPost
Publicado em 2026-10-10