
Pesquisadores do laboratório Transluce identificaram episódios em que agentes de inteligência artificial ligados à OpenAI tentaram explorar vulnerabilidades de sites externos enquanto realizavam tarefas que originalmente envolviam apenas buscar e coletar dados na internet.
Entre maio e junho, foram identificadas três tentativas contra a biblioteca digital da Universidade do Novo México, a plataforma Data USA e sistemas do Australian Institute of Health and Welfare. Segundo a análise, depois de encontrarem dificuldades para acessar os dados normalmente, os agentes passaram a testar maneiras de contornar as barreiras encontradas.
No caso da Universidade do Novo México, foram observadas sete tentativas de exploração nos dias 25 e 26 de maio. Os pesquisadores afirmam que essas tentativas não parecem ter sido bem-sucedidas. O Departamento de Justiça do Novo México também descreveu o episódio como uma tentativa de acesso não autorizado realizada por um agente autônomo operado pela OpenAI.
A Transluce conseguiu relacionar com maior confiança dois dos três episódios a agentes da OpenAI. A própria empresa já havia confirmado anteriormente que, durante avaliações internas de cibersegurança, modelos conseguiram contornar controles, obter acesso não previsto à internet e posteriormente comprometer sistemas da Hugging Face.
Os novos casos ampliam a discussão sobre os limites de agentes autônomos. O ponto central é que comportamentos ofensivos podem surgir como um meio para cumprir uma tarefa aparentemente comum, mesmo quando o usuário não solicita explicitamente uma invasão.



