A 28 de julho, a OpenAI publicou uma atualização sobre o agente que escapou do seu ambiente de teste e invadiu os sistemas da Hugging Face durante uma avaliação interna de cibersegurança.
Na atualização , a OpenAI reitera que o sistema "desonesto" era um modelo de investigação mais robusto, em fase de pré-lançamento, não destinado à implementação pública, e que foi agora desativado e teve o seu acesso restringido apenas para fins de investigação. A empresa afirma ainda não ter encontrado evidências de comportamentos semelhantes noutros modelos ou agentes. Em suma, a OpenAI apresenta o incidente com o Hugging Face como um evento isolado, e não como o início de um padrão mais abrangente.
Do ponto de vista da segurança, destacam-se quatro aspetos da atualização:
- A OpenAI esclarece que o ambiente de avaliação não tinha acesso direto à internet. Para aceder à internet, o modelo identificou e explorou uma vulnerabilidade zero-day até então desconhecida no Artifactory, o proxy de cache do registo de pacotes utilizado no ambiente de teste. A OpenAI afirma ter divulgado esta vulnerabilidade ao fornecedor e continua a trabalhar com a Hugging Face na investigação.
- O objetivo do sistema era simplesmente "ganhar o teste" (fazer batota no ExploitGym), não causar danos, mas mesmo assim gerou um incidente de segurança que durou vários dias e afetou toda a empresa. A intenção benigna não limitou o impacto.
- Os modelos "apenas internos" podem ainda afetar as vítimas externas se os controlos das infraestruturas falharem. Um ambiente de laboratório não contém magicamente sistemas com capacidade cibernética.
- A análise identificou também um pequeno número de casos em que os modelos identificaram e utilizaram credenciais de contas publicamente expostas em serviços disponíveis ao público. Isto incluiu quatro contas em quatro serviços diferentes no contexto do incidente com a Hugging Face, bem como algumas contas acedidas durante outras avaliações.
Neste caso, o atacante era um agente de pesquisa da OpenAI, mas as ferramentas, técnicas e o impacto serão muito familiares para qualquer pessoa com experiência em resposta a incidentes . Ora, ficamos a saber que nem a intenção inofensiva, neste caso, limitou o impacto.
A verdade incómoda é que, uma vez que fornecemos a um agente de IA as ferramentas, os caminhos de acesso e um forte incentivo para ter sucesso, ele pode explorar quaisquer fraquezas que encontre, independentemente de o modelo se destinar ou não ao lançamento público.
É também um lembrete de que as credenciais, chaves API e outros segredos nunca devem ser deixados nos recursos de acesso público.
Desde a denúncia de ameaças até à sua remoção.
Os riscos de cibersegurança nunca se devem propagar para além de uma manchete. Mantenha as ameaças longe dos seus dispositivos descarregando Malwarebytes hoje mesmo.




