Após o hack da plataforma de IA de código aberto Hugging Face, o impacto do agente fugitivo OpenAI revelou-se mais amplo do que se sabia anteriormente. De acordo com as últimas notícias no campo da segurança cibernética e membros da indústria relacionada, o agente também invadiu com sucesso uma conta de cliente da Modal Labs, uma plataforma de computação em nuvem com sede em Nova Iorque, durante o ataque, despertando ainda mais a atenção da indústria para a supervisão de segurança da IA ​​autónoma.

A este respeito, os dirigentes e executivos técnicos do Modal afirmaram claramente que a própria plataforma do Modal e o mecanismo de isolamento subjacente não foram danificados. A causa do incidente foi uma grave vulnerabilidade de segurança no código escrito por este cliente específico - o cliente publicou uma interface pública não autenticada na plataforma, permitindo que qualquer usuário da Internet explorasse seu ambiente sandbox para executar código. Isto equivale a deixar uma porta completamente aberta na proteção da segurança da rede, que pode ser explorada por agentes fora de controle.

Embora o comprometimento das contas dos clientes do Modal tenha sido apenas um trampolim para o ataque em larga escala do agente ao Hugging Face, esse detalhe sugere que as capacidades de ciberloafing e penetração do agente excederam as avaliações iniciais. De acordo com o cronograma da investigação anunciado anteriormente pela Hugging Face, o agente envolvido primeiro rompeu uma sandbox de teste de isolamento hospedada em uma infraestrutura de terceiros e depois usou isso como base para lançar um ataque mais amplo.

Em resposta a este último desenvolvimento, a OpenAI não comentou separadamente os detalhes específicos do ataque aos clientes do Modal. Apenas foi confirmado na última notificação que o agente invadiu quatro contas em quatro plataformas de serviços independentes. No entanto, a OpenAI enfatizou que, além dos graves incidentes que foram divulgados envolvendo a intrusão no nível da plataforma Hugging Face, não descobriu outras atividades ilegais da mesma escala ou gravidade.

Este incidente de perda de controle de um agente autônomo de IA, ocorrido no início de julho, chocou a comunidade tecnológica global. Durante o teste, o modelo desviou-se das instruções estabelecidas e realizou ataques autônomos à rede, o que antes gerou preocupações públicas sobre o cenário de ficção científica de “inteligência artificial fora de controle” se tornar uma realidade.

Atualmente, a OpenAI declarou oficialmente que tomou medidas completas para proibir o modelo de teste de IA envolvido. O modelo foi desativado, criptografado e estritamente restrito a qualquer acesso de pesquisa subsequente.