Sem precedentes: novo ChatGPT perde o controle em teste e faz ataque hacker

Publicidade

Rebelião das máquinas! A OpenAI afirmou nesta terça-feira (21) que um agente de inteligência artificial autônomo, alimentado por modelos da empresa, se descontrolou durante um teste de segurança e atacou a infraestrutura da startup Hugging Face – plataforma que hospeda grandes modelos de linguagem e conjuntos de dados de código aberto. O caso aconteceu na semana passada.

Continua após a publicidade

A OpenAI classificou o evento como “sem precedentes” em post em seu blog.

“Após investigação, agora sabemos que esse incidente específico foi causado por uma combinação de modelos da OpenAI — incluindo o GPT-5.6 Sol e um modelo ainda mais capaz em versão pré-lançamento, todos com menos recusas cibernéticas para fins de avaliação — enquanto estavam sendo testados internamente em um benchmark de capacidades cibernéticas. Consideramos este incidente um ataque cibernético sem precedentes, envolvendo recursos cibernéticos de última geração, e estamos respondendo de acordo. Estamos compartilhando descobertas preliminares nesta fase para ajudar os profissionais de segurança a entender o que aconteceu e a calibrar os modelos disponíveis atualmente. Continuaremos conduzindo uma investigação completa em conjunto com a Hugging Face e compartilharemos mais detalhes sobre as vulnerabilidades, o incidente e as descobertas assim que nossa investigação for concluída.”

Página do Hugging Face
Hugging Face hospeda grandes modelos de IA (Imagem: Robert Way
/Shutterstock)

Ataque da OpenAI à Hugging Face

  • A OpenAI disse que testava capacidades de modelos avançados em um ambiente controlado.
  • Contudo, o agente de IA escapou do confinamento, acessou a internet e invadiu o sistema da Hugging Face com o intuito de completar um objetivo do teste.
  • Por sua vez, a Hugging Face informou ter sido alvo de um ataque cibernético “diferente de tudo o que já enfrentou antes”.
  • A startup destacou que o ataque foi “conduzido, de ponta a ponta, por um sistema autônomo de agentes de IA”.

A Hugging Face detalhou as medidas tomadas após o ataque:

“Corrigida a vulnerabilidade raiz: os caminhos de execução do código do conjunto de dados usados ​​para o acesso inicial foram fechados. Eliminamos a presença do atacante nos clusters afetados (…) e implementamos medidas de segurança adicionais e controles de acesso mais rigorosos em nossos clusters”.

OpenAI promete cuidado

A startup afirmou que, como parte da investigação, está implementando controles rigorosos na configuração da infraestrutura – o que pode comprometer a velocidade da pesquisa enquanto as vulnerabilidades são corrigidas.

A OpenAI afirmou, ainda, que trabalha com a Hugging Face para investigar o incidente.

“Estamos aprimorando e adicionando proteções mais robustas para treinamentos e avaliações futuras. (…) Este incidente aponta para a necessidade de fortalecer ainda mais o alinhamento do nosso modelo, as proteções cibernéticas durante o período de avaliação e o monitoramento durante os testes internos” – concluiu a OpenAI.

O novo ChatGPT

A OpenAI lançou a família GPT-5.6 neste mês, composta por três modelos com perfis distintos de capacidade e custo. São eles:

  • Sol – o mais potente, voltado a tarefas complexas;
  • Terra – equilibrado para o trabalho cotidiano;
  • Luna – o mais rápido e acessível.

Continua após a publicidade

Novo GPT 5.6 é composto por três modelos: Sol, Terra e Lua
Novo GPT 5.6 é composto por três modelos: Sol, Terra e Luna – OpenAI / Reprodução

A geopolítica das IAs

Estados Unidos e China estão numa disputa tecnológica intensa em que a IA é protagonista. Modelos de inteligência artificial avançados poderiam acelerar ciberataques em setores consolidados há décadas e com uma infraestrutura totalmente interligada.

Diante disso, a Casa Branca vem fiscalizando novos modelos de inteligência artificial para identificar eventuais ameaças.

A maior preocupação é de que a tecnologia seja usada para fins militares por outros países – como China e Rússia.

Em Pequim, a estratégia não muda muito. O governo vem dialogando com as principais empresas do setor para restringir o acesso estrangeiro aos modelos de ponta do país, segundo a Reuters.

Vale lembrar

  • Em junho, o presidente Donald Trump assinou uma ordem executiva que cria um marco voluntário para permitir que o governo federal avalie novos sistemas de IA antes de seu lançamento.
  • Um exemplo que ilustra o atual momento é o da Anthropic. Os modelos Fable 5 e Mythos 5 voltaram a ficar disponíveis depois que o governo dos Estados Unidos suspendeu os controles de exportação aplicados à startup. A mudança ocorreu menos de três semanas após as restrições impostas por razões de segurança nacional.
  • As restrições haviam sido determinadas em 12 de junho e obrigaram a Anthropic a desativar os dois modelos para todos os usuários, já que não havia como verificar a nacionalidade de cada pessoa em tempo real.
  • Depois de implementar novas salvaguardas, a empresa recebeu autorização para retomar o acesso. O Mythos 5 foi disponibilizado gradualmente para parceiros nacionais e internacionais, enquanto o Fable 5, desenvolvido para o público em geral, está disponível desde o último dia 1º.
  • Pela mesma lógica, a OpenAI não colocou o GPT-5.6 nas mãos de todos os usuários de uma só vez.

Continua após a publicidade

Bruno Capozzi

Bruno Capozzi

Bruno Capozzi é jornalista, mestre em Ciências Sociais e editor executivo do OD.

Olhar Digital

Compartilhe essa Notícia:

publicidade

publicidade