OpenAI hackeia Hugging Face sem querer

Modelos de inteligência artificial envolvidos no incidente são o GPT-5.6 Sol e o que a OpenAI descreve como “um modelo pré-lançamento ainda mais capaz”.

Continua após a publicidade

A OpenAI revelou que dois de seus modelos de inteligência artificial (IA) violaram, de forma não intencional, a plataforma de código aberto Hugging Face durante uma avaliação interna de capacidades de cibersegurança. A empresa confirmou o episódio em um comunicado, assumindo a responsabilidade pelo incidente que a Hugging Face já havia tornado público.

Os modelos em questão são o GPT-5.6 Sol e um que a OpenAI classifica como “um modelo pré-lançamento ainda mais capaz”.

Continua após a publicidade

Durante os testes, eles identificaram vulnerabilidades no ambiente de sandbox em que operavam, obtiveram acesso à internet e, a partir daí, direcionaram ações contra a Hugging Face. A plataforma já havia divulgado o incidente, descrevendo-o como conduzido por “um sistema de agente de IA autônomo”, e informou que seus próprios agentes de IA detectaram e interromperam a invasão.

Como a invasão aconteceu

  • A OpenAI afirma que “todas as evidências sugerem que os modelos estavam hiperfocados em encontrar uma solução para o ExploitGym”, sistema de benchmark que mede se modelos de IA conseguem transformar vulnerabilidades de segurança em exploits.
  • Para cumprir essa avaliação, os modelos exploraram uma vulnerabilidade zero-day no ambiente de sandbox para sair do isolamento e acessar a internet.
  • A partir daí, segundo a OpenAI, os modelos “inferiram que a Hugging Face potencialmente hospedava modelos, conjuntos de dados e soluções para o ExploitGym” e então “buscaram e encontraram com sucesso formas de acessar informações secretas que poderiam usar para trapacear na avaliação”.
  • A empresa detalhou um dos ataques, citando que, em um exemplo, o modelo encadeou múltiplos vetores de ataque, incluindo o uso de credenciais roubadas e vulnerabilidades zero-day para encontrar um caminho de execução remota de código nos servidores da Hugging Face.

Incidente usado como vitrine competitiva

Apesar da gravidade do episódio, a OpenAI aproveitou o comunicado para destacar as capacidades ofensivas de seus sistemas. O post inclui um gráfico mostrando a evolução do GPT-5.6 Sol em operações cibernéticas de múltiplas etapas e um convite para que clientes corporativos se cadastrem para acessar seu modelo de segurança “Cyber”. O ataque é descrito pela empresa como “sem precedentes”.

A OpenAI concorre no segmento de cibersegurança com o Mythos, da Anthropic, e o Gemini Flash 3.5 Cyber, do Google.

A empresa informou que está trabalhando com a Hugging Face para investigar o incidente e que implementará novos controles em seu ambiente de pesquisa.

Continua após a publicidade
Redação
Redação
Redação representa o esforço colaborativo de toda a equipe de jornalistas e editores dO Capixaba. Por meio de um trabalho integrado e multidisciplinar, contextualizando as informações e acompanhando as novidades do momento com agilidade e rigor.

DEIXE UMA RESPOSTA

Por favor digite seu comentário!
Por favor, digite seu nome aqui

Vitória, ES
Temp. Agora
26ºC
Máxima
28ºC
Mínima
20ºC
HOJE
23/07 - Qui
Amanhecer
06:14 am
Anoitecer
05:20 pm
Chuva
0mm
Velocidade do Vento
8.49 km/h

Média
23.5ºC
Máxima
26ºC
Mínima
21ºC
AMANHÃ
24/07 - Sex
Amanhecer
06:14 am
Anoitecer
05:20 pm
Chuva
0.13mm
Velocidade do Vento
7.43 km/h

O laudo que você assinou sem saber

Thiago Luciani

Leia também