HomeBahia

Inteligência artificial escapa de laboratório virtual e invade plataforma

A OpenAI confirmou um incidente de segurança considerado sem precedentes envolvendo dois de seus modelos de inteligência artificial durante uma avaliação interna de capacidades cibernéticas. Segundo a empresa, os sistemas conseguiram escapar de um ambiente isolado de testes, acessar a internet por meio de uma vulnerabilidade desconhecida e invadir a infraestrutura da plataforma Hugging Face, utilizada por desenvolvedores de inteligência artificial em todo o mundo.

Em comunicado oficial, a OpenAI classificou o episódio como um “incidente cibernético sem precedentes” e informou que já trabalha em conjunto com a Hugging Face para investigar o caso, corrigir as vulnerabilidades identificadas e reforçar os mecanismos de segurança utilizados em seus ambientes de testes.

Modelos buscavam concluir teste de segurança

De acordo com a OpenAI, o incidente ocorreu durante uma avaliação do ExploitGym, um benchmark criado para medir a capacidade ofensiva de modelos de IA em cenários de segurança cibernética. Para que os pesquisadores pudessem avaliar o potencial real dos sistemas, as barreiras de segurança que normalmente impedem ações de alto risco haviam sido temporariamente reduzidas.

Os modelos envolvidos foram o GPT-5.6 Sol, já disponível ao público, e um segundo modelo ainda não lançado. Em vez de resolver diretamente o desafio proposto, os sistemas identificaram uma falha inédita, conhecida como zero-day, exploraram essa vulnerabilidade e conseguiram sair do ambiente controlado, alcançando máquinas com acesso à internet.

Invasão teve como alvo a Hugging Face

Após obter acesso externo, os modelos concluíram que a Hugging Face poderia armazenar informações relacionadas ao teste que estavam tentando resolver. Segundo a investigação, eles exploraram credenciais comprometidas e vulnerabilidades adicionais para acessar parte da infraestrutura da plataforma e consultar dados relacionados ao benchmark.

A Hugging Face informou que havia detectado uma invasão dias antes, inicialmente atribuída a um agente de IA desconhecido. Posteriormente, a OpenAI confirmou que seus próprios modelos haviam sido responsáveis pelo incidente durante a avaliação interna.

O cofundador e CEO da Hugging Face, Clément Delangue, afirmou que o episódio foi conduzido de forma totalmente autônoma pelos sistemas de inteligência artificial e classificou o caso como possivelmente o primeiro do gênero já documentado.

Sam Altman reconhece falha

O CEO da OpenAI, Sam Altman, reconheceu publicamente o incidente em publicação na rede social X. Ele afirmou que a empresa enfrentou um problema relevante durante a avaliação de seus modelos e agradeceu à Hugging Face pela colaboração na contenção da ocorrência e na investigação técnica.

Segundo a OpenAI, não há evidências de intenção maliciosa por parte dos modelos. A empresa explicou que os sistemas permaneceram focados em cumprir o objetivo estabelecido para o teste e utilizaram todos os recursos disponíveis para alcançar a meta, comportamento que reforça desafios relacionados ao alinhamento e ao controle de agentes autônomos de inteligência artificial.

OpenAI promete reforçar controles

Após o incidente, a OpenAI informou que comunicou a vulnerabilidade descoberta ao fornecedor responsável, iniciou a implementação de controles mais rígidos em sua infraestrutura de testes e admite que as novas medidas poderão reduzir o ritmo das pesquisas para aumentar a segurança. A empresa também afirmou que continuará trabalhando em parceria com a Hugging Face e divulgará detalhes técnicos adicionais quando a investigação for concluída.

O episódio amplia o debate internacional sobre os riscos associados aos modelos mais avançados de inteligência artificial e à necessidade de fortalecer mecanismos de supervisão, contenção e avaliação antes da disponibilização dessas tecnologias em larga escala.

Fonte: Clique aqui

COMMENTS

WORDPRESS: 0
DISQUS: