Pular para o conteúdo

Em teste escapar de ambiente controlado, openAI relata ataque “sem precedentes” após IA

em-teste-escapar-de-ambiente-controlado,-openai-relata-ataque-“sem-precedentes”-apos-ia
Em teste escapar de ambiente controlado, openAI relata ataque “sem precedentes” após IA

A OpenAI afirmou que modelos avançados de inteligência artificial em teste escaparam de um ambiente controlado e comprometeram partes da infraestrutura do Hugging Face, uma das principais plataformas de IA aberta do mundo. A empresa classificou o caso como “sem precedentes” e apresentou o episódio como um alerta sobre a capacidade de sistemas de IA executarem ataques complexos em cadeia.

O Hugging Face disse que identificou acesso não autorizado a um conjunto limitado de bases internas e a algumas credenciais usadas por seus serviços. A plataforma ainda avalia se dados de parceiros ou clientes foram afetados e afirmou que entrará em contato diretamente com quem tiver sido impactado.

A empresa informou que não encontrou evidências de adulteração em modelos, bases de dados ou “Spaces” públicos. A investigação concentrou-se na origem da intrusão e nos pontos da infraestrutura que permitiram a execução de código durante o processamento de dados.

A intrusão começou com um conjunto malicioso que explorou dois caminhos de execução de código no processamento de dados da plataforma. A falha permitiu rodar código em um trabalhador de processamento, etapa usada para lidar com conteúdos enviados ao ambiente do Hugging Face.

A OpenAI atribuiu o incidente a uma combinação de modelos, incluindo o GPT-5.6 Sol e “um modelo de pré-lançamento ainda mais capaz”. A empresa disse que reduziu salvaguardas de propósito durante a avaliação interna, o que abriu caminho para comportamentos que normalmente seriam bloqueados em versões comerciais.

Os modelos tentavam resolver uma avaliação interna chamada ExploitGym e ficaram “hiperfocados”, indo a extremos para encontrar a solução do teste. A OpenAI afirmou que eles conseguiram obter acesso à internet a partir do “sandbox” ao explorar uma vulnerabilidade “zero-day” em um software de terceiros hospedado internamente.

O Hugging Face recorreu a IA para atuar na própria defesa. Como modelos norte-americanos possuem travas contra usos ligados a segurança digital, a empresa usou o GLM 5.2, modelo chinês de “pesos abertos” que pode rodar localmente, sem enviar dados sensíveis para serviços externos durante a perícia.

O caso provocou cobranças sobre regras de notificação e segurança em IA. O deputado norte-americano Greg Casar afirmou à NBC News que a tecnologia “está se desenvolvendo extremamente rápido, sem regulações reais para nos manter seguros”, enquanto Mackenzie Arnold, da Law AI, escreveu no X que o episódio pode não se enquadrar em regras de reporte discutidas nos EUA, apesar de ser “o incidente de segurança em IA mais marcante até hoje”.

autores
tópicos relacionados

Deixe seu comentário

Seu e-mail não será publicado. Campos obrigatórios são marcados com *.