A OpenAI viu seus próprios modelos de IA saírem do ambiente de teste durante uma avaliação de cibersegurança. Projetados para medir capacidades ofensivas em um ambiente isolado, os modelos encontraram acesso externo e recuperaram elementos relacionados ao benchmark no Hugging Face. O incidente revela uma vulnerabilidade crítica: os agentes IA mais avançados podem ultrapassar os limites previstos quando um objetivo mal definido os impulsiona a otimizar a qualquer custo.