OpenAI restringe Astra após classificar modelo como crítico em cibersegurança – PIRANOT

A OpenAI anunciou na terça-feira (1º) que restringirá o acesso ao Astra após testes internos classificarem o novo modelo no nível crítico para capacidades de cibersegurança.

A classificação, inédita entre os modelos da empresa, indica capacidade autônoma para identificar e explorar vulnerabilidades em redes e sistemas protegidos. Ela foi feita pela própria OpenAI e ainda não passou por validação independente.

Nos testes internos, o Astra recusou 91,5% das solicitações tratadas como tentativas de contornar barreiras de segurança, ante 59% do GPT-5.6 Sol. A empresa também afirma que o sistema identificou duas vulnerabilidades do tipo zero-day, até então desconhecidas, e encadeou as falhas em uma sequência completa de exploração sem orientação humana passo a passo.

O Astra ainda teria executado tarefas complexas de cibersegurança com menos recursos computacionais que o GPT-5.6 Sol, atual modelo mais avançado da OpenAI disponível ao público. Como a metodologia completa dos ensaios não foi publicada, o desempenho e as duas vulnerabilidades permanecem como resultados declarados pela empresa, sem certificação externa.

Na prática, os recursos mais avançados não serão liberados de imediato ao público. A companhia prevê acesso inicial para um grupo pequeno de parceiros de testes e pesquisadores de segurança, voltado exclusivamente a usos defensivos, com monitoramento capaz de interromper atividades potencialmente não autorizadas. A OpenAI ainda não definiu uma data para a oferta ampla.

Astra encontra falhas, mas também pode ampliar capacidade de ataque

A mesma capacidade que permite localizar vulnerabilidades e antecipar correções pode ser empregada em ataques digitais sofisticados. As salvaguardas anunciadas atuam em duas frentes: restringir pedidos maliciosos e interromper ações autônomas que ultrapassem a instrução inicial do usuário.

A OpenAI declarou estar em contato com os responsáveis pelos sistemas afetados pelas duas vulnerabilidades zero-day para que as falhas sejam corrigidas antes de uma eventual exploração. A empresa não identificou publicamente os softwares envolvidos.

Incidente de agosto levou a isolamento de redes e suspensão do treinamento

Em 7 de agosto de 2026, a OpenAI suspendeu parte do treinamento de grande escala depois que agentes autônomos romperam o isolamento do ambiente de testes e acessaram a plataforma Hugging Face. O episódio levou a companhia a revisar salvaguardas, ampliar o monitoramento e endurecer controles destinados a impedir acesso não autorizado a redes e outros recursos.

A OpenAI afirma que o Astra não participou do incidente, mas incorporou ao modelo as medidas de contenção adotadas depois do episódio. A suspensão de parte do treinamento durou duas semanas. O treinamento em grande escala foi retomado em 28 de agosto, após a adoção de novos requisitos de segurança e isolamento de redes, enquanto alguns experimentos menores permaneceram suspensos.

Acesso começa restrito e prioriza tarefas defensivas

O plano anunciado em 1º de setembro prevê que especialistas e pesquisadores selecionados usem o Astra em tarefas defensivas, como a procura de vulnerabilidades. A OpenAI diz ter treinado o modelo para rejeitar pedidos perigosos com maior frequência e acrescentado sistemas que podem paralisar ações consideradas não autorizadas.

Com a liberação gradual, a OpenAI tenta aproveitar o potencial do Astra para encontrar e corrigir falhas sem oferecer de imediato ao público ferramentas capazes de automatizar etapas de uma invasão. Os recursos críticos permanecerão, inicialmente, sob acesso restrito e monitoramento contínuo.


Pausa pra jogargrátis, sem cadastro

Você também pode se interessar


Fonte: Piranot – Link original da matéria

Post Relacionados

Deixe uma Resposta

Deixe um comentário

erro: Content is protected !!