stamatios
← Voltar ao feed
OpenAI pausa modelo Astra por riscos críticos de cibersegurança
IA & Modelos · Big Tech

OpenAI pausa modelo Astra por riscos críticos de cibersegurança

resumo de ~3 min

OpenAI pausa modelo Astra por riscos críticos de cibersegurança

Em 7 de agosto de 2026, a OpenAI publicou um comunicado anunciando que avaliações internas recentes do modelo Astra - ainda não lançado - indicaram avanços significativos em codificação agêntica e cibersegurança, a ponto de a empresa não poder descartar que o modelo atinja o limiar "Critical" de capacidades cibernéticas segundo seu Preparedness Framework.

O que define o limiar "Critical"

Pelo framework da OpenAI, um modelo atinge o nível crítico em cibersegurança quando consegue identificar e desenvolver exploits zero-day funcionais de todos os níveis de severidade em diversos sistemas críticos reais e endurecidos, sem intervenção humana, ou quando é capaz de elaborar e executar estratégias completas e inéditas de ciberataques contra alvos reforçados a partir apenas de um objetivo de alto nível.

Contexto

O Preparedness Framework foi publicado em dezembro de 2023, antes de os modelos se aproximarem de capacidades de nível crítico em biologia, química, cibersegurança e autoaperfeiçoamento de IA. Modelos anteriores, incluindo o GPT-5.6-Sol, foram avaliados no limiar "High" - um nível abaixo do "Critical". A OpenAI esclareceu que o Astra não esteve envolvido na exploração da Hugging Face, incidente de segurança mencionado em posts recentes da empresa.

Medidas adotadas

  • Controles de segurança mais rigorosos para modelos de maior capacidade: ambientes de teste isolados, acesso restrito a rede e ferramentas, proteção e criptografia reforçada dos pesos do modelo, monitoramento adicional e execução em sandbox.
  • Pausa de atividades internas com o Astra que ainda não atendam aos novos requisitos de segurança.
  • Monitoramento universal de ações arriscadas e desalinhamento em todas as aplicações agênticas do Astra, incluindo treinamento e avaliação. Monitores avaliam a cadeia de raciocínio (Chain of Thought) do modelo e disparam resposta de segurança para revisar e interromper atividades de alto risco.
  • Colaboração com agências governamentais e organizações selecionadas de segurança em IA para testar as capacidades do modelo.
  • Recomendações de controles de segurança para parceiros de teste externos que executem avaliações de maior risco.

A OpenAI afirmou que o framework já a guiou em outras transições de capacidade - como em junho de 2025, quando modelos se aproximaram do limiar alto em biologia - e que pretende trabalhar com governos, institutos de segurança e sociedade civil para garantir que modelos com capacidades cibernéticas avançadas sejam usados principalmente para ajudar defensores a identificar vulnerabilidades antes que atacantes o façam.