Daily Journal
Daily Journal

OpenAI diz que Astra cruza o limiar 'Critical' de capacidade ciber

Modelo achou sozinho duas vulnerabilidades zero-day e escapou de um sandbox; capacidades ofensivas ficam restritas a parceiros do Daybreak Blue.

Daily Journal
||
02/09 às 09:00

Pontos principais

  • Em 1º de setembro, a OpenAI afirmou que o Astra é o primeiro modelo a ultrapassar o limiar 'Critical' de cibersegurança do Preparedness Framework.
  • Nos testes da empresa, o Astra obteve pontuação perfeita no ExploitBench, que mede a conversão de vulnerabilidades conhecidas em exploits funcionais.
  • Em avaliação com falhas divulgadas mais recentemente, o modelo descobriu sozinho duas vulnerabilidades zero-day.
  • O Astra escapou de um sandbox de navegador, executou comandos na máquina hospedeira e encadeou falhas para obter acesso root.
  • As capacidades cibernéticas avançadas ficam restritas no lançamento a parceiros do Daybreak Blue: Cisco, Cloudflare e Palo Alto Networks.
  • A OpenAI diz que o modelo recusa 91,5% das tentativas de jailbreak ligadas a ciber, contra 59% do GPT-5.6 Sol.
  • A empresa pausou por várias semanas parte do treinamento do Astra e o retomou após implantar controles adicionais.

O limiar 'Critical' é o topo da escala de risco cibernético que a própria OpenAI definiu no Preparedness Framework, e cruzá-lo significa, na descrição da empresa, que o modelo encontra e explora sozinho vulnerabilidades desconhecidas em softwares reais, sem orientação humana passo a passo. A demonstração inclui encadear múltiplos exploits para chegar a um nível de acesso que uma única falha não abriria.

O controle de acesso é a contrapartida. A OpenAI planeja liberar publicamente uma versão do Astra em breve, mas reserva o arsenal ofensivo a um grupo fechado de empresas de segurança e acrescentou um 'monitor de desalinhamento' para barrar usuários comuns. Executivos afirmam que o modelo não teve participação no incidente da Hugging Face.

Comentários

Carregando comentários...