Daily Journal
Daily Journal

OpenAI amplia testes de segurança no modelo Astra por riscos cibernéticos

A OpenAI pausou parte do desenvolvimento do modelo Astra após identificar capacidades cibernéticas críticas que podem comprometer a segurança digital.

Daily Journal
Foto: Folha de São Paulo - Mercado
||
07/08 às 14:02 · atualizado 20:01

Pontos principais

  • A OpenAI identificou que não pode descartar a presença de capacidades cibernéticas críticas no modelo Astra.
  • A empresa optou por expandir os protocolos de segurança e monitoramento como medida preventiva.
  • O lançamento do modelo pode sofrer atrasos devido à necessidade de avaliações mais rigorosas.
  • A classificação de 'capacidades cibernéticas críticas' refere-se ao potencial uso da IA em ataques digitais complexos.
  • A companhia negou que o Astra esteja relacionado a incidentes anteriores de acesso não autorizado a repositórios.
  • Novos controles foram estabelecidos para prevenir a exploração de vulnerabilidades de dia zero.
  • A decisão reflete a crescente pressão sobre empresas de tecnologia para mitigar riscos existenciais em IA.

A OpenAI anunciou a ampliação dos protocolos de segurança e a suspensão temporária de partes do desenvolvimento de seu próximo modelo de inteligência artificial, o Astra. A decisão foi motivada pela identificação de potenciais capacidades cibernéticas críticas, que incluem a possibilidade de o sistema executar ataques complexos ou identificar vulnerabilidades de segurança sem intervenção humana. A empresa afirmou que, neste estágio, não pode descartar riscos significativos, optando por uma postura cautelosa antes de prosseguir com o treinamento avançado.

Como medida de governança, a startup implementou controles mais rígidos e monitoramento adicional para garantir que o modelo não seja utilizado indevidamente. A OpenAI também divulgou análises preliminares sobre os riscos associados ao Astra, buscando aumentar a transparência sobre as salvaguardas adotadas. Embora a empresa não tenha confirmado uma nova data de lançamento, a necessidade de avaliações rigorosas sugere que o cronograma original do projeto pode sofrer atrasos significativos.

Este movimento ocorre em um momento de crescente escrutínio sobre o setor de inteligência artificial, com órgãos reguladores e especialistas pressionando por maior fiscalização sobre modelos de ponta. A OpenAI, que busca manter sua competitividade no mercado de modelos avançados, enfrenta o desafio de equilibrar a inovação tecnológica com a mitigação de riscos de cibersegurança. A empresa reforçou que a prioridade atual é garantir que o produto final seja seguro e não apresente ameaças a sistemas críticos antes de sua disponibilização ao público.

Fonte primária

OpenAI

Responding to the next frontier of critical cyber capabilities

A OpenAI diz que avaliações internas do Astra, um de seus modelos futuros, feitas nos últimos dias, mostraram avanços significativos em codificação agêntica e capacidades cibernéticas. Somadas a avaliações de especialistas externos, essas evidências levaram a empresa a concluir, na noite anterior à publicação, que não pode descartar que o Astra atinja o nível "Critical" de capacidade cibernética definido em seu Preparedness Framework (publicado em dezembro de 2023). Modelos anteriores, incluindo o GPT-5.6-Sol, haviam sido avaliados no nível "High", não "Critical". Pelo framework, o limiar "Critical" é atingido quando um modelo consegue identificar e desenvolver exploits zero-day funcionais de qualquer severidade em sistemas críticos reais e blindados sem intervenção humana, ou consegue conceber e executar de ponta a ponta estratégias inéditas de ataque contra alvos blindados a partir de apenas um objetivo de alto nível. A OpenAI afirma que o Astra não esteve envolvido no incidente de exploração do Hugging Face. Como resposta, a empresa escalou os testes de robustez de suas salvaguardas e controles de segurança e passou a aplicar internamente controles mais rígidos para modelos de maior capacidade: ambientes de teste isolados, acesso restrito a rede e ferramentas, proteção e criptografia reforçadas dos pesos do modelo, monitoramento e detecção adicionais, e execução em sandbox, incluindo monitoramento universal das aplicações agênticas do Astra. A OpenAI cita como precedente sua resposta em junho de 2025, quando modelos se aproximaram do limiar "High" para biologia, e diz que vai seguir trabalhando com governos, institutos de segurança e sociedade civil para garantir a implantação responsável dessas capacidades de fronteira.

Tópicos relacionados

Comentários

Carregando comentários...