Daily Journal
Daily Journal

Modelo de IA Mythos Preview supera GPT-5.5 em testes de cibersegurança

O Mythos Preview tornou-se o primeiro sistema a completar os testes de ataque cibernético do AISI, superando o desempenho do GPT-5.5.

Daily Journal
||
13/05 às 18:32

Pontos principais

  • O Mythos Preview foi o primeiro modelo a concluir com sucesso ambos os testes de capacidade de ataque cibernético do AISI.
  • O GPT-5.5, em comparação, conseguiu resolver apenas um dos desafios propostos pelo instituto.
  • Os testes do AISI avaliam a habilidade de modelos de IA em executar ataques cibernéticos complexos.
  • Dados do AISI indicam que a capacidade ofensiva de modelos de IA tem dobrado a cada 4,7 meses desde o final de 2024.

O modelo de inteligência artificial Mythos Preview estabeleceu um novo marco ao ser o primeiro sistema a completar integralmente os testes de cibersegurança do AI Security Institute (AISI). A avaliação, que mede a capacidade de modelos de linguagem em realizar ataques cibernéticos complexos, revelou um desempenho superior ao do GPT-5.5, que obteve êxito em apenas um dos cenários propostos. Este resultado destaca a rápida evolução das capacidades ofensivas em sistemas de IA, um setor que tem demonstrado uma aceleração constante em seu desenvolvimento técnico. Segundo o AISI, a extensão das tarefas cibernéticas que esses modelos conseguem executar tem dobrado a cada 4,7 meses desde o final de 2024. O avanço levanta discussões sobre a necessidade de protocolos de segurança mais robustos à medida que a tecnologia de IA se torna mais sofisticada e capaz de realizar operações digitais complexas de forma autônoma.

Tópicos relacionados

Comentários

Carregando comentários...