Daily Journal
Daily Journal

Cisco lança LLM Security Leaderboard e Anthropic domina 8 das 10 primeiras posições

Claude Opus 4.5 lidera ranking de resistência a ataques adversariais; GPT-5.2 da OpenAI ficou em sétimo lugar.

Daily Journal
||
24/03 às 09:00

Pontos principais

  • Cisco lançou o LLM Security Leaderboard na RSAC 2026 para avaliar resistência de modelos a ataques
  • Anthropic ocupa 8 das 10 primeiras posições: Claude Opus 4.5 em 1º, Sonnet 4.5 em 2º, Haiku 4.5 em 3º
  • GPT-5.2 da OpenAI ficou em 7º e GPT 5 Nano em 9º
  • Avalia ataques conversacionais multi-turno que refletem comportamento adversarial real
  • 83% das organizações planejam usar IA agêntica, mas apenas 29% se sentem prontas para fazê-lo com segurança

A Cisco lançou o LLM Security Leaderboard na RSAC 2026, ranking abrangente de resistência de modelos de linguagem a ataques adversariais incluindo tentativas de jailbreak em turnos únicos e múltiplos. A Anthropic dominou com 8 das 10 primeiras posições — Claude Opus 4.5 em primeiro, Sonnet 4.5 em segundo e Haiku 4.5 em terceiro.

O GPT-5.2 da OpenAI ficou em sétimo lugar e o GPT 5 Nano em nono. Modelos da Mistral ocuparam as últimas posições. O leaderboard avalia ataques conversacionais multi-turno, onde atacantes tentam degradar as proteções do modelo ao longo de conversas mais longas — cenário que reflete melhor o comportamento adversarial no mundo real.

Comentários

Carregando comentários...