Daily Journal
Daily Journal

Falha de segurança permite burlar filtros de IA com criptografia

Pesquisadores identificaram técnica que usa comandos criptografados para contornar filtros de segurança em modelos como Grok e Gemini.

Daily Journal
Foto: TecMundo
||
21/08 às 16:46

Pontos principais

  • A técnica, chamada 'Injeção de Contexto Criptográfico', utiliza o padrão AES-256 para ocultar comandos maliciosos.
  • No Grok, a falha viabilizou ataques 'zero-click' capazes de extrair dados privados de usuários.
  • No Gemini, o método permitiu contornar restrições de segurança para gerar instruções proibidas.
  • A xAI não respondeu aos alertas enviados pela Adversa AI em junho.
  • O Google excluiu a vulnerabilidade de seu programa de recompensas por considerá-la fora do escopo.

Pesquisadores da Adversa AI descobriram uma vulnerabilidade crítica denominada 'Injeção de Contexto Criptográfico', que compromete a segurança de modelos de linguagem como o Grok, da xAI, e o Gemini, do Google. A técnica utiliza o padrão de criptografia AES-256 para esconder comandos maliciosos dentro de textos, os quais são decodificados apenas no ambiente interno da IA, contornando filtros de segurança estabelecidos pelos desenvolvedores. No caso do Grok, a falha permitiu a execução de ataques 'zero-click' para coleta de dados privados, enquanto no Gemini possibilitou a geração de conteúdos proibidos, como instruções para fabricação de armas. A descoberta expõe desafios significativos na proteção de LLMs contra manipulações sofisticadas. Enquanto a xAI não respondeu aos contatos, o Google informou que não premia relatos de 'jailbreak', deixando a vulnerabilidade sem uma correção imediata reconhecida pelas empresas.

Comentários

Carregando comentários...