Daily Journal
Daily Journal

Anthropic ajusta políticas e lança Claude Fable 5 com foco em segurança

A Anthropic revisou restrições de uso do Claude Fable 5 e introduziu uma arquitetura de segurança para mitigar riscos de crimes cibernéticos.

Daily Journal
||
11/06 às 01:15 · atualizado há 1m

Pontos principais

  • A Anthropic reverteu restrições que impediam o Claude Fable 5 de auxiliar no desenvolvimento de novas IAs após pressão de pesquisadores.
  • O novo modelo integra a família Mythos, focada em segurança e restrição de usos maliciosos.
  • O sistema redireciona consultas de alto risco para o modelo Claude Opus 4.8 para evitar exploração de vulnerabilidades.
  • Cerca de 200 organizações, como Microsoft e Verizon, testam a tecnologia em ambientes controlados.

A Anthropic implementou mudanças estratégicas no Claude Fable 5, equilibrando a abertura para pesquisa e o controle de riscos. Após críticas da comunidade científica, a empresa reverteu uma política que limitava o uso do modelo no desenvolvimento de novas IAs, buscando preservar sua reputação entre desenvolvedores. Paralelamente, o modelo foi lançado com uma arquitetura de segurança avançada, parte da família Mythos, desenhada para impedir atividades ilícitas, como crimes cibernéticos e o desenvolvimento de armas biológicas. O sistema utiliza um mecanismo que redireciona consultas de alto risco para uma versão anterior, o Claude Opus 4.8, garantindo maior proteção. Atualmente, cerca de 200 organizações, incluindo Microsoft e Verizon, avaliam a eficiência e a capacidade de memorização do novo modelo em ambientes controlados, apesar do custo operacional mais elevado da tecnologia.

Comentários

Carregando comentários...