Anthropic conclui testes de segurança do modelo Fable 5
A Anthropic validou a segurança do Fable 5 e ajustou sua política de retenção de dados às diretrizes do governo Trump sobre inteligência artificial.
Pontos principais
- Testes de red teaming internos e externos não detectaram vulnerabilidades de jailbreak no Fable 5.
- A empresa implementou uma política de retenção de tráfego de usuários por 30 dias.
- A nova medida de armazenamento de dados está em conformidade com o decreto executivo de Donald Trump para o setor de IA.
- O modelo Fable 5 foca em alto desempenho aliado a salvaguardas reforçadas para temas sensíveis.
A Anthropic anunciou a conclusão bem-sucedida dos testes de segurança no seu novo modelo de inteligência artificial, o Fable 5. Segundo a empresa, processos rigorosos de red teaming, realizados tanto internamente quanto por especialistas externos, não identificaram falhas críticas ou vulnerabilidades universais de jailbreak, reforçando a robustez do sistema frente a usos indevidos. Além da validação técnica, a companhia atualizou sua política de governança de dados, passando a reter o tráfego de usuários por um período de 30 dias. Essa mudança operacional foi desenhada para alinhar a empresa às diretrizes estabelecidas pelo decreto executivo do presidente Donald Trump sobre o desenvolvimento e a segurança de sistemas de IA. Com essa atualização, a Anthropic busca equilibrar o avanço de capacidades de alto nível com a conformidade regulatória exigida pelo governo federal norte-americano.
Tópicos relacionados
Comentários
Carregando comentários...
