Anthropic expande acesso a modelos de IA com novas salvaguardas
A Anthropic liberou o modelo Mythos ao público geral, implementando restrições rigorosas para mitigar riscos em temas sensíveis como cibersegurança.
Pontos principais
- O modelo Mythos foi disponibilizado ao público geral após um período de testes restrito a cerca de 200 organizações parceiras.
- A ferramenta inclui travas de segurança rigorosas para impedir o uso em atividades de alto risco, como a exploração de vulnerabilidades.
- Restrições específicas foram implementadas para prevenir o uso da IA em ataques biológicos e cibersegurança.
- O modelo Fable 5, focado em engenharia de software, mantém filtros que redirecionam consultas sensíveis para o Opus 4.8.
- Testes internos de 'red team' indicam que as barreiras de segurança são robustas contra tentativas de contorno.
- A estratégia da empresa visa aprimorar modelos para tarefas complexas antes de uma possível oferta pública inicial (IPO).
A Anthropic ampliou significativamente o acesso às suas tecnologias de inteligência artificial ao liberar o modelo Mythos para o público geral. Anteriormente restrita a um grupo de cerca de 200 organizações via Project Glasswing, a ferramenta agora está disponível para uma base maior de usuários, embora acompanhada de salvaguardas rigorosas. Estas restrições foram desenhadas para impedir o uso da tecnologia em atividades de alto risco, como a exploração autônoma de vulnerabilidades cibernéticas e a geração de conteúdo relacionado a ataques biológicos, capacidades que exigem um equilíbrio cuidadoso entre inovação e mitigação de riscos. Paralelamente, a empresa continua a promover o modelo Fable 5, que se destaca pelo desempenho avançado em engenharia de software e análise de dados. Para garantir a segurança, o Fable 5 utiliza filtros que redirecionam consultas sensíveis para o modelo Opus 4.8. Segundo a companhia, testes internos de 'red team' indicam que as barreiras implementadas são robustas contra tentativas de contorno. Esse movimento de expansão faz parte da estratégia da Anthropic para consolidar sua liderança em modelos de alta capacidade em raciocínio lógico e programação, preparando o terreno para uma eventual oferta pública inicial (IPO) no futuro.
Comentários
Carregando comentários...
