Anthropic eleva risco de desalinhamento e cancela lançamento de modelo
Empresa revisou avaliação de segurança de seus sistemas e decidiu não disponibilizar publicamente o projeto interno conhecido como Model 2.
Pontos principais
- A Anthropic alterou a classificação de risco de desalinhamento de seus modelos de 'muito baixo' para 'baixo'.
- A companhia confirmou que não pretende lançar o 'Model 2', um sistema interno mais poderoso que o atual.
- O modelo Mythos segue como o produto de maior desempenho oferecido pela empresa no mercado.
- A decisão reflete uma postura de cautela estratégica diante do desenvolvimento de capacidades avançadas de IA.
A Anthropic, uma das principais empresas do setor de inteligência artificial, anunciou uma mudança em sua política de segurança ao elevar a estimativa de risco de desalinhamento de seus sistemas de 'muito baixo' para 'baixo'. Paralelamente, a companhia confirmou que não planeja disponibilizar publicamente o 'Model 2', um modelo interno que superaria as capacidades do atual topo de linha, o Mythos. Essa decisão marca uma mudança de postura em relação ao ritmo de lançamento de tecnologias de ponta. Ao optar por não liberar um sistema mais potente, a Anthropic demonstra um foco crescente em segurança e controle, priorizando a estabilidade de seus produtos atuais em vez da corrida por capacidades superiores. A medida reflete o debate contínuo na indústria sobre os perigos potenciais de modelos de IA cada vez mais autônomos e a necessidade de governança rigorosa no desenvolvimento de AGI.
Tópicos relacionados
Comentários
Carregando comentários...
