Daily Journal
Daily Journal

Anthropic recua sobre política oculta que degradava pedidos rivais ao Claude Fable 5

Recusas passarão a ser visíveis com fallback ao Opus 4.8 e razão explícita na API; classificador afeta ~0,05% das tarefas.

Daily Journal
||
11/06 às 09:00

Pontos principais

  • Anthropic recua sobre política que degradava ou recusava silenciosamente pedidos do Fable 5 voltados a construir modelos concorrentes
  • Redirecionamento ao Claude Opus 4.8 passa a ser visível ao usuário
  • Chamadas pela API devolverão razão explícita da recusa a cada disparo
  • Empresa pediu desculpas pela configuração oculta original
  • Classificador é acionado em ~0,05% das tarefas e afeta menos de 0,05% das organizações
  • Estimativa anterior falava em menos de 5% das sessões
  • Pesquisadores de cibersegurança relatam recusas em tarefas inócuas, empurrando usuários de volta ao Opus 4.8

A Anthropic voltou atrás na política que degradava ou recusava silenciosamente requisições do Claude Fable 5 voltadas a construir modelos de IA concorrentes, depois da reação de pesquisadores. A partir desta semana, o redirecionamento ao Claude Opus 4.8 passa a ser visível ao usuário, e chamadas pela API devolverão a razão explícita da recusa a cada disparo. A empresa pediu desculpas pela configuração oculta original, dizendo ter 'feito a escolha errada' entre transparência e estreitamento da intervenção.

Segundo a Anthropic, o classificador é acionado em cerca de 0,05% das tarefas e afeta menos de 0,05% das organizações — uma pequena fração da estimativa anterior de menos de 5% das sessões. A empresa admitiu que uma proteção visível terá de ser acionada em mais requisições para se manter robusta. Pesquisadores de cibersegurança já vinham relatando que o Fable 5 recusa tarefas inócuas como ler um post de blog ou rodar revisão de código, empurrando muitos usuários de volta ao Opus 4.8.

Comentários

Carregando comentários...