Anthropic recua sobre política oculta que degradava pedidos rivais ao Claude Fable 5
Recusas passarão a ser visíveis com fallback ao Opus 4.8 e razão explícita na API; classificador afeta ~0,05% das tarefas.
Pontos principais
- Anthropic recua sobre política que degradava ou recusava silenciosamente pedidos do Fable 5 voltados a construir modelos concorrentes
- Redirecionamento ao Claude Opus 4.8 passa a ser visível ao usuário
- Chamadas pela API devolverão razão explícita da recusa a cada disparo
- Empresa pediu desculpas pela configuração oculta original
- Classificador é acionado em ~0,05% das tarefas e afeta menos de 0,05% das organizações
- Estimativa anterior falava em menos de 5% das sessões
- Pesquisadores de cibersegurança relatam recusas em tarefas inócuas, empurrando usuários de volta ao Opus 4.8
A Anthropic voltou atrás na política que degradava ou recusava silenciosamente requisições do Claude Fable 5 voltadas a construir modelos de IA concorrentes, depois da reação de pesquisadores. A partir desta semana, o redirecionamento ao Claude Opus 4.8 passa a ser visível ao usuário, e chamadas pela API devolverão a razão explícita da recusa a cada disparo. A empresa pediu desculpas pela configuração oculta original, dizendo ter 'feito a escolha errada' entre transparência e estreitamento da intervenção.
Segundo a Anthropic, o classificador é acionado em cerca de 0,05% das tarefas e afeta menos de 0,05% das organizações — uma pequena fração da estimativa anterior de menos de 5% das sessões. A empresa admitiu que uma proteção visível terá de ser acionada em mais requisições para se manter robusta. Pesquisadores de cibersegurança já vinham relatando que o Fable 5 recusa tarefas inócuas como ler um post de blog ou rodar revisão de código, empurrando muitos usuários de volta ao Opus 4.8.
Comentários
Carregando comentários...
