Anthropic retoma cobrança por solicitações bloqueadas pelo sistema
A empresa passará a cobrar por prompts bloqueados por filtros de segurança em categorias específicas com baixa taxa de falsos positivos.
Pontos principais
- A medida abrange categorias como biologia, ataques de destilação e desenvolvimento de LLMs de fronteira.
- Os classificadores de segurança utilizados apresentam uma taxa de falsos positivos inferior a 0,1%.
- A decisão visa reforçar a defesa contra ataques coordenados aos sistemas da Anthropic.
- Testes recentes indicam que 99,7% dos usuários do Claude.ai, Claude Code e Cowork não foram afetados pelos bloqueios.
A Anthropic anunciou que voltará a cobrar por solicitações que forem bloqueadas por seus sistemas de segurança. A medida é restrita a categorias que apresentam baixas taxas de falsos positivos, incluindo biologia, ataques de destilação e o desenvolvimento de LLMs de fronteira.
Segundo a companhia, a iniciativa serve como uma camada adicional de proteção contra ataques coordenados recentes. A empresa afirma que os classificadores possuem uma taxa de erro inferior a 0,1% e que 99,7% dos usuários das plataformas Claude.ai, Claude Code e Cowork não foram impactados pelos bloqueios durante os testes realizados.
Comentários
Carregando comentários...
