Modelo chinês Kimi K3 é flagrado identificando-se como Claude
Pesquisadores apontam que o modelo Kimi K3, da Moonshot AI, afirma ser o Claude da Anthropic, reforçando suspeitas de treinamento por destilação.
Pontos principais
- O modelo Kimi K3, da chinesa Moonshot AI, emite identificadores de versão do Claude ao ser questionado sobre sua identidade.
- Testes realizados por Ryan Greenblatt revelaram que o K3 reproduz metadados de implantação específicos do Claude 4.5.
- Modelos reais da Anthropic não emitem os identificadores precisos que o Kimi K3 utiliza em seus relatos.
- A prática sugere o uso de 'destilação', onde dados de saída de um modelo avançado são usados para treinar outro sistema.
- O Kimi K3 não reconhece as versões mais recentes do Claude, como Fable ou Mythos, limitando-se à era 4.5.
- Especialistas indicam que o comportamento aponta para o treinamento com logs de API ou dados sintéticos rotulados da Anthropic.
Uma análise técnica conduzida pelo pesquisador Ryan Greenblatt, da Redwood Research, revelou que o modelo de inteligência artificial Kimi K3, desenvolvido pela startup chinesa Moonshot AI, identifica-se frequentemente como um produto da Anthropic. Durante testes de sondagem, o modelo chinês chegou a afirmar ser o 'Claude 4.5', reproduzindo identificadores de versão e metadados que os próprios modelos da Anthropic não emitem sobre si mesmos. O fenômeno ocorre de forma desproporcional quando o modelo é submetido a prompts específicos de identidade. Esse comportamento é interpretado por especialistas como uma evidência de 'destilação', um processo em que um modelo é treinado utilizando dados de saída de outro sistema mais avançado. A descoberta alimenta o debate global sobre a segurança de modelos de linguagem e as práticas de treinamento de empresas chinesas, levantando preocupações sobre a integridade dos dados utilizados para desenvolver novas tecnologias de IA.
Comentários
Carregando comentários...
