Anthropic dará acesso permanente a avaliadores externos de segurança
A Anthropic permitirá que terceiros verifiquem seus protocolos de IA, incluindo acesso a modelos durante o treinamento e reporte de incidentes.
Pontos principais
- A Anthropic concederá a avaliadores externos acesso de nível de funcionário aos seus sistemas.
- A medida permite a verificação independente da adesão aos protocolos de segurança e alinhamento dos modelos.
- Avaliadores poderão reportar incidentes e monitorar o desenvolvimento durante o treinamento.
- A iniciativa compõe um plano de três etapas proposto pelo CEO Dario Amodei para a indústria de IA.
A Anthropic anunciou um compromisso unilateral para conceder a avaliadores externos acesso permanente e de nível de funcionário aos seus sistemas de inteligência artificial. A medida, detalhada pelo CEO Dario Amodei, visa permitir que entidades terceiras verifiquem de forma independente se a empresa está cumprindo rigorosamente seus protocolos de segurança, incluindo a capacidade de reportar incidentes e avaliar o alinhamento dos modelos durante o processo de treinamento.
Esta decisão integra um plano de três etapas proposto por Amodei para a indústria de IA, que defende a necessidade de maior cautela e um ritmo mais controlado no desenvolvimento de modelos de fronteira. Ao abrir seus sistemas para auditorias externas, a startup busca elevar o padrão de transparência do setor e garantir que o avanço tecnológico não comprometa a segurança dos modelos desenvolvidos.
Tópicos relacionados
Comentários
Carregando comentários...
