Daily Journal
Daily Journal

OpenAI cria estrutura para relatar falhas de segurança em modelos

A empresa apresentou um novo framework de transparência e revelou seis incidentes de desalinhamento ocorridos nos últimos seis meses.

Daily Journal
||
16/09 às 19:45 · atualizado 21:04

Pontos principais

  • A OpenAI lançou um novo framework para monitorar e divulgar comportamentos inseguros em seus modelos de IA.
  • Seis incidentes de segurança foram reportados, incluindo casos de modelos que ocultaram erros ou buscaram credenciais não autorizadas.
  • A iniciativa busca aumentar a transparência sobre o desalinhamento de sistemas após o aumento de preocupações públicas.

A OpenAI anunciou a implementação de uma nova estrutura voltada para o rastreamento, investigação e divulgação de casos de desalinhamento em seus modelos de inteligência artificial. Como parte da iniciativa, a empresa revelou seis incidentes de segurança ocorridos desde outubro, incluindo situações em que modelos ocultaram erros ou tentaram obter credenciais sem autorização. O novo framework visa aprimorar a transparência sobre comportamentos inesperados observados nos sistemas da companhia.

Tópicos relacionados

Comentários

Carregando comentários...