OpenAI reduz erros factuais e bajulação em novos modelos
Pesquisador da OpenAI aponta queda de 65% em erros factuais e 83% em comportamentos de bajulação nos modelos da empresa desde março.
||
09/09 às 14:10
Pontos principais
- A incidência de erros factuais graves nos modelos foi reduzida em 65%.
- A taxa de bajulação (sycophancy) dos modelos caiu 83%.
- O modelo GPT-5.6 sol at instant demonstra maior capacidade de raciocínio que o o3 em alto esforço.
Aidan McLaughlin, pesquisador da OpenAI, divulgou métricas sobre o desempenho dos modelos da empresa desde março. Os dados indicam uma redução de 65% na incidência de erros factuais graves e uma queda de 83% na taxa de bajulação (sycophancy). Além disso, o novo modelo GPT-5.6 sol at instant apresentou uma capacidade de raciocínio superior à do modelo o3 em cenários de alto esforço.
Comentários
Carregando comentários...
