OpenAI lança GPT-5.4 com uso nativo de computadores e janela de 1M de tokens
Modelo supera humanos em benchmark de navegação desktop e iguala profissionais em 83% das comparações de trabalho cognitivo.
Pontos principais
- GPT-5.4 marca 75% no OSWorld-Verified contra 72,4% dos humanos
- No GDPval, iguala ou supera profissionais em 83% das comparações em 44 profissões
- Janela de contexto de 1 milhão de tokens, o dobro do GPT-5.3
- Tool Search reduz consumo de tokens em 47% em sistemas de agentes
- Alucinações caíram 33% em relação ao GPT-5.2
- Lançamento dois dias após GPT-5.3, em meio a cancelamentos por contrato com o Pentágono
A OpenAI lançou o GPT-5.4 em 5 de março com uso nativo de computadores, janela de contexto de 1 milhão de tokens e um sistema de Tool Search que reduz consumo de tokens em 47% em sistemas de agentes. No benchmark OSWorld-Verified de navegação desktop, o modelo marca 75% — superando os 72,4% dos humanos — enquanto o GPT-5.2 ficava em 47,3%.
No GDPval, que avalia trabalho de conhecimento em 44 profissões, o modelo iguala ou supera profissionais humanos em 83% das comparações. Alucinações caíram 33%. A cadência de lançamentos é acelerada: dois dias entre versões maiores, enquanto usuários cancelam assinaturas em protesto contra o contrato com o Pentágono.
Comentários
Carregando comentários...
