StepFun lança Step 5 Preview, modelo agêntico de 600B, a US$ 1 por milhão
Modelo MoE com 27 bilhões de parâmetros ativos pontua 44 no Intelligence Index da Artificial Analysis e terá pesos abertos em 15 de outubro.
Pontos principais
- Anunciado em 20 de setembro de 2026, com sparse mixture-of-experts de 600 bilhões de parâmetros totais e 27 bilhões ativos por token
- Janela de contexto de 1 milhão de tokens, entrada de imagem e API aberta no mesmo dia
- Preço de US$ 1,00 por milhão de tokens de input e US$ 2,70 por milhão de output, com desconto de 95% em cache
- A Artificial Analysis pontua o modelo em 44 no Intelligence Index, empatado com o Kimi K3 Max
- No StepCodeBench, benchmark próprio da StepFun com 553 repositórios e 33 linguagens, o modelo atinge 49% (avg@4), atrás do Claude Opus 5 (63,9%) e do GPT-6 Astra (61%), mas à frente do GLM-5.3 (40,2%) e do Kimi K3 (43,9%)
- Em teste de 24 horas otimizando um kernel de GPU, o modelo atingiu pico de 508 TFLOPS, superando os 493 TFLOPS do Claude Opus 5 no mesmo teste
- Em avaliação com especialistas internos e externos da StepFun, cerca de 70% considerou o modelo capaz de resolver sozinho tarefas de codificação de complexidade moderadamente alta
- O preço equivale a cerca de um sétimo do cobrado pelo GPT-5.6 Sol
- A StepFun promete pesos abertos em 15 de outubro de 2026; o repositório no Hugging Face tinha só um .gitattributes no dia do anúncio
- Fundada em abril de 2023 por Jiang Daxin, ex-vice-presidente da Microsoft Research Asia, a empresa pulou toda a linha Step 4.x
O argumento central do lançamento é custo: a StepFun afirma entregar inteligência comparável a um custo por tarefa substancialmente menor, a "fronteira de Pareto" citada no título. Os alvos são engenharia de software, trabalho de conhecimento profissional e finanças.
As alegações de capacidade são amplas e ainda não reproduzidas por terceiros: execução autônoma de tarefas contínuas de até 24 horas, depuração de código, acesso a porta serial, captura de tela, acesso a câmera e operações simuladas de mouse. A empresa se chama formalmente Shanghai Jieyue Xingchen Intelligent Technology e foi do Step-3.7-Flash direto para o Step 5.
Fontes primárias
Step 5 Preview: Advancing the Pareto Frontier
StepFun anuncia o Step 5 Preview, modelo flagship com arquitetura MoE esparsa de 600B parâmetros totais e 27B ativos, contexto de 1M tokens, e input nativo de texto, imagem e vídeo. O modelo pontua 44 no Artificial Analysis Intelligence Index, colocando-o entre os três melhores modelos open-source globalmente, com custo por tarefa substancialmente menor que modelos de capacidade comparável (StepFun cita custo por tarefa de cerca de 1/8 do Claude Opus 5). Em StepCodeBench, benchmark próprio com 553 repositórios, 9 categorias de tarefas, 20 domínios de aplicação e 33 linguagens, o modelo atinge avg@4 de 49,0%, com desempenho forte em correção de bugs, modificação de features e refatoração, aproximando-se do Claude Opus 5 em tarefas de baixa e média dificuldade, mas mantendo defasagem em tarefas longas mais desafiadoras. Em avaliação com especialistas internos e externos, cerca de 70% considerou o modelo capaz de resolver autonomamente tarefas de codificação de complexidade moderadamente alta. Acesso via API já disponível; pesos abertos previstos para 15 de outubro.
Preços do step-5-preview — StepFun Open Platform
Tabela oficial de preços do modelo step-5-preview: entrada (cache miss) a ¥7 por milhão de tokens, entrada (cache hit) a ¥0,35 por milhão, e saída a ¥20 por milhão de tokens, cobrança baseada no consumo real de tokens.
Comentários
Carregando comentários...
