CoreWeave disponibiliza modelo GLM-5.3-Flash em plataforma serverless
A CoreWeave integrou o modelo GLM-5.3-Flash, da Zhipu AI, à sua plataforma de inferência, oferecendo suporte a visão e janelas de 1 milhão de tokens.
Pontos principais
- O modelo GLM-5.3-Flash conta com 18 bilhões de parâmetros ativos.
- A ferramenta oferece capacidade de processamento de visão e janela de contexto de 1 milhão de tokens.
- O custo de inferência é de US$ 0,15 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída.
- O modelo está posicionado entre os 5 melhores no Artificial Analysis Intelligence Index.
A CoreWeave anunciou a disponibilidade do modelo GLM-5.3-Flash, desenvolvido pela Zhipu AI, em sua plataforma de inferência serverless. O modelo, que possui 18 bilhões de parâmetros ativos, destaca-se por integrar capacidades de visão e suportar uma janela de contexto de até 1 milhão de tokens.
Atualmente, o GLM-5.3-Flash figura entre os cinco principais modelos no Artificial Analysis Intelligence Index. Para os usuários da plataforma, o custo de inferência foi fixado em US$ 0,15 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída.
Comentários
Carregando comentários...
