Daily Journal
Daily Journal

CoreWeave disponibiliza modelo DeepSeek-V4-Pro-0813 em sua plataforma

A provedora de infraestrutura CoreWeave integrou o modelo DeepSeek-V4-Pro-0813 à sua plataforma de inferência serverless.

Daily Journal
Foto: x.com
||
01/09 às 17:45

Pontos principais

  • O modelo DeepSeek-V4-Pro-0813 conta com 1,6 trilhão de parâmetros.
  • A capacidade de processamento de contexto atinge 1 milhão de tokens.
  • O custo operacional para leituras de cache é de US$ 0,044 por milhão de tokens.
  • A arquitetura é otimizada para fluxos de trabalho de agentes de longo horizonte.

A CoreWeave anunciou a disponibilidade do modelo DeepSeek-V4-Pro-0813 em seu serviço de inferência serverless, expandindo as opções de processamento de alta performance para desenvolvedores. Com 1,6 trilhão de parâmetros, o modelo é projetado para lidar com tarefas complexas, oferecendo uma janela de contexto de até 1 milhão de tokens. Essa capacidade é particularmente relevante para fluxos de trabalho que exigem agentes de longo horizonte, permitindo que o sistema mantenha a coerência em interações extensas e análises de dados volumosos. A integração visa otimizar a eficiência de custos, com a leitura de cache fixada em US$ 0,044 por milhão de tokens. A iniciativa reforça a estratégia da CoreWeave em fornecer infraestrutura escalável para modelos de linguagem de grande escala (LLMs), facilitando a adoção de tecnologias avançadas de inteligência artificial por empresas que buscam alta performance em ambientes de nuvem.

Comentários

Carregando comentários...