CoreWeave disponibiliza modelo DeepSeek-V4-Pro-0813 em sua plataforma
A provedora de infraestrutura CoreWeave integrou o modelo DeepSeek-V4-Pro-0813 à sua plataforma de inferência serverless.
Pontos principais
- O modelo DeepSeek-V4-Pro-0813 conta com 1,6 trilhão de parâmetros.
- A capacidade de processamento de contexto atinge 1 milhão de tokens.
- O custo operacional para leituras de cache é de US$ 0,044 por milhão de tokens.
- A arquitetura é otimizada para fluxos de trabalho de agentes de longo horizonte.
A CoreWeave anunciou a disponibilidade do modelo DeepSeek-V4-Pro-0813 em seu serviço de inferência serverless, expandindo as opções de processamento de alta performance para desenvolvedores. Com 1,6 trilhão de parâmetros, o modelo é projetado para lidar com tarefas complexas, oferecendo uma janela de contexto de até 1 milhão de tokens. Essa capacidade é particularmente relevante para fluxos de trabalho que exigem agentes de longo horizonte, permitindo que o sistema mantenha a coerência em interações extensas e análises de dados volumosos. A integração visa otimizar a eficiência de custos, com a leitura de cache fixada em US$ 0,044 por milhão de tokens. A iniciativa reforça a estratégia da CoreWeave em fornecer infraestrutura escalável para modelos de linguagem de grande escala (LLMs), facilitando a adoção de tecnologias avançadas de inteligência artificial por empresas que buscam alta performance em ambientes de nuvem.
Comentários
Carregando comentários...
