O que é a Cerebras
A Cerebras Systems é uma fabricante americana de chips e sistemas de inteligência artificial, com sede em Sunnyvale, na Califórnia. Fundada em 2015 por Andrew Feldman (atual CEO), Gary Lauterbach, Michael James, Sean Lie (atual CTO) e Jean-Philippe Fricker, a empresa ficou conhecida por construir o maior processador de IA já fabricado: um chip do tamanho de um wafer inteiro de silício, o Wafer-Scale Engine (WSE).
Além de vender os sistemas, a Cerebras aluga a capacidade desses chips como serviço de nuvem, a partir de data centers próprios, com foco em inferência — a etapa em que um modelo de IA já treinado gera respostas. É vista pelo mercado como uma das principais alternativas às GPUs da Nvidia.
Como funciona o chip da Cerebras
Em vez de cortar um wafer de silício em centenas de chips, como faz a indústria, a Cerebras usa o wafer inteiro como um único processador. As gerações do WSE:
- WSE-1 (agosto de 2019): 1,2 trilhão de transistores e 400 mil núcleos.
- WSE-2 (abril de 2021): 2,6 trilhões de transistores e 850 mil núcleos.
- WSE-3 (março de 2024): 4 trilhões de transistores e 900 mil núcleos otimizados para IA.
- WSE-3T (agosto de 2026): versão "Turbo" do WSE-3, com 4 trilhões de transistores em 46.225 mm² de silício, 44 GB de SRAM e 250 petaflops de computação de IA por wafer.
A vantagem declarada está na memória. Segundo a empresa, uma GPU tem cerca de 200 MB de memória dentro do chip e precisa buscar os parâmetros do modelo numa memória externa a cada token gerado; o WSE-3 integra 44 GB de SRAM no próprio chip, com 21 petabytes por segundo de largura de banda de memória agregada. Modelos maiores do que um wafer são divididos entre vários sistemas.
Os chips são vendidos dentro de sistemas completos: CS-1, CS-2, CS-3 e, desde agosto de 2026, o CS-4, primeiro produto da arquitetura de rack Nexus. O CS-4 reúne três chips WSE-3T, entrega 750 petaflops de computação de IA e, segundo a Cerebras, é duas vezes mais rápido que o CS-3. As primeiras entregas estavam previstas para o terceiro trimestre de 2026.
Cerebras Cloud, API e modelos
O serviço Cerebras Inference foi lançado em 27 de agosto de 2024, com acesso por API para desenvolvedores. No lançamento, a empresa anunciou 1.800 tokens por segundo no modelo Llama 3.1 8B e 450 tokens por segundo no Llama 3.1 70B, velocidade que dizia ser 20 vezes maior que a de nuvens baseadas em GPUs da Nvidia.
A plataforma roda modelos de pesos abertos de vários desenvolvedores, como a família Llama, da Meta, e o Qwen, da Alibaba. Em abril de 2025, a Meta fechou acordo para usar a Cerebras na API do Llama. Entre os clientes citados pela CNBC estão Cognition, Hugging Face e IBM.
Em 13 de março de 2026, a Amazon Web Services anunciou que levaria a Cerebras ao Amazon Bedrock, num arranjo em que servidores com chips Trainium, da própria AWS, processam a leitura do prompt e os sistemas CS-3 geram a resposta.
Parceria com a OpenAI
Em 14 de janeiro de 2026, a OpenAI anunciou um contrato plurianual para usar 750 megawatts de computação da Cerebras até 2028, hospedados pela própria fabricante. Os termos não foram divulgados; pessoas próximas à empresa estimaram o valor em mais de US$ 10 bilhões, segundo a CNBC. O acordo diminuiu a dependência da G42, grupo dos Emirados Árabes Unidos que respondeu por 87% da receita da Cerebras no primeiro semestre de 2024.
Em abril de 2026, segundo reportagem do The Information repercutida pela Reuters, o acordo foi ampliado para mais de US$ 20 bilhões em três anos. A OpenAI recebeu warrants para uma participação minoritária na Cerebras, que pode chegar a cerca de 10% se os gastos totais atingirem US$ 30 bilhões, e se comprometeu a adiantar cerca de US$ 1 bilhão para financiar data centers. A Cerebras entrou com o pedido de IPO em 17 de abril de 2026.
Em 13 de agosto de 2026, a OpenAI lançou em prévia o modo Ultrafast do GPT-5.6 Sol, rodando em chips da Cerebras, com até 750 tokens de saída por segundo — 14 vezes a velocidade do processamento padrão.
No fim de setembro de 2026, a consultoria SemiAnalysis publicou que o modo Ultrafast do GPT-6.1 Sol usaria GPUs da Nvidia, e não hardware da Cerebras. Em 2 de outubro, Sam Altman, CEO da OpenAI, respondeu no X: "A Cerebras é uma parceira próxima, e temos um engajamento profundo empurrando as fronteiras da velocidade".
Ações (CBRS) e IPO
A Cerebras pediu registro para abrir capital em setembro de 2024, mas retirou o pedido em outubro de 2025, dias depois de anunciar uma rodada de US$ 1,1 bilhão que a avaliou em US$ 8,1 bilhões. Em março de 2025, o Comitê de Investimento Estrangeiro nos EUA (CFIUS) havia aprovado a venda de ações à G42.
A empresa estreou na Nasdaq em 14 de maio de 2026, sob o código CBRS. Vendeu 34,5 milhões de ações a US$ 185 cada, incluindo o lote suplementar, e captou cerca de US$ 6,38 bilhões, o maior IPO de 2026 até então. As ações abriram a US$ 350 e fecharam o primeiro pregão em US$ 311,07, alta de 68%; a CNBC calculou o valor de mercado no fechamento em US$ 95 bilhões.
Os resultados trimestrais derrubaram o papel duas vezes. Em 12 de agosto de 2026, a Cerebras reportou receita de US$ 180,1 milhões no segundo trimestre (alta de 74% em um ano), com a receita de nuvem quase quadruplicada, e prejuízo líquido de cerca de US$ 450 milhões; as ações caíram 16%. A empresa informou US$ 25,4 bilhões em obrigações de desempenho a cumprir e projetou receita "core" de US$ 880 milhões a US$ 890 milhões em 2026.
Na semana encerrada em 2 de outubro de 2026, as ações caíram quase 20% e fecharam em US$ 166,43, o menor nível desde o IPO e abaixo do preço de oferta. Além do relato sobre a OpenAI e a Nvidia, pesou o fim do período de restrição de venda: em 30 de setembro, até 19,4 milhões de ações de diretores, executivos e outros acionistas foram liberadas, 8% do total. Feldman e Lie venderam mais de US$ 240 milhões em ações entre 20 de agosto e 25 de setembro.
Data centers
A Cerebras opera clusters de inferência em Santa Clara e Stockton, na Califórnia, e em Dallas, no Texas, e expande para Minneapolis, Canadá e Europa. A meta é ter 200 MW de capacidade na Europa até o fim de 2027. Em 1º de setembro de 2026, anunciou um campus de 165 MW em Mikkeli, na Finlândia, em parceria com a Compute Nordic, com investimento previsto entre € 1 bilhão e € 1,7 bilhão. No segundo trimestre de 2026, a capacidade contratada para entrega até o fim de 2027 passou de 600 MW.
Cerebras, Groq e Nvidia
A Cerebras disputa o mercado de inferência rápida com a Groq, outra fabricante de chips dedicados. No lançamento do serviço de inferência, em 2024, a Cerebras afirmou ser 2,4 vezes mais rápida que a Groq no Llama 3.1 8B. Em dezembro de 2025, a Nvidia fechou com a Groq um acordo de licenciamento não exclusivo, que levou funcionários da Groq para a Nvidia; a CNBC estimou o valor em US$ 20 bilhões.
Notícias relacionadas
Ações da Cerebras atingem mínima histórica após notícias sobre OpenAI
2 de out, 2026
General Compute firma acordo plurianual para usar chips da Cerebras
2 de out, 2026
Gimlet Cloud firma parceria com Cerebras para 100MW de computação
30 de set, 2026
Cerebras desenvolve tecnologia de DRAM empilhada para IA
29 de set, 2026
Cerebras firma parceria com Gimlet Labs para expandir inferência
29 de set, 2026
