---
title: "Google divide linha de chips TPU em modelos para treinamento e inferência"
url: https://dailyjournal.news/news/2026-10-07/google-divide-linha-de-chips-tpu-em-modelos-para-treinamento-e-inferencia
published: 2026-10-07T12:51:12.69661+00:00
updated: 2026-10-07T13:15:42.574206+00:00
categories: ["technology"]
source_count: 3
outlet_count: 0
language: pt-BR
publisher: "Daily Journal"
---

# Google divide linha de chips TPU em modelos para treinamento e inferência

O Google lançou as versões 8i e 8t de seus chips TPU para otimizar a infraestrutura de IA entre tarefas de inferência e treinamento.

## Pontos principais

- O Google separou sua nova geração de TPUs em dois modelos distintos: o 8i para inferência e o 8t para treinamento.
- A decisão responde à projeção de que o serving de IA representará até 60% da demanda de mercado durante a vida útil dos chips.
- Engenheiros de hardware do Google utilizam o modelo Gemini para acelerar o design de chips e reduzir o tempo até o tape-out.
- A empresa mantém alta eficiência de hardware, com TPUs antigas operando com 100% de utilização mesmo após o período de depreciação.

O Google anunciou uma mudança estratégica em sua infraestrutura de inteligência artificial ao dividir sua nova geração de chips TPU em dois modelos especializados. Segundo Amin Vahdat, chefe de infraestrutura de IA da companhia, o modelo 8i foi projetado especificamente para inferência, enquanto o 8t é focado em treinamento. A decisão foi motivada pelo crescimento acelerado das demandas de serving, com projeções indicando que essas tarefas representarão entre 30% e 60% do mercado de chips durante sua vida útil.

Para otimizar o desenvolvimento desses componentes, a empresa tem integrado o uso de inteligência artificial no próprio processo de fabricação. Engenheiros de hardware do Google agora utilizam o Gemini para projetar o hardware que sustentará futuras gerações de modelos, reduzindo significativamente o tempo entre o início do projeto e a fase de tape-out. Essa integração demonstra que o uso de IA no design de chips atingiu o mesmo nível de intensidade que o desenvolvimento de software dentro da organização.

Apesar da especialização, os novos componentes mantêm a capacidade de executar tarefas do outro modelo caso haja sobras de capacidade operacional. A estratégia de hardware do Google também se destaca pela longevidade, com gerações de TPUs de até oito anos operando com 100% de utilização em seus data centers. A substituição de equipamentos é realizada por blocos completos, conhecidos como pods, que chegam a integrar 9.600 chips em uma única estrutura.

## Fontes

- [Amin Vahdat em Sequoia Capital: Google's AI Infrastructure Chief, Amin Vahdat, on the Physics & Economics of Frontier AI](https://www.youtube.com/watch?v=bGph8GwB3Sk&t=3157s&q=eb7bc0e6) (2026-10-06)
- [Amin Vahdat em Sequoia Capital: Google's AI Infrastructure Chief, Amin Vahdat, on the Physics & Economics of Frontier AI](https://www.youtube.com/watch?v=bGph8GwB3Sk&t=1827s&q=ba907a73) (2026-10-06)
- [Amin Vahdat em Sequoia Capital: Google's AI Infrastructure Chief, Amin Vahdat, on the Physics & Economics of Frontier AI](https://www.youtube.com/watch?v=bGph8GwB3Sk&t=1126s&q=60331517) (2026-10-06)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-10-07/google-divide-linha-de-chips-tpu-em-modelos-para-treinamento-e-inferencia
