---
title: "Google introduz compreensão de vídeo agentica nos modelos Gemini"
url: https://dailyjournal.news/news/2026-09-01/google-integra-capacidades-de-compreensao-de-video-ao-gemini
published: 2026-09-01T17:32:07.972976+00:00
updated: 2026-09-01T18:10:45.171+00:00
categories: ["technology"]
source_count: 4
outlet_count: 1
language: pt-BR
publisher: "Daily Journal"
---

# Google introduz compreensão de vídeo agentica nos modelos Gemini

Nova funcionalidade permite que modelos Gemini analisem vídeos com maior precisão, reduzindo o consumo de tokens em até 88% e os custos operacionais em 66%.

## Pontos principais

- A tecnologia de compreensão de vídeo agentica foi integrada aos modelos Gemini 3.7 Flash, 3.6 Flash e 3.5 Flash-Lite.
- O sistema analisa dinamicamente transcrições, áudio e quadros para selecionar momentos específicos do vídeo.
- A ferramenta permite processar vídeos longos com uma redução de 88% no uso de tokens.
- O custo de processamento de vídeo foi reduzido em 66% para desenvolvedores.
- Testes indicam um aumento de 7% na precisão da análise de conteúdo em comparação com versões anteriores.
- O recurso já está disponível via Gemini API no Google AI Studio e na Gemini Enterprise Agent Platform.
- A funcionalidade será integrada futuramente ao aplicativo Gemini e à ferramenta Ask YouTube.

O Google anunciou a implementação de capacidades de compreensão de vídeo agentica em sua linha de modelos Gemini. A nova tecnologia permite que os modelos 3.7 Flash, 3.6 Flash e 3.5 Flash-Lite adaptem a velocidade de processamento para identificar movimentos rápidos e extrair informações de forma dinâmica, analisando transcrições, áudio e quadros de vídeo de maneira integrada. O avanço é voltado principalmente para a otimização de tarefas complexas que envolvem conteúdos de longa duração.

Além do ganho de 7% na precisão da análise, a atualização traz benefícios significativos de eficiência para desenvolvedores que utilizam a Gemini API. Segundo a empresa, a nova arquitetura reduz o consumo de tokens em até 88% e diminui os custos de processamento em 66%. A ferramenta já pode ser acessada por meio do Google AI Studio e da Gemini Enterprise Agent Platform, com planos de expansão para o aplicativo Gemini e o recurso Ask YouTube em breve.

## Fontes

- [Introducing agentic video understanding with Gemini](https://deepmind.google/blog/introducing-agentic-video-in-gemini/) — DeepMind (2026-09-01)
- [@googleaidevs: Can Gemini count the number of claps? 👏](https://x.com/googleaidevs/status/2094841365389803900) (2026-09-01)
- [@GoogleDeepMind: We’re bringing agentic video understanding to our latest Gemini models.](https://x.com/GoogleDeepMind/status/2094840179676660097) (2026-09-01)
- [@Google: We’re introducing a new capability to our latest Gemini models: agentic video understanding.](https://x.com/Google/status/2094840325789430066) (2026-09-01)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-09-01/google-integra-capacidades-de-compreensao-de-video-ao-gemini
