---
title: "Pesquisadores de Stanford desenvolvem técnica de aprendizado por reforço"
url: https://dailyjournal.news/news/2026-09-23/pesquisadores-de-stanford-desenvolvem-tecnica-de-aprendizado-por-reforco
published: 2026-09-23T17:10:34.823714+00:00
updated: 2026-09-23T17:10:34.823714+00:00
categories: ["technology"]
source_count: 1
outlet_count: 0
language: pt-BR
publisher: "Daily Journal"
---

# Pesquisadores de Stanford desenvolvem técnica de aprendizado por reforço

Nova abordagem de aprendizado por reforço utiliza política de edição em tempo real para otimizar o desempenho em tarefas dinâmicas.

## Pontos principais

- A técnica opera em tempo real sobre uma base VLA (Vision-Language-Action).
- O método foi projetado especificamente para mitigar problemas de latência.
- Resultados superaram o desempenho do controle em tempo real (RTC) em testes.
- Projeto foi conduzido no Stanford AI Lab por Perry Dong e Kevin Hung.

Pesquisadores do Stanford AI Lab apresentaram uma nova técnica de aprendizado por reforço voltada para a execução de tarefas dinâmicas. O método utiliza uma política de edição de pequena escala que opera em tempo real sobre uma base VLA (Vision-Language-Action), visando solucionar desafios relacionados à latência.

O projeto foi liderado por Perry Dong e Kevin Hung, com orientação da professora Dorsa Sadigh. Em testes comparativos, a nova abordagem demonstrou um desempenho superior ao do controle em tempo real (RTC).

## Fontes

- [@chelseabfinn: RL for dynamic tasks requires handling latency.](https://x.com/chelseabfinn/status/2102804667197698532) (2026-09-23)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-09-23/pesquisadores-de-stanford-desenvolvem-tecnica-de-aprendizado-por-reforco
