Daily Journal
Daily Journal

Skild AI lança S1, robô que aprende tarefa com um único vídeo

O modelo acerta 66% em tarefas inéditas contra 9% de uma política com prompt em linguagem treinada com os mesmos dados.

Daily Journal
||
26/08 às 09:00

Pontos principais

  • O S1 foi anunciado em 25 de agosto de 2026 e usa um único vídeo de demonstração como prompt.
  • O modelo executa a tarefa sem fine-tuning e sem pós-treinamento, de modo que os pesos nunca mudam.
  • O vídeo é gravado em perspectiva egocêntrica, do ponto de vista de quem executa a tarefa.
  • Com dados, arquitetura e compute constantes, o prompt em vídeo obteve 66% de acerto contra 9% do prompt em linguagem.
  • Uma demonstração em vídeo equivaleu a cerca de 380 episódios de pós-treinamento.
  • As quatro tarefas demonstradas e ausentes do pré-treinamento foram plantar em vaso, fazer panquecas, preparar café coado e montar um kit.
  • Os parceiros anunciados são ABB Robotics, Universal Robots e MiR.

As tarefas levam até dez minutos e envolvem dezenas de etapas de manipulação. A Skild argumenta que o modelo precisa inferir a intenção de quem demonstra, porque a demonstração pode vir de outra cena, de outro ponto de vista ou de outro corpo de robô.

O que não existe é verificação externa: não há pesos para download, API pública, licença, preço nem artigo científico. A empresa está implantando o S1 com um conjunto limitado de parceiros industriais, e o modelo foi treinado em infraestrutura de IA da Nvidia.

Comentários

Carregando comentários...