World Labs anuncia Atlas, modelo que unifica reconstrução 3D e geração
A startup fundada por Fei-Fei Li apresentou o Atlas, modelo de inteligência visual que integra reconstrução 3D e geração de conteúdo em um sistema.
Pontos principais
- O Atlas unifica tarefas de reconstrução 3D e geração de vídeo em uma única arquitetura.
- A tecnologia é multimodal e aceita texto, imagens, vídeos e poses de câmera como entradas.
- O sistema utiliza a estimativa de pontos de vista para integrar os processos de reconstrução e geração.
- O desenvolvimento visa superar a divisão histórica entre os subcampos de visão computacional.
A World Labs, fundada por Justin Johnson e pela Dra. Fei-Fei Li, anunciou o lançamento do Atlas, um novo modelo de inteligência visual. A tecnologia foi desenvolvida para unificar a reconstrução 3D e a geração de conteúdo em uma única arquitetura, superando a divisão histórica entre esses subcampos da visão computacional. O sistema opera de forma multimodal, processando nativamente entradas como texto, imagens, vídeos e poses de câmera. A base do funcionamento do Atlas reside na estimativa de pontos de vista, que permite integrar as tarefas de reconstrução e geração de forma coesa.
Comentários
Carregando comentários...
