Daily Journal
Daily Journal

Alibaba lança modelo de IA Qwen-Image 3.0 para geração visual

A Alibaba apresentou o Qwen-Image 3.0, modelo capaz de renderizar textos complexos e interfaces digitais, disponível exclusivamente via Qwen Chat.

Daily Journal
||
21/07 às 13:42

Pontos principais

  • O Qwen-Image 3.0 suporta até 4.500 tokens de entrada para layouts densos.
  • O modelo permite a renderização precisa de textos com fontes a partir de 10px.
  • Suporte nativo para 12 idiomas e reprodução realista de interfaces de aplicativos e web.
  • Capacidade de integrar dados da internet em tempo real, como gráficos meteorológicos.
  • Diferente das versões anteriores, a Alibaba não divulgou pesos, parâmetros ou relatórios técnicos.
  • O acesso ao modelo é restrito à plataforma Qwen Chat, sem opção de implantação local.

A Alibaba lançou em 21 de julho de 2026 o Qwen-Image 3.0, a terceira geração de sua série de modelos de geração de imagens. O sistema se destaca pela capacidade de criar layouts complexos, como páginas de jornais, storyboards e infográficos de múltiplas seções, em uma única passagem de processamento. Além da precisão tipográfica, o modelo é capaz de replicar interfaces de usuário e extrair dados dinâmicos da internet para compor elementos visuais específicos.

Ao contrário das iterações anteriores, como o Qwen Image 2.0 — que era reconhecido por sua arquitetura de 7B parâmetros e liderança em benchmarks de avaliação humana —, o lançamento do 3.0 ocorreu sem a publicação de métricas de desempenho, contagem de parâmetros ou acesso aos pesos do modelo. Atualmente, a ferramenta está disponível apenas através do serviço Qwen Chat, mantendo o desenvolvimento sob um modelo de acesso fechado que impede a verificação independente por pesquisadores externos.

Comentários

Carregando comentários...