Alibaba lança modelo de IA Qwen-Image 3.0 para geração visual
A Alibaba apresentou o Qwen-Image 3.0, modelo capaz de renderizar textos complexos e interfaces digitais, disponível exclusivamente via Qwen Chat.
Pontos principais
- O Qwen-Image 3.0 suporta até 4.500 tokens de entrada para layouts densos.
- O modelo permite a renderização precisa de textos com fontes a partir de 10px.
- Suporte nativo para 12 idiomas e reprodução realista de interfaces de aplicativos e web.
- Capacidade de integrar dados da internet em tempo real, como gráficos meteorológicos.
- Diferente das versões anteriores, a Alibaba não divulgou pesos, parâmetros ou relatórios técnicos.
- O acesso ao modelo é restrito à plataforma Qwen Chat, sem opção de implantação local.
A Alibaba lançou em 21 de julho de 2026 o Qwen-Image 3.0, a terceira geração de sua série de modelos de geração de imagens. O sistema se destaca pela capacidade de criar layouts complexos, como páginas de jornais, storyboards e infográficos de múltiplas seções, em uma única passagem de processamento. Além da precisão tipográfica, o modelo é capaz de replicar interfaces de usuário e extrair dados dinâmicos da internet para compor elementos visuais específicos.
Ao contrário das iterações anteriores, como o Qwen Image 2.0 — que era reconhecido por sua arquitetura de 7B parâmetros e liderança em benchmarks de avaliação humana —, o lançamento do 3.0 ocorreu sem a publicação de métricas de desempenho, contagem de parâmetros ou acesso aos pesos do modelo. Atualmente, a ferramenta está disponível apenas através do serviço Qwen Chat, mantendo o desenvolvimento sob um modelo de acesso fechado que impede a verificação independente por pesquisadores externos.
Comentários
Carregando comentários...
