---
title: "Perplexity libera código aberto do motor de inferência Lily"
url: https://dailyjournal.news/news/2026-09-02/perplexity-libera-codigo-aberto-do-motor-de-inferencia-lily
published: 2026-09-02T20:40:34.462797+00:00
updated: 2026-09-02T20:40:34.462797+00:00
categories: ["technology"]
source_count: 1
outlet_count: 0
language: pt-BR
publisher: "Daily Journal"
---

# Perplexity libera código aberto do motor de inferência Lily

A ferramenta otimiza o desempenho do modelo Qwen3.6-35B-A3B em dispositivos Apple Silicon através de computação híbrida.

## Pontos principais

- O motor Lily foi projetado para rodar o modelo Qwen3.6-35B-A3B em hardware Apple.
- O sistema utiliza computação híbrida entre nuvem e processamento local no Mac.
- Testes em MacBook Pro com chip M5 Max indicam desempenho superior ao framework MLX-LM.
- O Lily apresentou throughput de prefill 1,23 vezes maior e de decode 1,35 vezes maior que o MLX-LM.
- O código-fonte do motor de inferência já está disponível publicamente.

A Perplexity anunciou o lançamento em código aberto do Lily, um motor de inferência local desenvolvido para otimizar a execução do modelo Qwen3.6-35B-A3B em dispositivos com processadores Apple Silicon. A tecnologia utiliza um sistema de computação híbrida que distribui as tarefas de processamento entre a nuvem e o hardware local do usuário.

Em testes realizados em um MacBook Pro equipado com chip M5 Max, o Lily demonstrou desempenho superior ao framework MLX-LM. O motor registrou um throughput de prefill 1,23 vezes maior e de decode 1,35 vezes maior, consolidando-se como uma alternativa para otimização de modelos em dispositivos da Apple.

## Fontes

- [@perplexity_ai: Today we’re open-sourcing Lily, the local inference engine we built for hybrid compute in Perplexity Computer.](https://x.com/perplexity_ai/status/2095241544383226274) (2026-09-02)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-09-02/perplexity-libera-codigo-aberto-do-motor-de-inferencia-lily
