Daily Journal
Daily Journal

Google lança Gemini Embedding 2, primeiro modelo de embedding nativamente multimodal

Modelo mapeia texto, imagens, vídeo, áudio e documentos em espaço unificado com redução de latência de até 70%.

Daily Journal
||
11/03 às 09:00

Pontos principais

  • Primeiro modelo de embedding nativamente multimodal do Google
  • Mapeia texto, imagens, vídeo, áudio e documentos em um espaço unificado
  • Suporta mais de 100 idiomas para busca cross-modal
  • Redução de latência de até 70% para alguns clientes enterprise
  • Disponível via Gemini API no Google AI Studio e Vertex AI

O Google lançou o Gemini Embedding 2 em preview público, seu primeiro modelo de embedding nativamente multimodal. O modelo mapeia texto, imagens, vídeo, áudio e documentos em um espaço de embedding unificado, habilitando busca e classificação cross-modal em mais de 100 idiomas.

Para clientes enterprise, o modelo promete redução de latência de até 70% e menor custo total para sistemas de IA baseados em RAG. Está disponível via Gemini API no Google AI Studio e Vertex AI.

Comentários

Carregando comentários...