Google lança Gemini Embedding 2, primeiro modelo de embedding nativamente multimodal
Modelo mapeia texto, imagens, vídeo, áudio e documentos em espaço unificado com redução de latência de até 70%.
||
11/03 às 09:00
Pontos principais
- Primeiro modelo de embedding nativamente multimodal do Google
- Mapeia texto, imagens, vídeo, áudio e documentos em um espaço unificado
- Suporta mais de 100 idiomas para busca cross-modal
- Redução de latência de até 70% para alguns clientes enterprise
- Disponível via Gemini API no Google AI Studio e Vertex AI
O Google lançou o Gemini Embedding 2 em preview público, seu primeiro modelo de embedding nativamente multimodal. O modelo mapeia texto, imagens, vídeo, áudio e documentos em um espaço de embedding unificado, habilitando busca e classificação cross-modal em mais de 100 idiomas.
Para clientes enterprise, o modelo promete redução de latência de até 70% e menor custo total para sistemas de IA baseados em RAG. Está disponível via Gemini API no Google AI Studio e Vertex AI.
Comentários
Carregando comentários...
