Thinking Machines lança Inkling-Small, modelo multimodal de pesos abertos
O novo modelo de IA da Thinking Machines Lab oferece desempenho comparável à versão original com maior eficiência e licenciamento Apache 2.0.
Pontos principais
- O Inkling-Small possui 276 bilhões de parâmetros totais e 12 bilhões de parâmetros ativos, utilizando arquitetura de Mistura de Especialistas (MoE).
- O modelo é licenciado sob a licença Apache 2.0, facilitando a adoção comercial por empresas.
- A ferramenta oferece suporte a entradas de texto, imagem e áudio, com uma janela de contexto de até um milhão de tokens.
- O modelo permite que usuários controlem o esforço de raciocínio durante a execução, otimizando recursos computacionais.
- Apesar da eficiência, o modelo ainda exige infraestrutura de servidores de GPU de nível empresarial para execução.
A Thinking Machines Lab anunciou o lançamento do Inkling-Small, um modelo de inteligência artificial multimodal de pesos abertos. Com 276 bilhões de parâmetros totais e apenas 12 bilhões de parâmetros ativos, o modelo utiliza uma arquitetura de Mistura de Especialistas (MoE) para entregar um desempenho comparável ao Inkling original, ocupando apenas um quarto do tamanho. O lançamento, licenciado sob a licença Apache 2.0, reforça a estratégia da empresa em disponibilizar tecnologias acessíveis para a comunidade de desenvolvedores e para o setor corporativo.
Além da eficiência, o Inkling-Small suporta entradas de texto, imagem e áudio, contando com uma janela de contexto de até um milhão de tokens. O modelo permite que os usuários ajustem o esforço de raciocínio durante a execução, embora ainda demande infraestrutura de servidores de GPU de nível empresarial para operar. A iniciativa demonstra a capacidade da startup em estabelecer um pipeline de desenvolvimento de modelos escalável, sendo que a ferramenta já pode ser acessada para fine-tuning na plataforma Tinker ou via Hugging Face.
Comentários
Carregando comentários...
