Thinking Machines Lab lança modelos Inkling com foco em segurança
Startup de Mira Murati introduz framework de liberação gradual para modelos de IA, disponibilizando os pesos dos novos Inkling e Inkling-Small.
Pontos principais
- A Thinking Machines Lab lançou os modelos Inkling (975B) e Inkling-Small (276B) com pesos abertos.
- A empresa estabeleceu um framework de quatro estágios para liberar modelos de forma segura e iterativa.
- O processo inclui acesso antecipado para defensores, fine-tuning, testes de caixa-branca e monitoramento público.
- Avaliações internas e testes de red-teaming externo indicaram que os modelos não apresentam riscos adicionais significativos.
- Testes de fine-tuning adversarial confirmaram que a remoção de salvaguardas não eleva riscos de cibersegurança ou CBRN.
- O modelo Inkling-Small já está disponível para fine-tuning na plataforma Tinker e via chat no Tinker Playground.
A Thinking Machines Lab, startup liderada por Mira Murati, anunciou uma nova abordagem para a disponibilização de modelos de inteligência artificial com pesos abertos. A estratégia, detalhada no framework 'A Safe Path to Open Weights', propõe um modelo de liberação em estágios, que condiciona o acesso à maturidade das defesas e à evidência de segurança, visando equilibrar a abertura da tecnologia com a mitigação de riscos de uso indevido.
Os modelos Inkling, com 975 bilhões de parâmetros, e Inkling-Small, com 276 bilhões, foram submetidos a rigorosos processos de avaliação, incluindo testes de red-teaming por quatro organizações independentes e simulações de fine-tuning adversarial. Segundo a empresa, os resultados demonstram que os modelos não superam o nível de risco já existente em outras soluções de pesos abertos disponíveis no mercado, validando a estratégia de abertura gradual adotada pela startup.
Comentários
Carregando comentários...
