A IA suíça lançou o Apertus 1.5, uma família de modelos de linguagem com 8B e 70B parâmetros que introduz capacidades multimodais e um novo recurso de raciocínio. A atualização envolve pré-treinamento contínuo em uma mistura multimodal adicional de 4T tokens para o modelo 8B e 2T tokens para o modelo 70B.
- Suporta entradas multimodais, incluindo imagens, áudio e texto, para gerar respostas em texto.
- Introduz um "modo de raciocínio" que permite aos modelos raciocinar sobre a entrada antes de gerar respostas.
- Aumenta o comprimento padrão do contexto para 262.144 tokens, um aumento quatro vezes maior em relação ao Apertus 1.0.
- Aprimora as capacidades de seguir instruções e usar ferramentas por meio de uma receita de pós-treinamento aprimorada.
- Mantém pesos, dados e detalhes de treinamento totalmente abertos, enquanto suporta uma ampla gama de idiomas.
O lançamento visa avançar o estado da IA multilíngue, multimodal e transparente, fornecendo aos desenvolvedores opções versáteis de interação e desempenho melhorado em tarefas de raciocínio.