A xAI anunciou o Grok-1.5, um novo modelo com capacidades de raciocínio aprimoradas e uma janela de contexto de até 128.000 tokens. O modelo estará disponível para testadores iniciais e usuários existentes na plataforma 𝕏 nos próximos dias.
- Alcançou 50,6% no benchmark MATH e 90% no GSM8K para tarefas matemáticas.
- Marcou 74,1% no benchmark HumanEval para geração de código.
- Suporta um comprimento de contexto de 128K tokens, aumentando a capacidade de memória em 16 vezes.
- Demonstrou resultados perfeitos nas avaliações Needle In A Haystack.
- Construído sobre um framework de treinamento distribuído personalizado usando JAX, Rust e Kubernetes.
O lançamento visa fornecer aos usuários capacidades avançadas de resolução de problemas e a capacidade de processar documentos substancialmente mais longos, mantendo a precisão no seguimento de instruções.