xAI ha anunciado Grok-1.5, un nuevo modelo que cuenta con capacidades de razonamiento mejoradas y una ventana de contexto de hasta 128.000 tokens. El modelo estará disponible para los primeros probadores y usuarios existentes en la plataforma 𝕏 en los próximos días.
- Logró un 50,6% en el benchmark MATH y un 90% en GSM8K para tareas matemáticas.
- Obtuvo un 74,1% en el benchmark HumanEval para generación de código.
- Admite una longitud de contexto de 128K tokens, aumentando la capacidad de memoria 16 veces.
- Demostró resultados perfectos en las evaluaciones Needle In A Haystack.
- Construido sobre un marco de entrenamiento distribuido personalizado que utiliza JAX, Rust y Kubernetes.
El lanzamiento tiene como objetivo proporcionar a los usuarios capacidades avanzadas de resolución de problemas y la capacidad de procesar documentos sustancialmente más largos mientras mantiene la precisión en el seguimiento de instrucciones.