A implementação do CUDA foi atualizada para priorizar estratégias de agendamento de tiles completos para o FlashAttention. Essa mudança visa otimizar o fluxo de execução dos mecanismos de atenção dentro do framework.