Le projet llama résout une course de données sur le backend CPU qui se produisait lorsque des copies de séquences partagées écrivaient la même représentation du pool de clés-valeurs depuis plusieurs entrées de scatter. La correction garantit que chaque représentation poolée est re-poolisée exactement une fois, empêchant les conflits d'écriture concurrents.

  • Re-pooliser chaque représentation partagée du k-pool une fois pour résoudre la course de données.
  • Vérifier la copie de la séquence entière dans la mémoire d'index hybride pour rejeter les plages partielles qui pourraient causer des regroupements de pool invalides.
  • Supprimer le mode cache_safe du k-pool, permettant aux séquences partageant des cellules de partager des lignes de pool valides sans contournements par invalidation totale.

Ce changement supprime les scans de partage inutiles et la logique d'invalidation d'état, simplifiant le processus de copie de séquence tout en assurant l'intégrité des données.