Проект llama устраняет гонку данных на CPU-бэкенде, возникавшую при записи одинакового представления пула ключей и значений из нескольких записей scatter при копировании общих последовательностей. Исправление гарантирует, что каждое представление пула перепулизуется ровно один раз, предотвращая конфликты одновременной записи.
- Перепулировать каждое общее представление k-pool один раз для устранения гонки данных.
- Проверять копирование всей последовательности в гибридной индексной памяти, чтобы отклонять частичные диапазоны, которые могут привести к некорректным группировкам пулов.
- Отключить режим k-pool cache_safe, позволяющий последовательностям, разделяющим ячейки, использовать общие допустимые строки пула без обходных путей с полной инвалидацией.
Это изменение устраняет ненужные сканирования общего доступа и логику инвалидации состояния, упрощая процесс копирования последовательностей при сохранении целостности данных.