llama 项目解决了 CPU 后端发生的数据竞争问题,当共享序列副本从多个 scatter 条目写入相同的键值池表示时会出现此问题。修复确保每个池化表示仅重新池化一次,防止并发写入冲突。
- 将每个共享的 k-pool 表示重新池化一次以解决数据竞争。
- 在混合索引内存中验证整个序列的复制,以拒绝可能导致无效池分组的 partial ranges。
- 移除 k-pool cache_safe 模式,允许共享单元格的序列共享有效的池化行,而无需使用全量失效的变通方法。
此更改移除了不必要的共享扫描和状态失效逻辑,简化了序列复制过程,同时确保数据完整性。