llama 프로젝트는 공유 시퀀스 복사본이 여러 scatter 엔트리에서 동일한 키-값 풀 표현을 쓸 때 발생하는 CPU 백엔드의 데이터 레이스를 해결합니다. 수정으로 인해 각 풀된 표현이 정확히 한 번만 재풀링되어 동시 쓰기 충돌을 방지합니다.

  • 데이터 레이스를 해결하기 위해 공유된 k-pool 표현을 한 번만 재풀링합니다.
  • 무효한 풀 그룹을 초래할 수 있는 부분 범위를 거부하기 위해 하이브리드 인덱스 메모리에서 전체 시퀀스 복사를 확인합니다.
  • k-pool cache_safe 모드를 제거하여 셀을 공유하는 시퀀스가 stale-all 우회 방법 없이 유효한 풀 행을 공유할 수 있게 합니다.

이 변경으로 불필요한 공유 스캔 및 상태 무효화 로직이 제거되어 데이터 무결성을 보장하면서 시퀀스 복사 프로세스가 단순화됩니다.