llama.cpp 프로젝트가 빌드 b10293을 출시했으며, 여기에는 gfx1151 아키텍처에 대한 AMD ROCm 지속적 통합 온보딩과 통합 RDNA3.5 GPU의 정확성 문제가 해결되었습니다.
- 디버그 어설트에서 통합-GPU 호스트 출력 버퍼를 허용하여 gfx1151의 test-recurrent-state-rollback을 수정했습니다.
- mmap으로 로드된 가중치와의 GPU 일관성 문제를 우회하기 위해 통합 메모리를 활성화하여 RDNA3.5에서의 추론 정확성을 복원했습니다.
- HIP 경로에서 비동기 실행 오류를 해결하기 위해 HIP_LAUNCH_BLOCKING=1을 사용하여 커널 시작을 직렬화했습니다.
- 지원되지 않는 작업과 잘못된 출력으로 인해 HIP 백엔드에서 jamba 아키텍처 테스트 및 top-k 하위 테스트를 건너뛰었습니다.
이 업데이트는 ROCm을 통해 AMD RDNA3.5 하드웨어에서 llama.cpp 모델의 신뢰할 수 있는 테스트와 추론을 가능하게 합니다.