llama.cpp 프로젝트는 Vulkan 백엔드에 대한 GGML_OP_POOL_1D 전체 지원을 도입한 버전 b10216을 출시했습니다. 이 업데이트에는 기존 pool2d 구현을 반영하는 새로운 계산 셰이더와 텐서 차원이 음수 종료 경계를 초래할 때 발생하는 충돌을 수정하는 것이 포함됩니다.

  • 1D 풀링 작업을 위한 vk_op_pool1d_push_constants 구조체 및 pipeline_pool1d_f32 필드 추가.
  • Vulkan에서 1D 풀링 로직을 처리하기 위해 pool1d.compute 셰이더 구현.
  • pool1d_f32를 등록하고 텐서 차원 인덱스 및 평균 풀링 스케일을 수정하여 셰이더 로직 수정.
  • k0 < p0일 때 경계 충돌 문제를 해결하고 수정에 대한 테스트 범위를 확장.

이 릴리스는 Vulkan으로 가속화된 모델 내에서 1D 풀링 레이어를 사용할 수 있도록 하며, CPU, CUDA, ROCm 및 기타 백엔드에 대해 macOS, Linux, Windows, Android 및 openEuler용 바이너리를 제공합니다.