llama.cpp 프로젝트는 Metal 성능을 개선하기 위해 Apple M3 Max, M5 및 M5 Pro GPU용 빠른 주의 벡터(fa-vec) 튜닝 레코드를 추가했습니다.
- Apple M5용 튜닝은 f16 및 q8_0 데이터 유형을 사용하여 M5 머신에서 생성되었습니다.
- Apple M5 Pro에 대한 레코드는 20개의 GPU 코어에 걸쳐 F16, Q4_0 및 Q8_0 형식을 다룹니다.
- M3 Max 지원에는 저전력 모드에서 64GB가 탑재된 MacBook Pro의 F16 및 Q8_0 구성이 포함됩니다.
이러한 업데이트는 Metal 가속 기능을 최신 Apple silicon 아키텍처로 확장합니다.