llama.cpp 프로젝트에서 버전 0.1.2를 출시했으며, 여기에는 ggml 동기화(0.20.2로 업그레이드)와 서버 및 UI 구성 요소에 대한 여러 업데이트가 포함되어 있습니다.
- CUDA: DGX Spark의 밀집 모델용 bs=1에 대해 MMVQ nwarps=8.
- mtmd: 입력 해싱에 sha256 사용.
- vocab: 정수 토큰화기 점수 지원.
- mtmd: 타일링되지 않은 LFM2 이미지의 썸네일 건너뛰기.
- server: 처리된 mtmd 청크를 자리 표시자로 저장.
- ui: 열거형 멤버의 알파벳 순서 강제 적용 및 내장 도구 이름 재구성.
이번 릴리스에는 xcframework + cmake에 대한 빌드 정리와 프리릴리스 생성을 위한 CI 프로세스 업데이트도 포함되어 있습니다.