llama.cpp b10666 릴리스는 모든 아키텍처에서 실행되도록 test-save-load-state 스위트(suite)를 확장하고 상태 관리 및 그래프 처리의 여러 치명적인 버그를 해결했습니다. 주요 변경 사항에는 minimax-01의 덩글링 참조 수정, 온디바이스 시퀀스에 대한 청크 복사 정렬, deepseek4에 대한 인덱서 헤드 카운트 교정이 포함됩니다.
- test-save-load-state 스위트는 이제 이전의 단일 모델 제한을 대체하는 새로운 --models DIR 모드를 통해 모든 *.gguf 모델에서 실행됩니다.
- 온디바이스 상태 시퀀스 복사 로직이 정확한 청크 정렬 대신 바이트 커서를 사용하여 비연속 소스를 처리하도록 완화되었습니다.
- 더미 DSA 인덱서 매개변수가(key_length=128, head_count=64) 업데이트되어 퓨즈드 Lightning Indexer 연산자가 CPU로 폴백되지 않고 GPU에서 실행되도록 보장했습니다.
- deepseek4의 인덱서 헤드 카운트를 64로 설정하여 수정된 커널 요구 사항과 일치시켜 장치 불일치 경고를 방지했습니다.
- minimax-01의 LA 그래프 입력에서 덩글링 hparams 참조가 복사본으로 대체되어 그래프 재사용 중 스택 메모리 손상을 방지했습니다.
이러한 업데이트는 deepseek4, gemma2, minimax-01과 같은 복잡한 아키텍처에 대한 테스트 커버리지와 안정성을 개선하여 다양한 하드웨어 백엔드에서 상태 직렬화가 올바르게 작동하도록 보장합니다.