llama.cpp b10666 版本将 test-save-load-state 套件扩展至在所有架构上运行,并解决了状态管理和图处理中的几个关键错误。主要更改包括修复 minimax-01 中的悬空引用、对齐设备内序列的块复制,以及纠正 deepseek4 的索引器头计数。
- test-save-load-state 套件现在通过新的 --models DIR 模式针对每个 *.gguf 模型运行,取代了之前单一模型的局限。
- 设备内状态序列复制逻辑已放宽,通过使用字节游标而非要求精确的块对齐来处理非连续源。
- 更新了虚拟 DSA 索引器参数(key_length=128, head_count=64),以确保融合的 Lightning Indexer 操作在 GPU 上运行,而不是回退到 CPU。
- deepseek4 的索引器头计数设置为 64,以匹配修复后的内核要求,防止设备不匹配警告。
- minimax-01 的 LA 图输入中的悬空 hparams 引用被替换为副本,以防止在图重用期间发生栈内存损坏。
这些更新提高了对 deepseek4、gemma2 和 minimax-01 等复杂架构的测试覆盖率和稳定性,确保状态序列化在各种硬件后端上能正确工作。