Выпуск llama.cpp b10676 исправляет ошибку в `conv_transpose_2d`, где вычислялся только первый пакет, а последующие оставались нулевыми. Это исправление применяется как к основной библиотеке ggml, так и к реализации бэкенда Metal.

  • ggml: Перестановка источника и цикл вычислений теперь итерируются по измерению пакета, а размер рабочего буфера масштабируется по количеству пакетов.
  • Metal: Сетка ядра охватывает все пакеты, декодируя индекс пакета из координаты z для смещения входных и выходных индексов.
  • В `test-backend-ops` добавлен тестовый случай с несколькими пакетами для проверки исправления.

Это гарантирует корректность результатов свёртки для нескольких пакетов на бэкендах CPU и GPU.