MuJoCo Warp (MJWarp), построенный на основе NVIDIA Warp, позволяет совместимым моделям MuJoCo работать в масштабе GPU, обеспечивая запуск сотен или тысяч независимых симуляционных миров за один вызов. Эта архитектура смещает фокус с минимизации задержки для одного окружения на улучшение общей пропускной способности, что благоприятствует обучению с подкреплением и масштабной выборке.
- MJWarp реализует физический конвейер MuJoCo с использованием NVIDIA Warp, компилируя CUDA-ядра для обновления состояний симуляции на GPU NVIDIA.
- Фреймворк поддерживает явный параллельный рабочий процесс, массивы устройств и композиционные запуски ядер, с опциональной дифференцируемостью и детерминированными режимами выполнения.
- Настройка производительности включает захват CUDA-графов для повторяющихся шагов и точное определение размеров буферов контактов и ограничений, таких как nconmax и njmax.
- Переход от CPU MuJoCo требует согласования скоростей симуляции и проверки результатов по базовой линии, например, складывания кубов манипулятором SO-101.
Этот подход помогает пользователям масштабировать рабочие процессы моделирования робототехники за счет использования параллелизма GPU для эффективного сбора опыта в конвейерах обучения.