在七种场景下,对感知约束的GPU分配器与FIFO调度器进行了基准测试,在相同硬件上实现了高达33个百分点的GPU利用率提升,以及高达105%的优先级加权输出增长。该系统将实时推理需求视为波动曲线而非静态预留,允许类批处理作业在低谷期填充容量,同时遵守严格约束,如连续的GPU块和非抢占式调度。
- 利用率从52–85%的范围提升至72–88%,在竞争场景中优先级加权价值平均增加52%。
- 在8 GPU上的训练密集型工作负载中,利用率从53.6%跃升至87.0%,输出价值翻倍以上。
- 该分配器在标准场景下运行时间为1–2毫秒,在包含64个GPU和30个作业的大规模测试中为15毫秒。
- 即使在优先级均匀分布的情况下,系统也将利用率从76.8%提升至87.5%,证明视界规划带来的增益超越了仅靠优先级加权的效果。
通过在整个调度视界内优化分配决策,而非依赖到达顺序,该分配器防止了由静态预留导致的空闲容量,并确保高优先级工作负载得到高效调度。