实验 9: 使用 Kueue 管理 HAMi vGPU 队列
本实验把 HAMi GPU 切分与 Kueue 准入控制接到一起。HAMi 为 Pod 分配显存和算力切片,Kueue 在 Job 准入前统计这些切片。你将提交三个相同规格的 Job:前两个正常运行,第三个因为 vGPU、显存和算力配额已经用完而保持挂起。
文中的输出来自一套实际环境:Kubernetes 1.36.1、containerd 2.2.4、Kueue 0.18.1、HAMi 2.9.0,GPU 为一张 15 GiB Tesla T4。
版本相关的 API
本实验使用 Kueue 0.18.1 提供的 v1beta2 API 和 ResourceTransformation 配置。若使用其他 Kueue 版本,请先核对对应版本的发布说明。