首先确保当前docker环境使用的是GPU版的onnxruntime,通过ort.get_available_providers()来看是否有CUDAExecutionProvider。之后在进行量化的时候可以新开一个终端去watch - n 1 nvidia-smi,进入到calibration的时候GPU是参与了运算的。