模型性能分析疑问

如图所示,在本地部署私有模型的时候,性能报告中发现相同ops的卷积层,耗时差距接近四倍,其中conv1的输入tensor shape是[1,128,160,32],conv4的输入tensor shape是[[1,32,40,128],请问造成性能差距如此巨大的原因是为什么呢?是分辨率的差距导致的性能差距吗?