最近在部署一个YOLOv8-seg模型,用TensorRT的ONNX转换,FP16模式跑出来的mAP比原始PyTorch低了将近3个点,尤其小目标漏检变多。我试过关闭某些层的FP16(用trtexec--fp16--precision控制),但效果不明显。也试过用onnx-simplifier清理图结构,还是没改善。