推理快6到25倍
融合CNN与MLP的轻量级架构,在保持分割精度的同时大幅压缩交互时间,适合需要实时响应的临床部署场景。
Zhenkun, Wei · Jia, Liu · Yao, Yu
Semantic Web and Information Systems 2024
采用token化策略显著降低计算量,使交互时间缩短至同类网络的1/6至1/10,实时反馈成为可能。
CNN提取细节特征,MLP捕获长程依赖,解码器融合全局与高分辨率特征,在提速同时保持分割精度。