复杂场景稳定位
通过全流程整合局部与全局信息,克服现有方法在复杂场景中定位不准、边界模糊的问题。
Mei, Haiyang · Xu, Ke · Yunduo, Zhou · 汪洋 · Piao, Haiyin · 魏小鹏 · 杨鑫
International Journal of Computer Vision 2023
通过金字塔定位模块同时整合局部特征与全局表示,使网络对场景有全面理解,避免被局部背景吸引。
双聚焦模块在获得准确定位后专注于目标边界,显著改善边界模糊问题。
网络运行速度达到 54 帧/秒,可直接部署到实时视频分析系统中。
在 4 个挑战性数据集、4 项标准指标上显著优于 15 个前沿模型,验证了其优越性。