视频目标检测网络

85.2% mAP 领先精度

融合上下文细化与语义蒸馏,提升检测框定位与分类精度,为视频分析任务提供更可靠的结果。

Qi, Qiang · Hou, Tianxiang · Yan, Yan · 卢杨 · 王菡子

IEEE Transactions on Circuits and Systems for Video Technology 2023

参数信息

mAP
85.2 %
mAP
86.3 %

技术优势

定位更准

通过上下文感知的建议框细化模块生成高质量建议框,从而提高目标定位准确性。

识别更可靠

相似度感知的语义蒸馏模块利用类别标签的语义知识作为额外监督信号,增强目标识别能力。

特征聚合更有效

结构感知的关系学习模块通过自适应剪枝残差图卷积网络建模特征间的结构关系,实现更有效的特征聚合。

应用场景