拼图CAM弱监督模型

弱标签定位声事件

用弱标签训练的分类网络,通过拼图式类激活图直接输出声音事件的时间戳,摆脱对强标签数据的依赖。

Cai, Xichang · Yanggang, Gan · 武梦龙 · Juan, Wu

IEEE Access 2023

参数信息

PSDS2(单系统)
0.732
PSDS2(集成)
0.751

技术优势

无需强标签

利用模型分类预测引导CAM输出,从弱标签训练的模型中获取时间戳信息。

检测更完整

通过最小化原始特征CAM与分离特征块合并CAM的差异,发现更完整的声音事件区域。

实时定位事件

根据特征所在帧的位置确定声音事件的发生时间,实现帧级定位。

集成提升显著

多系统CAM集成将PSDS2从0.732提升到0.751,集成后性能更好。

应用场景