多智能体强化学习自适应切换编码与定位策略,通过渐进细化实现弱监督视频重定位的精准时序边界检测。
周圆 · Axin, Guo · Huo, Shuwei · 刘瑜 · Kung, Sunyuan
IEEE Transactions on Circuits and Systems for Video Technology 2023
只需视频级标注,无需逐帧标签,直接降低标注成本。
智能体强化边界定位器通过渐进细化修正目标时刻边界,而不是一次性预测。
智能体根据输入动态选择编码方式,获得更有效的视频特征表示。
用相关性导向的奖励生成器评估定位片段与查询视频的相关性,并以此训练多个智能体。