语义文本即控ROI
用户仅输入语义文本即可自行界定感兴趣区域并灵活调节ROI与非ROI的重建质量权衡,无需固定掩码,且统一掩码下仍优于主流深度图像压缩方法。
Jin, Jian · Fanxin, Xia · Feng, Ding · 张新峰 · 刘美琴 · 赵耀 · Lin, Weisi · 孟丽丽
IEEE Transactions on Circuits and Systems for Video Technology 2025
用户通过输入语义文本即可自定义ROI,无需手动标注掩码,编码器由文本控制。
通过可调节的非ROI掩蔽强度(CVA机制)灵活控制ROI与非ROI的重建质量分配。
即使输入统一掩码,本方法在图像重建和机器视觉任务上仍超过锚定方法。