视频深度估计Transformer适配器

时序一致实时估计

无需光流即可输出时空一致的视频深度图,克服单图模型在视频上的闪烁伪影。

冼可 · Peng, Juewen · 曹治国 · Zhang, Jianming · Lin, Guosheng

IEEE Transactions on Multimedia 2023

技术优势

不依赖光流

推理时无需光流估计,消除了光流误差累积和计算开销,使模型能够实时处理视频。

消除闪烁

通过时序嵌入和时空一致性损失,约束连续帧同一空间点的预测一致,避免单图模型导致的闪烁伪影。

应用场景