跨场景视觉共生联动模型

跨图像关系解析

该模型能够同时理解跨场景关系与对象,通过分析各场景中的理据来实现全局信息的捕获,从而突破单图像关系构建的局限。

Guoqing, Zhang · 阚世超 · Lu, Shi · 许万茹 · 安高云 · 岑翼刚

Pattern Recognition 2025

参数信息

预训练图像对数量
100000
验证图像对数量
10000

技术优势

数据量大

在100,000对跨场景图像对上预训练,在10,000对图像对上验证,为跨场景关系解析提供了充足的训练数据。

应用场景