基础模型嵌入式3D高斯展开

语义一致超90%

将视觉-语言基础模型的语义特征高效地融入3D高斯展开,实现多视图语义一致的整体场景理解。

Zuo, Xingxing · Samangouei, Pouya · Yunwen, Zhou · Di, Yan · Li, Mingyang

International Journal of Computer Vision 2024

参数信息

多视图语义一致性提升
10.2 %
推理速度
851 ×

技术优势

推理快851倍

通过结合高斯展开与多分辨率哈希编码,构建了高效场景表示,显著降低渲染与特征查询成本。

多视图语义一致

像素对齐损失使同一语义实体在不同视角下的渲染特征距离拉近,遵循像素级语义边界。

训练快速

新的场景表示融合了高斯展开与多分辨率哈希编码的优点,确保高质量渲染的同时加速训练。

应用场景