语义一致超90%
将视觉-语言基础模型的语义特征高效地融入3D高斯展开,实现多视图语义一致的整体场景理解。
Zuo, Xingxing · Samangouei, Pouya · Yunwen, Zhou · Di, Yan · Li, Mingyang
International Journal of Computer Vision 2024
通过结合高斯展开与多分辨率哈希编码,构建了高效场景表示,显著降低渲染与特征查询成本。
像素对齐损失使同一语义实体在不同视角下的渲染特征距离拉近,遵循像素级语义边界。
新的场景表示融合了高斯展开与多分辨率哈希编码的优点,确保高质量渲染的同时加速训练。