抓取准确率提升
该框架融合视觉、文本与人类先验知识,实现上下文感知的精准抓取,超越现有最先进方法。
Zhao, Zhou · Dongyuan, Zheng · 73189817 · 罗晶 · Yanjun, Wang · 黄攀峰 · Yang, Chenguang
IEEE Transactions on Automation Science and Engineering 2025
同时使用视觉、文本和人类先验知识,在复杂动态环境中更准确地识别和操作物体。
利用语言线索细化物体视觉表示,实现更符合场景的抓取动作。
在两个数据集上均大幅超越现有方法,最高提升22.76%。