免训练即插即用
无需额外训练即可缓解大型视觉语言模型的物体幻觉问题,生成的描述与图像内容高度一致。
Leng, Sicong · Hang, Zhang · Guanzheng, Chen · Li, Xin · Lu, Shijian · Miao, Chunyan · Bing, Lidong
2024
VCD 无需额外训练即可生效,可直接应用于现有模型。
VCD 在多个 LVLM 家族上均能缓解幻觉,并在通用基准测试上取得优异表现。
VCD 不依赖外部工具或额外数据,易于集成。