牙科视觉语言模型

七模态牙科诊断

一个模型覆盖7种牙科影像、36项诊断任务,在协作中把初级与中级医生提升到接近专科水平。

Zijie, Meng · Hao, Jin · Feng, Bin · Xiaotang, Gai · Tianxiang, Hu · Xu, Hongxia · 刘晓强 · Zhu, Fudong · 赵志河 · 房兵 · 夏伦果 · Sun, Jimeng · 吴健 · 刘佐珠

Nature Communications 2026

参数信息

支持的影像模态数
7
支持的任务数
36
训练图像数
110,447
训练视觉问答对数
2.46 million
参与研究人数
32
诊断时间缩短
15.0-37.0 %

技术优势

覆盖7种模态

模型在7种牙科影像模态上联合训练,能综合多种影像信息进行判断,而现有系统多为单任务。

达到专科水平

在32名参与者的研究中,模型表现超越初级阅片者、比肩中级全科医生,并接近高级专科医生。

协作提升效率

在人机协作流程中,模型将初级和中级阅片者提升至专科专家水平,并将诊断时间缩短15.0-37.0%。

应用场景