提出一种结合多重空间注意力的AlexNet模型,利用文本与图像多模态数据实现对贫血的自动化高精度识别。
盛津芳 · Muhammad Usman, Saeed · Wang, Bin · Faisal, Z. Duraihem
Visual Computing for Industry, Biomedicine, and Art 2024
提出的AlexNet多重空间注意力模型在贫血检测数据集上达到了99.58%的准确率,超越了传统机器学习模型。
结合文本和图像数据的集成方法优于单一模态,表明多模态信息互补提升了检测性能。
消融实验证实了蓝绿红、多重和空间注意力等关键组件对模型性能的贡献。