小数据超越20倍预训练
用专家知识监督预训练,在吸附、分离等50多项任务上以极小数据量实现优于大规模预训练模型的精度。
Lv, Zirui · 谭伟敏 · Lin, Runfeng · 杨弋 · 李巧伟 · 李晓民 · Yan, Boo · 赵东元
Nature Communications 2026
专家知识直接监督预训练,所需数据量减少近20倍,且效果优于大规模预训练模型。
在超过50个下游任务(包括吸附、分离等)上,相对误差平均降低超过20%。
在MOF、COF、分子筛等分布内和分布外材料上均展现出强泛化能力。