跨场景泛化避碰
通过因果表征学习,本品的避碰能力可推广到训练未见的新场景。
76745435 · 78103256 · 78103257 · Lin, Che · Zhuang, Jiafan · 李文姬 · 郝志峰 · 范衠
International Conference on Big Data and Information Analytics, BigDIA 2024
通过因果干预忽略与强化学习任务无关的变化因素,使学到的表征只保留影响决策的因果信息,从而在未见场景中仍能正确避碰。
在不同测试场景的广泛测试中,所提方法的泛化结果优于现有最先进方法,证明其鲁棒性。