无模型光学训练算法

免建模、训练更稳更快

用PPO强化学习直接在物理系统上训练衍射光学处理器,省去精确建模,适合实验现场优化。

Li, Yuhang · Chen, Shiqi · Tingyu, Gong · Ozcan, Aydogan

Light: Science and Applications 2026

技术优势

无需系统建模

直接在物理系统上训练,自然适应未知的真实世界缺陷,省去先验知识获取与建模步骤。

收敛更稳更快

PPO高效复用原位测量数据并约束策略更新,实现比现有方法更稳定、更快的收敛。

多任务表现更好

在多种原位学习任务中均表现出更好的收敛性和性能,包括能量聚焦、图像生成、像差校正和图像分类。

应用场景