免训练代码翻译增强
一种基于信息覆盖的示例选择方法,能将代码结构知识直接注入现有大语言模型,无需重新训练即可提升代码翻译性能。
Du, Yali · Hui, Sun · 李明
IEEE Transactions on Software Engineering 2025
通过上下文学习直接添加示例,无需修改模型架构或重新训练,即可让预训练模型利用代码结构知识。
示例选择被建模为子模最大化问题,贪心算法在多项式时间内保证 (1-1/e) 近似最优。
用AST最大子树覆盖作为信息覆盖的替代度量,比相似度和多样性组合的传统选择目标更精确。