多LoRA融合指令微调模型

领跑开放LLM榜单

将多个独立训练的LoRA适配器以可学习权重融合,所得大语言模型在HuggingFace Open LLM Leaderboard两次位列第一,超越传统数据集融合微调。

Gao, Dehong · Yufei, Ma · Liu, Sen · Mengfei, Song · Jin, Linbo · 蒋雯 · Xin, Wang · Ning, Wei · Shanqing, Yu · Xuan, Qi · 蔡晓妍 · 杨黎斌

Knowledge-Based Systems 2024

技术优势

性能超越数据融合

多LoRA适配器融合方法有效避免任务间干扰,在实验中超越传统数据集融合微调方法。

两次登顶开放榜单

在HuggingFace Open LLM Leaderboard两次位列第一,证明模型的卓越性能。

可学习权重融合

通过可学习权重融合多个独立训练的LoRA适配器,实现灵活的多能力集成。

应用场景