Routing Distilled Knowledge via Mixture of LoRA Experts for Large Language Model based Bundle Gen...

文章总结与翻译

一、文章主要内容

本文聚焦大型语言模型(LLMs)在自动商品组合生成(Bundle Generation)任务中的应用痛点——虽有潜力但计算成本高昂,且直接融合教师LLM蒸馏的不同类型知识会引发知识冲突、降低模型性能。为此,作者提出RouteDK框架,核心内容如下:

  1. 知识蒸馏阶段:从教师LLM中提取两种互补知识——高层知识(可泛化规则,如“每个组合至少包含2件商品”)和细粒度知识(会话特定推理,如“购买GPU、CPU和主板的用户通常在组装高性能电脑”)。
  2. 专家设计阶段:构建3个基于LoRA的专用专家模块,分别适配不同知识类型:基础专家(Base Expert)处理原始会话数据,高层知识专家(High-level Expert)学习泛化规则,细粒度知识专家(Fine-grained Expert)捕捉会话内个性化推理。
  3. 动态融合阶段:设计输入感知的动态融合模块,通过轻量级路由网络(Router),根据输入会话的特征在模型各层动态分配专家权重,缓解知识冲突,实现高效知识整合。
  4. 推理优化阶段:引入推理时增强模块,采用基于自一致性的测试时缩放策略(多次随机解码+多数投票),降低生成结果的方差,提升推理可靠性。
  5. 实验验证:在电子、服装、食品3个公开数据集上验证,RouteDK在精度(Precision)、召回率(Recall)、覆盖率(Coverage)等
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

UnknownBody

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值