多任务学习在推荐算法中的应用（二）_语言 & 开发_Alex-zhai_InfoQ精选文章



 写点什么

登录/注册

多任务学习在推荐算法中的应用（二）

2. 阿里 DUPN

Perceive Your Users in Depth: Learning Universal User Representations from Multiple E-commerce Tasks

多任务学习的优势：可共享一部分网络结构，比如多个任务共享一份 embedding 参数。学习的用户、商品向量表示可方便迁移到其它任务中。本文提出了一种多任务模型 DUPN：

模型分为行为序列层、Embedding 层、LSTM 层、Attention 层、下游多任务层。

❶ 行为序列层：输入用户的行为序列 x = {x1,x2,…,xN}，其中每个行为都有两部分组成，分别是 item 和 property 项。Item 包括商品 id 和一些 side-information 比如店铺 id、brand 等 ( 好多场景下都要带 side-information，这样更容易学习出商品的 embedding 表示 )。Property 项表示此次行为的属性，比如场景 ( 搜索、推荐等场景 ) 时间、类型 ( 点击、购买、加购等 )。

❷ Embedding 层：主要多 item 和 property 的特征做处理。

❸ LSTM 层：得到每一个行为的 Embedding 表示之后，首先通过一个 LSTM 层，把序列信息考虑进来。

❹ Attention 层：区分不同用户行为的重要程度，经过 attention 层得到 128 维向量，拼接上 128 维的用户向量，最终得到一个 256 维向量作为用户的表达。

❺ 下游多任务层：CTR、L2R ( Learning to Rank )、用户达人偏好 FIFP、用户购买力度量 PPP 等。

另外，文中也提到了两点多任务模型的使用技巧：

❶ 天级更新模型：随着时间和用户兴趣的变化，ID 特征的 Embedding 需要不断更新，但每次都全量训练模型的话，需要耗费很长的时间。通常的做法是每天使用前一天的数据做增量学习，这样一方面能使训练时间大幅下降；另一方面可以让模型更贴近近期数据。

❷ 模型拆分：由于 CTR 任务是 point-wise 的，如果有 1w 个物品的话，需要计算 1w 次结果，如果每次都调用整个模型的话，其耗费是十分巨大的。其实 user Reprentation 只需要计算一次就好。因此我们会将模型进行一个拆解，使得红色部分只计算一次，而蓝色部分可以反复调用红色部分的结果进行多次计算。

美团 “猜你喜欢” 深度学习排序模型

根据业务目标，将点击率和下单率拆分出来，形成两个独立的训练目标，分别建立各自的 Loss Function，作为对模型训练的监督和指导。DNN 网络的前几层作为共享层，点击任务和下单任务共享其表达，并在 BP 阶段根据两个任务算出的梯度共同进行参数更新。网络在最后一个全连接层进行拆分，单独学习对应 Loss 的参数，从而更好地专注于拟合各自 Label 的分布。

这里有两个技巧可借鉴下：

❶ Missing Value Layer：缺失的特征可根据对应特征的分布去自适应的学习出一个合理的取值。

❷ KL-divergence Bound：通过物理意义将有关系的 Label 关联起来，比如 p(点击) * p(转化) = p(下单)。加入一个 KL 散度的 Bound，使得预测出来的 p(点击) * p(转化) 更接近于 p(下单)。但由于 KL 散度是非对称的，即 KL(p||q) != KL(q||p)，因此真正使用的时候，优化的是 KL(p||q) + KL(q||p)。

Google MMoE

Modeling Task Relationships in Multi-task Learning with Multi-gate Mixture-of-Experts

模型 (a) 最为常见，两个任务直接共享模型的 bottom 部分，只在最后处理时做区分，图 (a) 中使用了 Tower A 和 Tower B，然后分别接损失函数。

模型 (b) 是常见的多任务学习模型。将 input 分别输入给三个 Expert，但三个 Expert 并不共享参数。同时将 input 输出给 Gate，Gate 输出每个 Expert 被选择的概率，然后将三个 Expert 的输出加权求和，输出给 Tower。有点 attention 的感觉

模型 © 是作者新提出的方法，对于不同的任务，模型的权重选择是不同的，所以作者为每个任务都配备一个 Gate 模型。对于不同的任务，特定的 Gate k 的输出表示不同的 Expert 被选择的概率，将多个 Expert 加权求和，得到 fk(x) ，并输出给特定的 Tower 模型，用于最终的输出。

其中 g(x) 表示 gate 门的输出，为多层感知机模型，简单的线性变换加 softmax 层。

本文转载自 DataFunTalk 公众号。

**原文链接：https://mp.weixin.qq.com/s?__biz=MzU1NTMyOTI4Mw==&mid=2247496333&idx=1&sn=da03f8db68e5276cffe73e090ac271ec&chksm=fbd740e1cca0c9f76da90a713311bac81e9890c1f9fd69976705e167dd30e4135db6ea297d6b&scene=27#wechat_redirect

评论

发布

暂无评论

WorkPlus移动办公系统：打造安全专属、统一业务与运营的企业门户

【Jvm】Jvm类加载机制

石臻臻的杂货铺

[Spring Framework]AOP初识

十八岁讨厌编程

aop 后端开发 9月月更

INFINI 产品更新啦 20220923

极限实验室

elasticsearch console Gateway infini 极限实验室

《软件开发的201个原则》思考：6. 低可靠性比低效率更糟糕

个人成长软件工程能力高质量

优化帮助中心需要做到以下几点

产品帮助中心在线设计

Chrome操作指南——入门篇（十二）color picker（颜色选择器）

Chrome开发者工具 9月月更

峰会倒计时1天！九位行业大咖邀您共启极速统一的数据分析新范式

2022-09-23：整数数组 stations 表示水平数轴上各个加油站的位置。给你一个整数 k 。请你在数轴上增设 k 个加油站，新增加油站可以位于水平数轴上的任意位置，而不必放在整数

福大大架构师每日一题

算法 rust 福大大

Chrome操作指南——入门篇（十三）element小技巧

Chrome开发者工具 9月月更

每日算法刷题Day16-和为S的两个数字、数字排列、二进制中1的个数

算法题 9月月更

[Javaweb]JSON

十八岁讨厌编程

json 后端开发 9月月更

跟着卷卷龙一起学Camera--LTM

企业选择局域网即时通讯软件的必要性是什么？

Chrome操作指南——入门篇（十一）network

Chrome开发者工具 9月月更

疫情时代下，线上协同办公成时下热点

远程办公企业协同办公在线设计

AI走向何方？我们在GTC 2022看到了这些趋势

关于 Angular 应用 tsconfig.json 中的 target 属性

typescript 前端开发 angular web开发 9月月更

使用 NVIDIA CloudXR 从 Google Cloud 流式传输 VR 和 AR 内容

3DCAT实时渲染

开发者有话说｜在内卷中不断成长

9月月更开发者有话说

【云原生 | 从零开始学Kubernetes】五、Kubernetes核心技术Pod

Docker 云计算云原生 k8s 9月月更

Baklib|怎样编写内嵌式的帮助文档？

产品产品经理企业帮助文档在线设计

[Spring Framework]AOP经典案例、AOP总结

十八岁讨厌编程

Java 后端开发 9月月更

Web3.0 杂谈 -#003（49/100）

培养技能、增强信心、获得亚马逊云科技认证

亚马逊云科技 (Amazon Web Services）

培训与认证

我也不想学之PHP系列（1）

吉师职业混子

金九银十必备！这份java面经让你轻松拿下45kOffer

Java 程序员面试 java面试 Java面试题

2021年中国自然语言处理软件及服务市场规模超200亿，市场保持高速增长，竞争格局远未稳定

自然语言处理市场

FAQ需要有哪些功能？哪些注意事项

产品产品经理客户服务 FAQ

速刷html一周目（上）

吉师职业混子

速刷html一周目（下）

吉师职业混子