多任务学习在推荐算法中的应用（三）_文化 & 方法_Alex-zhai_InfoQ精选文章



 写点什么

登录/注册

多任务学习在推荐算法中的应用（三）

阿里 ESM2

Conversion Rate Prediction via Post-Click Behaviour Modeling

前面已经介绍过一种基于多任务学习的 CVR 预估模型 ESMM，但对于 CVR 预估来说，ESMM 模型仍面临一定的样本稀疏问题，因为 click 到 buy 的样本非常少。但其实一个用户在购买某个商品之前往往会有一些其他的行为，比如将商品加入购物车或者心愿单。如下图所示：

文中把加购物车或者心愿单的行为称作 Deterministic Action ( DAction )，表示购买目的很明确的一类行为。而其他对购买相关性不是很大的行为称作 Other Action ( OAction )。那原来的 Impression→Click→Buy 购物过程就变为：

Impression→Click→DAction/OAction→Buy 过程。

ESM2 模型结构：

那么该模型的多个任务分别是：

❶ Y1：点击率

❷ Y2：点击到 DAction 的概率

❸ Y3：DAction 到购买的概率

❹ Y4：OAction 到购买的概率

并且从上图看出，模型共有 3 个 loss，计算过程分别是：

❶ pCTR：Impression→Click 的概率是第一个网络的输出。

❷ pCTAVR：Impression→Click→DAction 的概率，pCTAVR = Y1 * Y2，由前两个网络的输出结果相乘得到。

❸ pCTCVR：

Impression→Click→DAction/OAction→Buy 的概率，pCTCVR = CTR * CVR = Y1 * [(1 - Y2) * Y4 + Y2 * Y3]，由四个网络的输出共同得到。其中 CVR=(1 - Y2) * Y4 + Y2 * Y3。是因为从点击到 DAction 和点击到 OAction 是对立事件。

随后通过三个 logloss 分别计算三部分的损失：

最终损失函数由三部分加权得到：

YouTube 多目标排序系统

Recommending What Video to Watch Next: A Multitask Ranking System

本文主要解决了视频推荐场景下普遍存在的两个问题：

❶ 视频推荐中的多任务目标。比如不仅需要预测用户是否会观看外，还希望去预测用户对于视频的评分，是否会关注该视频的上传者，否会分享到社交平台等。

❷ 偏置信息。比如用户是否会点击和观看某个视频，并不一定是因为他喜欢，可能仅仅是因为它排在推荐页的最前面，这会导致训练数据产生位置偏置的问题。

模型结构：

从上图可知，整个模型需要预测两大类目标，分别是：

❶ Engagement objectives：主要预测用户是否点击和观看视频的时长。其中通过二分类模型来预测用户的点击行为，而通过回归模型来预测用户观看视频的时长。

❷ Satisfaction objectives：主要预测用户在观看视频后的反馈。其中使用二分类模型来预测用户是否会点击喜欢该视频，而通过回归模型来预测用户对于视频的评分。

模型中有两个比较重要的结构：Multi-gate Mixture-of-Experts ( MMoE ) 和消除位置偏置的 shallow tower。

MMoE 的结构为：

Shallow tower 的结构为：

通过一个 shallow tower 来预测位置偏置信息，输入的特征主要是一些和位置偏置相关的特征，输出的是关于 selection bias 的 logits 值。然后将该输出值加到子任务模型中最后 sigmoid 层前，在预测阶段，则不需要考虑 shallow tower 的结果。值得注意的是，位置偏置信息主要体现在 CTR 预估中，而预测用户观看视频是否会点击喜欢或者用户对视频的评分这些任务，是不需要加入位置偏置信息的。

知乎推荐页 Ranking 模型

上图是知乎在推荐场景下使用的多目标模型，预测的任务包括点击率、收藏率、点赞率、评论率等，共 8 个目标。可以看出知乎的做法也是底层 embedding 和 DNN 前几层权重设置成共享。损失函数可设置成这几个 task 的简单线性加权和。上线后线上性能：点击率基本不变，而其他的几个指标，比如点赞，收藏大幅提升。

美图推荐排序多任务

模型结构：

如上图，Multi-task NFwFM 模型的前几个隐层是共享的。在最后即将预估多个目标时通过全连接层进行拆分，各自学习对应任务的参数，从而专注地拟合各自任务。在线上预估时，因为模型尺寸没有变化，推理效率和线上的点击率预估模型一致。考虑到我们是在点击率任务的基础上同时优化关注转化率，融合公式上体现为优先按照点击率排序再按照曝光→关注的转化率排序。Multi-task NFwFM 已在美图秀秀社区首页 Feeds 推荐、相关推荐下滑流全量上线。首页 Feeds 点击率+1.93%，关注转化率+2.90%，相关推荐下滑流人均浏览时长+10.33%，关注转化率+9.30%。

小结

当我们在推荐场景需要同时优化多个目标时，多任务学习就可以派上用场。那反过来思考一个问题，在什么样的情况下，多任务学习会没效果呢？其实也很容易想到，当多个任务的相关性没那么强时，这些任务之间就会相互扰乱，从而影响最后的效果。

最后总结下现在多任务学习模型的主要使用方式：

❶ 底层 embedding 和 mlp 参数共享，上层演化出各个任务的分支，最后 loss 函数是各个任务的简单加权和。

❷ 通过多任务之间的关系来建模出新的 loss 函数，比如阿里的 ESSM，ESSM2。

❸ 通过 Multi-gate Mixture-of-Experts ( MMoE ) 这种特殊的多任务结构来学习出不同任务的权重，比如 YouTube 的多任务模型。

参考链接：

https://arxiv.org/pdf/1804.07931.pdf

https://www.jianshu.com/p/35f00299c059

https://arxiv.org/pdf/1805.10727.pdf

https://www.jianshu.com/p/aba30d1726ae

https://tech.meituan.com/2018/03/29/recommend-dnn.html

https://zhuanlan.zhihu.com/p/70940522

https://arxiv.org/abs/1910.07099

https://www.jianshu.com/p/c06e9ed08dd1

https://www.jianshu.com/p/2f3dbbfc16a6

https://zhuanlan.zhihu.com/p/89401911

知乎推荐页 Ranking

原文链接：

https://zhuanlan.zhihu.com/p/78762586

https://zhuanlan.zhihu.com/p/91285359

本文转载自 DataFunTalk 公众号。

原文链接：https://mp.weixin.qq.com/s?__biz=MzU1NTMyOTI4Mw==&mid=2247496333&idx=1&sn=da03f8db68e5276cffe73e090ac271ec&chksm=fbd740e1cca0c9f76da90a713311bac81e9890c1f9fd69976705e167dd30e4135db6ea297d6b&scene=27#wechat_redirect

评论

发布

暂无评论

博文推荐｜深入解析Apache BookKeeper 系列：第一篇 — 架构原理

开源架构云原生中间件 Apache Pulsar

ReactNative进阶（二十四）：react-native-scrollable-tab-view 标签导航器组件详解

No Silver Bullet

1月月更 ReactNative 标签导航

HarmonyOS工程【鸿蒙开发02】

鸿蒙开发 1月月更

从零开发区块链应用(四)--自定义业务错误信息

杰哥的技术杂货铺

web技术分享| 白板SDK之函数和方程式的运用

anyRTC开发者

前端音视频视频会议白板 web技术分享

Spring中部署Activiti流程定义的三种姿势

华为云开发者联盟

spring 工作流 Activiti流程 Activiti框架 Activiti Explorer

基于 Prometheus 的边缘计算监控实践

火山引擎边缘云

云原生监控边缘计算

一个cpp协程库的前世今生（二十）外部调度

使用 google_breakpad 分析 Electron 崩溃日志文件

Electron 1月月更 google_breakpad

社区知识库｜常见问答 FAQ 集合第 2 期：Topic 配置、ACK 等问题的解决

架构云原生 Apache Pulsar 开源社区消息中间件

设计模式【11】-- 搞定组合模式

秦怀杂货店

Java 组合模式

从零开发区块链应用(一)--golang配置文件管理工具viper

杰哥的技术杂货铺

golang 区块链

博文推荐｜Apache Pulsar: 统一消息流平台

开源云原生 broker Apache Pulsar 消息中间件

Spring都在用的技术，你确定不过来看看？1️⃣

从零开发区块链应用(二)--mysql安装及数据库表的安装创建

杰哥的技术杂货铺

(1-15/15) 预训练模型+微调范式下如何做到文本数据安全

300天创作 2022Y300P

1月月更|推荐学java——Spring集成MyBatis

mybatis ssm Spring Framework spring aop spring+mybatis

2022AJAX常见面试题分享

社区知识库｜常见问答 FAQ 集合第 4 期：消息保留及延迟、Broker、Pulsar 权限等相关问题

架构云原生开源社区消息中间件 Apachepulsar

Tcp网络模型

只有天空才是你的极限，我们热爱探索的过程并沉浸其中丨图数据库 TiMatch 团队访谈

网关流控利器：结合 AHAS 实现 Ingress/Nginx 流量控制

阿里巴巴云原生

nginx 阿里云高可用云原生 ingress

谈A股投资策略--《香帅中国财富报告》摘录（5/100）

鸿蒙开发初体验【鸿蒙01】

鸿蒙 1月月更

模块 5 作业

Go 语言快速入门指南：Go 结构体

宇宙之一粟

Go 语言结构体 1月月更

从零开发区块链应用(三)--mysql初始化及gorm框架使用

杰哥的技术杂货铺

社区知识库｜常见问答 FAQ 集合第 3 期：Topic 数量、Broker 设置等相关问题

分布式云原生 Apache Pulsar 开源社区消息中间件

HTTP跨域小结

nginx HTTP cros

SIG技术直播来了！技术专家教你，如何使用 iLogtail 采集可观测数据？

OpenAnolis小助手

Linux 开源数据直播采集

低代码实现探索（二十四）业务的领域可视化构思

零道云-混合式低代码平台