【CTR排序】多任务学习之MMOE模型

企业开发 2022-10-03 22:55:40 阅读次数: 0

学习总结

常见的多任务模型有三种范式：
- hard parameter sharing：底部有shared bottom，然后上层用全连接层分别学习特定任务模式，但是当两个任务相关性没那么好(比如排序中的点击率与互动，点击与停留时长)，共用一套shared bottem参数的效果就可能没这么好了。
- soft parameter sharing: 这个范式对应的结果从MOE->MMOE->PLE等。没有shared bottom，而是有不同权重的不同专家tower进行组合预测。
- 任务序列依赖关系建模：如ESSM，DBMTL，ESSM2等都是属于该范式。这种适合于不同任务之间有一定的序列依赖关系。比如电商场景里面的ctr和cvr，其中cvr这个行为只有在点击之后才会发生。所以这种依赖关系如果能加以利用，可以解决任务预估中的样本选择偏差(SSB)和数据稀疏性(DS)问题
  - 样本选择偏差: 后一阶段的模型基于上一阶段采样后的样本子集训练，但最终在全样本空间进行推理，带来严重泛化性问题
  - 样本稀疏：后一阶段的模型训练样本远小于前一阶段任务
MOE混合专家模型的几个思想：bagging模型集成思想、注意力机制（不同专家的决策地位不同）、multi-head机制（多个专家即多个head，代表了不同的非线性空间）。
Multi-gate Mixture-of-Experts(MMOE)的魅力就在于在MOE的基础上，对于每个任务都会涉及一个门控网络，这样，对于每个特定的任务，都能有一组对应的专家组合去进行预测。

猜你喜欢

转载自blog.csdn.net/qq_35812205/article/details/125471739

【CTR排序】多任务学习之MMOE模型

详解谷歌之多任务学习模型MMoE(KDD 2018)

MMOE 多任务学习模型介绍与源码浅析

多任务学习之mmoe理论详解与实践

【阅读笔记】多任务学习之MMoE(含代码实现)

推荐模型复现（四）：多任务模型ESMM、MMOE

【推荐系统】多任务学习之ESMM模型（更新ing）

MMoE论文中Synthetic Data生成代码(控制多任务学习中任务之间的相关性)

多任务多目标CTR预估技术

Pytorch创建多任务学习模型

【推荐系统】多任务学习模型

深度学习之----多任务学习

多任务融合的模型

多任务模型

推荐系统遇上深度学习(十九)--探秘阿里之完整空间多任务模型ESSM

YouTube基于多任务学习的视频排序推荐系统

多任务之进程

多任务之线程

多任务学习

Tensorflow 多任务学习

【转载】多任务学习

浅谈多任务学习

Taskonomy 多任务学习

多任务学习概述

【综述】多任务学习

多任务学习（二）

多任务学习（一）

数据挖掘中的元学习与多任务学习——基于Python的多任务学习模型与元学习算法研究

ESP32学习笔记（三）之运行多任务

【阅读笔记】多任务学习之PLE(含代码实现)

今日推荐

开放签电子签章：停止新增，优化体验，前进更进（五一假期前工作）

开源日报 | 中学生开源前端动画引擎；全球首个Llama3 8B中文版开源模型；联想电脑恐出局；Linus讽刺AI炒作

“百模大战”必有一战 | 2024中国“百模大战”竞争格局分析

最强开源大模型 Llama 3 上架 Gitee AI

虽然老乡鸡开源的不是代码，但背后的原因却让人很暖心

富文本编辑器 Quill 2.0 重磅发布，特性、可靠性与开发者体验大幅提升

周排行

SVN同步出现问题

解决 nginx 出现 413 Request Entity Too Large 的问题

第一节区块链服务BaaS的总体架构以及基本模块设计的一种方案

ITeye 2013年度盘点——社区赠书书单

IDEA / git 和github 的新手使用教程史上最简单的 IntelliJ IDEA 教程史上最简单的 GitHub 教程

测试工程方法：测试用例设计综合策略

Spark优化(三)：对多次使用的RDD进行持久化

使用STM32 ST-LINK Utility 设置读保护后不能运行

exgcd 解同余方程ax=b(%n)

Android使用脚本进行多渠道打包

每日归档

更多

2024-04-22(39)

2024-04-21(0)

2024-04-20(6)

2024-04-19(5)

2024-04-18(0)

2024-04-17(5)

2024-04-16(70)

2024-04-15(42)

2024-04-14(0)

2024-04-13(119)