推荐广告召回阶段正负样本构建

1. 学习精排的序

为了保证推荐系统全链路的一致性，在召回阶段常常会学习精排的序，即把精排排在前面的item作为正样本，排在后面的item作为副样本，还可以补充一部分未来进精排的item作为easy负样本。

这里也可以采用point-wise和pair-wise两种建模方式，如果采用pair-wise建模，可以把排在前面的item label置为5，排在中间的item labell置为3，排在后面的item label置为1

2. inbatch采样

参考YouTube的这篇论文《Sampling-Bias-Corrected Neural Modeling for Large Corpus Item Recommendations》，一个batch内都是由正反馈的user-item组成，即只有正样本，可以把其它batch内其它user的正反馈样本作为当前user的负样本，但是这样采样可能会对热门item造成打压（因为热门item容易被采样为负样本），所以YouTube提出可以流式的估计每个item的采样频率，然后用这个频率去纠偏。YouTube在这篇论文中采用了softmax作为多分类来计算，也可以采用sigmoid作为二分类来计算

posted @ 2023-06-06 11:55 xd_xumaomao 阅读(248) 评论(0) 编辑收藏举报

刷新页面返回顶部

登录后才能查看或发表评论，立即登录或者逛逛博客园首页

【推荐】还在用 ECharts 开发大屏？试试这款永久免费的开源 BI 工具！
【推荐】国内首个AI IDE，深度理解中文开发场景，立即下载体验Trae
【推荐】编程新体验，更懂你的AI，立即体验豆包MarsCode编程助手
【推荐】抖音旗下AI助手豆包，你的智能百科全书，全免费不限次数
【推荐】轻量又高性能的 SSH 工具 IShell：AI 加持，快人一步

相关博文：

· 《Sampling-Bias-Corrected Neural Modeling for Large Corpus Item Recommendations》论文阅读

· 对比学习《Self-supervised Learning for Large-scale Item Recommendations》

· 召回和粗排负样本构造问题

· 推荐系统--负样本采样--负样本采样偏差--Sample Selection Bias

· 关于推荐系统中召回模块建模采样方式的讨论

阅读排行：
· 被坑几百块钱后，我竟然真的恢复了删除的微信聊天记录！
· 没有Manus邀请码？试试免邀请码的MGX或者开源的OpenManus吧
· 【自荐】一款简洁、开源的在线白板工具 Drawnix
· 园子的第一款AI主题卫衣上架——"HELLO! HOW CAN I ASSIST YOU TODAY
· Docker 太简单，K8s 太复杂？w7panel 让容器管理更轻松！

历史上的今天：
2020-06-06 linux 中的 exec 函数族
2020-06-06 linux中的fork函数
2020-06-06 linux进程相关命令
2020-06-06 linux网络配置相关命令
2020-06-06 linux用户相关命令
2020-06-06 linux磁盘管理相关命令
2020-06-06 linux文本查找相关命令

公告

昵称： xd_xumaomao
园龄： 5年9个月
粉丝： 1
关注： 0

<

2025年3月

>

日

一

二

三

四

五

六

23

24

25

26

27

28

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

16

17

18

19

20

21

22

23

24

25

26

27

28

29

30

31

1

2

3

4

5

随笔档案

阅读排行榜

推荐排行榜

最新评论

1. Re:Weighted LR （WCE Weighted cross entropy）
@gxxxxxxl 是的，第三行最右边是y'...
--xd_xumaomao
2. Re:Weighted LR （WCE Weighted cross entropy）
倒数第二张图的公式推导有问题吧，第三行的 y' 就开始少了，对吗？
--gxxxxxxl
3. Re:ListNet和ListMLE
@葡萄和咖啡是的，不小心写错了，感谢指正...
--xd_xumaomao
4. Re:ListNet和ListMLE
博主你好，请问你的例子里面是不是应该是三个排列的概率相乘而非相加呢？
--葡萄和咖啡
5. Re:对比学习《Self-supervised Learning for Large-scale Item Recommendations》
@dddddddddsdf 按论文说的，应该是先按互信息把特征分成两个集合：集合1和集合2，样本1是mask集合1中的特征+dropout得到的，样本2时mask集合2中的特征+dropout得到的，...
--xd_xumaomao