Paper Reading
354 papers
📅 2026-09-29
18 篇 · 精读 2
长序列与生成式推荐提效,反馈信号测量纠偏
本期 18 篇(含 3 篇晚公告的早前提交):LLM 5、生成式推荐 4、判别式 3、其他 6;工业 1 篇,精读 2 篇。Google/YouTube 的 FLVM 把观看、点赞、点踩、问卷视为潜在价值的带噪测量,以 stop-gradient 基线吸收时长等混杂,Shorts 14 天 A/B 主指标 +2.67%,但模型、标签与打分公式一并替换、无消融,去混杂也无外部标尺验证。清华/天大的 ...
📅 2026-09-28
22 篇 · 精读 5
工业推荐服务侧改造:真实收益多不在标题部件
今日 22 篇(精读 5),含一批 arXiv 延迟公告、此前漏收的 9 月 13–24 日提交;LLM 9、判别式 7、生成式 5、其他 3,工业学术各半。五篇工业精读读后均下调:腾讯 KuaFu 的 item 级可缓存压缩扎实,但 GMV +1.37% 来自腾出的更长历史与更快刷新;Shopify T-RoPE 在带时间 RAB 的 HSTU 上仍有增益,但主要来自多尺度时间戳 RoPE,独有...
📅 2026-09-25
8 篇 · 精读 2
生成式推荐在 SID 离散码与连续向量之间取舍
今日 8 篇:生成式推荐 4、判别式 2、LLM 2,工业 3、学术 5。字节 TikTok 的 X-Rec 用球面流匹配在连续物品向量上采样触发器接 ANN,同骨干下 R@20 略胜 SID 自回归、生成吞吐 3.46×(不含 ANN),但 R@50 反输;去掉离散 anchor 即跌破对照,线上对照是无此召回源的现网而非 SID 召回。阿里国际 CMRec 在共享码本上做跨国序列替换并加权,同...
📅 2026-09-24
6 篇 · 精读 2
编码一次多处复用:推荐级联共享主干与 KV 不变扩参
今日 6 篇(判别式推荐 3、LLM 2、生成式推荐 1、其他 1),工业署名 2 篇,精读 2 篇。字节 OneTrans-V2 把召回、粗排、精排作为一个 Transformer 的三个任务联合训练,但服务仍跑三级级联,共享的只是一次序列编码、一套参数和一个训练作业,是共享主干而非替换级联。线上 GMV/u +9.74% 的对照是整条旧级联,混合了 2.4× 算力、MoE/μP 等 scali...
📅 2026-09-23
2 篇 · 精读 0
双曲残差量化与 LLM 用户模拟器的评估可靠性
今日仅 2 篇论文,均为学术界工作、类别为 other,都只有摘要级简读、无精读,信息量有限。第一篇提出几何感知的双曲残差量化:前向用双曲残差聚合在 Poincaré 球上恢复残差量化的逐级叠加性,反向用带折扣的双曲直通估计器稳定梯度,在层次预测、推荐、图像分词和音频编码上提升了双曲残差码的稳定性与层次结构,但纯压缩场景下欧氏 RQ 仍更优。第二篇发现 LLM 用户模拟器的“活跃度”特质会渗入偏好...
📅 2026-09-22
8 篇 · 精读 4
工业推荐扎堆上线,收益难归因到所提机制
今日 8 篇:4 篇精读、4 篇仅摘要,生成式 4 篇、判别式 3 篇,四篇精读全是工业论文(百度 ×2、Google、Netflix)。百度 UNIQUE 用同容量 16,384 单层平坦码本替换 128×128 分层 RQ 码本,工业码本资源方差 1510.85→389.57,三场景全量 A/B 时长 +0.96%,但四个消融中三个单独移除即跌破最强 baseline。百度 MuSeR 在 M...
📅 2026-09-21
6 篇 · 精读 1
落地约束下的效率取舍:MoE 物化解耦与轻量化建模
今日 6 篇:生成式推荐 1、判别式推荐 2、LLM 2、其他 1;仅 1 篇来自工业界(阿里高德 DreamX),也是当日唯一精读。IntBMoE 把 MoE 拆成参与度、执行量、物化量三量,用学习码本与共享超网络把整池专家基组合成与输入无关的 block,离线缓存后请求时成本不随专家数增长,在高德首屏 POI 推荐以平均 19ms、P99 38ms 全量上线;但线上 +2.4% UVCTR 的...
📅 2026-09-18
3 篇 · 精读 0
三篇简读:agent 选数据、几何图 RAG 与画像推荐复现
今日仅 3 篇,全部为简读、无精读:LLM 类 2 篇、判别式推荐 1 篇,均为学术工作,是偏轻的一天。AutoData(学术)让 LLM agent 在可执行的打分与采样程序空间中搜索预训练数据筛选配方,借小代理模型反馈迭代,一夜所得配方超过人工清洗流水线并可迁移到更大规模。G3RAG(学术)零 LLM 调用、仅用文档嵌入建图,以几何增益兼顾相关性与新颖性,在三个多跳 QA 基准上较图类 RAG...
📅 2026-09-17
6 篇 · 精读 3
增量叠加式改造:真正的杠杆常不在署名机制
本期 6 篇:生成式推荐 3、判别式 2、LLM 2(有交叉),工业 2 篇,精读 3 篇。腾讯 ANGLE 用意图×摘要文本标识做搜索广告召回,作补充通道上线,消耗 +1.81%,但无 SID 对照,优势多来自约束解码。Meta LIGE-GR 在排序栈上叠因果注意力与束搜索、可回退,Reels 时长 +1.14%,加宽束仅 +0.05%,改目标才见效。Q Labs 的 Untied-Grow ...
📅 2026-09-16
6 篇 · 精读 0
改模型的没上线,上了线的没改模型:本期零精读
当日 6 篇(判别式 2、LLM 2、生成式 1、其他 1;工业 2),零精读:唯一够线的 QueryFormer(7 分)被 deep_read_rec_requires_industry 拦下。它以交叉注意力取代投影 MLP 生成 query,夺 UniRec 工业赛道第一,但 H 扫到 8 验证 AUC 仅 +0.00075,无线上。ReliGRec 的提示路由靠评论代理标签,LimiX-2...
📅 2026-09-15
12 篇 · 精读 4
工业推荐的收益归因:对照组决定结论成色
当日 12 篇(4 精读):生成式推荐 5、LLM 4、判别式 2、其他 2,工业仅阿里、Netflix。淘天 VARG 的价值序 SID 绕开粗排,GMV +1.45%,但 Prefix-GRPO 仅占 RL 增益 11.7%,真价值在冻结槽位日更。阿里 LazFormer 的零初始化适配器:Direct/PreProj 对照证明融合方式比迁移与否关键;非对称多轮较 1 epoch 仅 +0.2...
📅 2026-09-14
9 篇 · 精读 3
三重压缩:长序列、解码状态与词表的开销重分配
当日 9 篇(3 精读):推荐 3、LLM 1、其他 5,工业仅腾讯快手。Meta FAIR 与 UW 以 <eot> 吸收残余概率质量,单次前向精确转出字节分布,logit 存储压到 261 维,并指出 BPB 跨分词不可比。腾讯 ChronicleRec 把终身用户建模改为候选无关预训练,查询 token 因果交织锚定时序,55 个可缓存 token 取回九成全注意力增益,广告 A/B GMV...
📅 2026-09-11
2 篇 · 精读 0
工业推荐发力模型之外:跨阶段融合层与实验流程自动化
当日入库 2 篇,判别式推荐与 LLM 各 1 篇,均出自工业界,评分 6 与 5,本期无精读。快手 UniRec 把粗排与精排的多目标融合模块放进同一计算图联合训练,并以停梯度 teacher 回传下游偏好,已全量部署、线上使用时长 +0.616%;但消融中收益最大项仍是常规后验 reward loss,跨阶段对齐项移除后排序指标不变,且消融与公开基线分处两套数据集。Meta 的 Auto-Re...
📅 2026-09-10
2 篇 · 精读 0
合成数据的两阶段课程与托攻击的骨干依赖
今日 2 篇,均为摘要归档。人大与港大把合成数据的强模型崩塌推进到一遍 SGD 的有限样本动力学,证明混合训练留下不可消的风险地板,而合成在前、真实在后的两阶段课程能让风险继续随数据下降;CIFAR10 与 WikiText-103 三档 Transformer 复现同一规律:模型越大,混合下受合成数据的伤害越重。它有真实验证,但解释的是既有实践、未提新方法。另一篇让一组 LLM 角色协同发起托攻...
📅 2026-09-09
7 篇 · 精读 3
扩容三连:宣称扩的那根轴有没有被真正扫过
今日 7 篇(llm 与 generative-rec 各 3、discriminative-rec 1;5 工业 2 学术),3 篇精读都在扩容,分野是宣称的那根轴有没有被真正扫过。字节 SequenceO1 是唯一扫过的:低秩 sketch 把 100K 历史压成目标无关的可缓存定长表示,抖音双端全流量替换 TWIN V2、跑满一个月 A/B,10k 到 85k 四个实测点未见饱和,同 1K×...
📅 2026-09-08
8 篇 · 精读 2
机制被断言与机制被测量:统一排序骨干对照召回标度律
本日 8 篇:判别式推荐 3、LLM 1、其他 4,1 工业 7 学术,2 篇精读。今日的对照是机制被断言与被测量。陌陌 MORE 把 Private Anchor 与任务边界掩码搬进统一骨干,七任务全胜、A/B 六项 p<0.05 已上线、P99 降 30%,工程扎实;但消融折回主表口径后,全消融底座 +0.41% 低于 OneTrans 的 +0.54%,对公开骨干增量仅约 0.2 个点,且多...
📅 2026-09-07
7 篇 · 精读 2
工业推荐的自我举证难题:消融与算术加总撑不住主张
今日 7 篇、2 篇精读,llm 占 5 篇,工业侧仅网易与华为。两篇精读栽在同一处:主张所依的数字经不起论文另一处的对照。华为 PTDG 把任务依赖改成实例级可学的低秩拓扑,日活过亿平台的 A/B 是真的;但相对最强公开基线 PMTRec 的全部优势仅 +0.68%,而去个性化、去 GCN、去因果掩码三个消融变体全部跌破 PMTRec,每项损失单独大过总优势;主打的信号侵蚀断言 12 次却从未测...
📅 2026-09-04
9 篇 · 精读 2
度量自指:工业推荐用被自己优化的尺子做证明
今日 9 篇、2 篇精读:判别式推荐 1、生成式推荐 2、LLM 3、其他 3,工业署名仅 2 篇。两篇工业论文的问题落在同一处:证明主张的那把尺子,本身就是被优化的目标。美团 UniCon 把 CTR 统一建模的单位从 token 换成“上下文单元”,一年期生产数据、7 天 20% 流量 A/B(RPM +3.09%、CTR +2.07%)与编译式 C++ 运行时都很扎实;但直接检验命名主张的两...
📅 2026-09-03
7 篇 · 精读 2
工业署名不等于工业证据:大厂推荐论文的叙事与证据落差
今日 7 篇、2 篇精读:判别式推荐 3、LLM 2、生成式推荐与其他各 1,仅高德与 Meta 两篇工业署名。两篇都自称有工业价值,精读却双双下调其证据强度:看点在「工业署名不等于工业证据」。SPAR(高德)把空间感知贯穿 SID 构造、CPT 与 SFT,空间信号整体贡献 23%–37% 属实;但它与同团队两天前的 HF-SID 五作者重叠却互不引用,两条空间编码路线相反,且只有 HF-SID...
📅 2026-09-02
9 篇 · 精读 3
工业规模化的三把尺子:替换边界、营收口径与算力匹配
今日 9 篇、3 篇精读,推荐 4 / LLM 5,工业居多。三篇精读都在做规模化,共同点是「口径」而非结论。腾讯 PCG 的 TGR 以 CCFormer、BARGE、HiGR、TGR-Reason 四块逐块替换级联,均有生产 A/B,但首条局限自承「仍是一摞耦合模型,还不是一个模型」;对照 Yandex SONA 用单模型替掉 15+ 召回器与粗精排,两者却收敛到同一句:省下的成本来自容量花在...
📅 2026-09-01
19 篇 · 精读 6
语义 ID 与 ANN 双线会师:先修表示,不修量化器
今日 19 篇(覆盖 08-29~08-31):生成式 6、判别式 6、LLM 4、其他 3,6 篇精读,近一月最大一期。主线是量化线的罕见会师:高德 HF-SID 把 SID 的病根从码本设计移到送进量化器的那个嵌入本身——tokenizer 把经纬度切成数字子 token,连续性在量化之前就没了,下游网格或聚类都救不回;量化器零改动(三层 K-means、同码本、同长度),Hit@200 的 ...
📅 2026-08-31
4 篇 · 精读 1
工业排序换用 latent hub 交互,收益归因被消融推翻
今日 4 篇:判别式推荐 3 篇、LLM 1 篇,仅 1 篇精读。主线是快手+清华的 HubMixer,用 16 个可学习 latent hub 把异构特征 token 的全对全混合折成归纳-交互-读出三段式,在 10 亿样本的招聘排序上四目标 AUC 全胜且参数更少,7 天 7.2% 流量 A/B 简历投递 CVR +5.48% 已全量部署。但精读把自动评分从 8 压到 6:论文自身消融里,去掉...
📅 2026-08-28
9 篇 · 精读 2
在线延迟约束下的重活外挪:离线刷新与权重内化
今日 9 篇:判别式推荐 4 篇、生成式 2 篇、其他 2 篇、LLM 1 篇,仅 2 篇精读且都来自工业界。两篇不同源——一个社交好友召回、一个电商图搜生成式检索——却撞上同一条约束:离线可以很重,在线必须很轻;分歧只在把重活挪去哪。AI VK 的 VK-GNN 挪到离线刷新:194M 用户 / 28B 边的好友图上,multi-hash 把 ID 嵌入表从 202.88GB 压到 2GB 且 ...
📅 2026-08-27
7 篇 · 精读 2
工业推荐 Transformer 扩容:事件 token 化与判别式召回的互斥押注
今日 7 篇:判别式推荐 4 篇、生成式 1 篇、其他 3 篇,仅 2 篇来自工业界,却恰是同一问题的两种互斥押注——工业推荐 Transformer 想扩容,卡在每候选算力预算与异构特征的 token 统一。Meta 的 AMBER 把每个事件数百个异构特征压成 1 个连续稠密 token 并对齐 Llama 嵌入空间,提出 snapshot resolution 这一新扩容维度,靠异步 tok...
📅 2026-08-26
10 篇 · 精读 6
语义 ID 残差量化的路线分歧与工业推荐对齐
今日 10 篇:生成式推荐 4 篇、判别式推荐 5 篇、LLM 1 篇,工业与学术各 5 篇,其中 6 篇精读。罕见的是一组三方对照:清华与腾讯的 Tlow 用 Glow 式可逆流把语义嵌入掰成标准正态,就此离开残差量化、改用最朴素的 PQ 并行解码;快手 PRQ-KMeans 把病根定在层间传递算子——全码字相减留下残差夹带,遂用带正交约束的投影残差留在层级里修;而 8 月 21 日快手的 Dy...
📅 2026-08-25
11 篇 · 精读 4
生成式推荐回到 item 表示,工业侧用显式先验治干扰
今日 11 篇:生成式推荐 6 篇、判别式 2 篇、LLM 与其他各 2 篇;四篇精读均出自有线上系统的公司(SK Telecom、Spotify、美团、阿里),其余 7 篇为无部署的学术工作。DuELRec(SK Telecom)把 LLM 跨域负迁移归因于 token 级自回归压过 item 级协同信号,以块级 item 掩码派生单域与跨域双专家再门控融合,线上相对 SASRec 变体 CTR...
📅 2026-08-24
4 篇 · 精读 2
Semantic ID 双线工业实践:重构码本结构与跨系统复用层次
今日仅 4 篇入选,规模偏小:生成式推荐 1 篇、判别式推荐 3 篇,其中 2 篇为已上线的工业工作,另 2 篇为学术研究。快手的 Dynamic PV-S2 从 SID 结构本身下手:线上三级 SID 的第二级语义码条件利用率仅 2.48%,改用单层大语义码本加一位恒定哈希消歧码,自回归解码由三步降至两步,解码 FLOPs 降约 48%,5 天 2.5% 流量 A/B 主消费指标 +0.792%...
📅 2026-08-21
8 篇 · 精读 2
训练与检索降本:廉价结构化信号替代大模型计算
今日 8 篇:llm 2 篇、generative-rec 3 篇、discriminative-rec 4 篇(有交叠),其中仅 2 篇出自工业界并做了精读,其余 6 篇为学术工作。Kakao 的超参迁移框架用适配 MLA 与 Muon 的 μP 消掉模型规模维、以 log-log 回归外推 token 维,把二维学习率搜索降为一维,并用外推值从零预训练 155B 总参/17B 激活 MoE、全...
📅 2026-08-20
7 篇 · 精读 3
推荐排序工业落地三线:统一底座、LLM 蒸馏与延迟预算
今日 7 篇:判别式推荐 3 篇、生成式推荐 2 篇、LLM 与其他各 1 篇;3 篇精读全部是已上线的工业系统,且两篇同出小红书。OneModel(小红书)用场景私有投影把推荐、广告、商家三条流并成一条事件序列,配场景门控与用户状态增量缓存,稠密参数增三成而延迟由 270ms 降到 90ms;但其“scaling”主张只有单点邻域敏感性支撑,论文本身仍是模板占位符状态的未评审预印本。GateDi...
📅 2026-08-19
3 篇 · 精读 1
端到端生成式 slate 推荐落地,兼看紧凑 LLM 与 agent 委托
今日仅 3 篇入库,是个小日子:工业 1 篇、学术 2 篇,生成式推荐、判别式推荐与其他各 1 篇,精读只有 1 篇。重点是快手 OGR,把 slate 推荐从先生成再排序的级联改成端到端一次生成即有序:TUSID 将多模态语义与置信度加权的局部共现协同融合后量化成统一 SID,GL2P 让偏好规划器与位置级 SID 解码流水线重叠,串行深度由 O(KD) 降到 O(K+D),SPA 再做 sla...
📅 2026-08-18
11 篇 · 精读 2
排序模型之外发力:上游候选过滤与跨域统一用户表征
本日 11 篇,属周末合并批次、覆盖三天投稿:判别式推荐 4 篇、LLM 3 篇、生成式推荐 2 篇、其他 2 篇,工业系统 3 篇,余者多为学术,2 篇精读。SDF(Google Discover)把「陈旧性」拆成机制不同的「取代」与「衰减」,分别用 PaLM 2-L 蒸馏的成对分类器与多模态流量比回归识别;两者均非个性化、在用户请求路径外算好、服务时只查表,于排序上游剪枝候选,故不产出 CTR...
📅 2026-08-17
6 篇 · 精读 0
无线上部署的学术日:机理诊断、过程监督与新基准三线并行
今日 6 篇:LLM 2、生成式推荐 1、判别式推荐 1、其他 2,全部为学术工作、无线上部署,无一篇精读。评分最高的 EchoRec 把生成式推荐里的 MTP 从效率技巧改造成稠密监督:未来行为携带当前行为的“语义回声”却随视界衰减,故以视界感知偏好生成串接辅助分支,再由可验证整体偏好对齐经循环一致投影回射,理论上排除秩坍缩式虚假对齐,脚手架推理期丢弃。另一篇把因果自注意力推荐器的末位 item...
📅 2026-08-14
7 篇 · 精读 2
训练动力学极小模型与工业排序去噪的双线分野
今日 7 篇:判别式推荐 4、生成式推荐 1、其他 2,仅快手一篇有线上部署,两篇精读方向差异极大。NQF(MIT+EPFL)仅从层内单元的置换对称性推出:任何有宽度的模块在近零初始化附近的领头项唯一是 Tr[WW^T A(x)],架构只活在结构矩阵中;其动力学闭合于序参量,归约为广义 Lotka-Volterra 方程后各模式按 logistic 曲线逐个点火形成平台期,幂律谱又把这些点火叠加成...
📅 2026-08-13
6 篇 · 精读 1
训练信号精细化:超参调优前沿与 token 级信用分配
今日 6 篇:LLM 2、判别式推荐 2、生成式推荐 2,无一涉及线上系统。评分最高的 Small-Scale Experiments 出自 FAIR at MSL Meta 与纽约大学,它把“小规模 scaling law 不可靠”的病因从规模改判为超参:约 4000 次 run 表明律一直延伸到 4M 有效参数,却只在完全调优前沿显形——每规模 4 个配置时测试 MSE 为 1.30e-2,到...
📅 2026-08-12
11 篇 · 精读 4
真实约束重塑最优解:单模型化、系统感知与分组校准
今日 11 篇:判别式推荐 5、LLM 3、生成式推荐 2、其他 1;4 篇精读中 3 篇出自工业界(Yandex、Amazon、Meta),其余以学术工作为主。SONA 是 Yandex Music 的单模型生成式推荐器,也是已归档 Gryphon-v2 的系统级后继(后者的线上 A/B 即 SONA 的第 4 组实验),靠 History Compression 把 8192 事件历史塞进服务...
📅 2026-08-11
14 篇 · 精读 6
工业推荐的控制层转向:LLM 生成可执行策略而非物品序列
本批合并 8 月 8 日至 10 日三天共 14 篇,6 篇精读、8 篇仅存摘要;生成式推荐 6 篇、LLM 5 篇,精读名额全部被有线上验证的工业论文占据。高德 IntHQ 把多任务生成式推荐诊断为来源、关系、层级三重坍缩,以双流解耦与分层查询对治,全量上线 UVCTR 相对提升 1.60% 且 FLOPs 低于所有基线。淘宝 MetaStrategy 让 LLM 生成受 schema 约束的可...
📅 2026-08-10
5 篇 · 精读 3
把重计算挪到离线:超长序列蒸馏、标度律与后训练对齐
今日入库 5 篇,3 篇精读、2 篇仅摘要归档;生成式推荐 3 篇、判别式推荐 2 篇、LLM 1 篇,工业 3 篇、学术 2 篇。ByteDance 的 TM20K 把电商广告行为序列推到 20K:教师保留全量 token 一次性训练并缓存 logits,学生用 LITM、PATM、LPTM 三种零参数 token merge 把平均长度从 8.8K 压到 1.8K,再靠蒸馏找回教师约 85% ...
📅 2026-08-07
6 篇 · 精读 1
统一模型与智能体重构推荐检索链路,兼论可审计性
今日 6 篇:生成式推荐 1、判别式推荐 1、LLM 4;仅 Yandex 有公司署名,精读只有 Gryphon-v2,另 5 篇止于速览。Gryphon-v2 在共享 encoder 的 generate-and-rank 架构上提出 Rollout Distillation:训练期专用的 Teacher Ranker(8,000 事件上下文、免特征)为当前 decoder 同步生成的 on-p...
📅 2026-08-06
5 篇 · 精读 2
工业排序的价值定义之变:跨请求探索与延迟信号分离
今日入库 5 篇,2 篇精读、3 篇仅存摘要;类别上生成式推荐与判别式推荐各 1 篇、LLM 2 篇、其他 1 篇,工业色彩浓厚,仅 1 篇纯学术。京东的 DEGR 把重排的价值定义从即时收益扩到跨请求探索:以上游 Max-pCTR 作为供给质量代理,实证它与“下一请求点击率”基本解耦,据此训练探索型奖励模型,再用自适应奖励加权 ORPO 驱动生成器,线上只部署生成器做单次贪心解码,京东首页 7 ...
📅 2026-08-05
6 篇 · 精读 3
语义 ID 下沉为系统骨架,扩散 MoE 立 scaling 律
当日 6 篇:判别式推荐 3 篇、LLM 2 篇、生成式推荐与其他各 1 篇,工业界(快手、蚂蚁)与学术各半,精读 3 篇。快手 UniGD 把自回归 SID 生成与显式相关性打分统一进同一 decoder-only 骨干,用 CAGE 在梯度层面协调两个目标,以单模型替掉线上级联,一周 A/B 广告收入涨 5.78%、检索延迟降 33%;但其公开集对比并不对等——基线只按生成似然排序,它却在 b...
📅 2026-08-04
13 篇 · 精读 5
生成式推荐工业化:预训练刷新、离线后训练与服务加速
当日 13 篇,生成式推荐 7 篇、判别式 4 篇,5 篇精读清一色出自工业界。Shopee 与厦大的 KGD 把预训练知识与下游几何拆给两个参数所有者,读侧 stop-gradient、写侧用锚定预训练嵌入的正交低秩残差,让 encoder 每日刷新而不失效下游适配,线上单用户 GMV 提升 1.75%;反直觉的是共享参数下每日刷新是负收益,甚至低于完全不预训练。快手 HRPO 沿 SID 前缀...
📅 2026-08-03
7 篇 · 精读 4
工业推荐的高效建模与自适应演进
今日共收录 7 篇论文,判别式 5 篇、生成式 4 篇(部分跨类),工业 4 篇、学术 3 篇,主线聚焦高效建模、行为对齐与自动演进。
LinkedIn 的 TransX 把长期行为编码离线化,在线只保留候选特定的稀疏交叉注意力聚合,点击率提升 6.0%、转化提升 4.4%,在线算力约降八成;阿里巴巴淘宝闪购的 GALA 以生成式对齐和购买奖励 GRPO 把行为目标写回冻结的多模态商家向量,再经...
📅 2026-07-31
11 篇 · 精读 6
工业界两条战线:算力效率与决策可解释
当日共 11 篇,其中 6 篇精读且全部出自工业界,无一纯学术;类别上判别式与生成式推荐各 4 篇,另有 2 篇 LLM 训练与 1 篇近邻检索。腾讯 PCG 的 CCFormer 把特征交互拆成特征域分离的定向交叉注意力与子空间 token 混合,再用 Conv1D 逐层压缩序列,训练较 HSTU 快 2.21 倍,0.5k token 即打平其 2k 效果,CTR 提升 3.57% 并已全量部...
📅 2026-07-30
14 篇 · 精读 6
生成式推荐的工业重构:解码结构与位置编码双线并进
当日 14 篇、6 篇精读,生成式推荐 4 篇、判别式 6 篇、LLM 2 篇、其他 2 篇,工业界论文主导。快手三篇分别打在生成式链路的不同层:Multi-Decoder OneRec 用共享基座加隔离 LoRA 专家与配额协同解码替换多路召回,巴西 A/B 十一项指标全正;DIRECTOR 把重排的逐位自回归换成一次并行生成连续检索索引,配容量约束最优传输与硬匹配去重,线上 VV 提升且 CP...
📅 2026-07-29
15 篇 · 精读 6
生成式检索路线之争与奖励侧判别信号注入
当日 15 篇,生成式推荐 8 篇、LLM 6 篇,判别式与其他各 2 篇,工业与学术近乎对半,其中 6 篇完成精读。最大看点是路线之争:Meta 的 The Case Against Generation for Retrieval 论证生成式检索在 web 规模属架构错配,改用 LLM 做判别式双塔,0.6B 学生反超 8B 的 OneRec-Think,结论与三天前 Snap 的 EGR 正...
📅 2026-07-28
16 篇 · 精读 6
生成式召回与判别式排序在工业系统中走向单模型统一
今日 16 篇入选:生成式推荐 6 篇、判别式推荐 5 篇、LLM 5 篇,工业界论文占多数,6 篇完成精读。快手 UniR² 把用户上下文、SID 生成轨迹与排序特征拼成单条 decoder-only 序列,用双查询前缀因果注意力隔离两类任务的可见性,端到端推理耗时降 54.29%。JD 的 OxygenREC-v2 把行为指令注入解码前缀,并以可验证命中率奖励加特权 teacher 自蒸馏替代...
📅 2026-07-27
3 篇 · 精读 1
内容公平性与推荐系统的攻防、可持续双重博弈
今日共收录 3 篇论文,1 篇精读、2 篇速览,横跨工业系统(other)、LLM 与判别式推荐三个方向,工业与学术各半。当日主线可概括为「谁的内容被看见、又该如何被看见」——从曝光公平、对抗操纵到可持续目标,三篇论文从不同侧面追问推荐分发的价值取向。代表作是 Pinterest 的 PinEqualizer,一套已线上部署两年的全漏斗内容冷启动去偏系统,横跨 corpus selection→r...
📅 2026-07-24
6 篇 · 精读 1
生成式推荐:从自回归到扩散,弥合序列生成与推荐的结构鸿沟
今日共 6 篇,其中生成式推荐 3 篇、判别式推荐 2 篇、其他 1 篇,1 篇工业精读(腾讯 BARGE),其余 5 篇为学术 brief。主线是「把为自然语言设计的序列生成范式适配到推荐」:代表作 BARGE(腾讯,reading_score 9)把生成式推荐相对推荐任务的结构性错配形式化为编码器侧「item-boundary gap」与解码器侧「semantic-drift gap」两个正交...
📅 2026-07-23
4 篇 · 精读 1
推荐系统降本与规模化:从工业级 LLM 推理聚类到统一排序 benchmark
本日共 4 篇,1 篇精读、3 篇 brief,类别对半分布于 llm 与 discriminative-rec,工业与学术各占其一:唯一工业代表作来自 Amazon,其余三篇均为学术工作。当日主线是「让推荐与 LLM 在千万级规模下既省又稳」。精读代表作 Amazon 的《Efficient Clustering with Provable Guardrails》给出两阶段聚类——先 Mini-...
📅 2026-07-22
5 篇 · 精读 1
生成式检索与推荐 tokenization:把业务价值与拓扑结构注入 Semantic ID
## 当日主线:生成式检索 × 推荐 tokenization
今日共 5 篇(2 篇生成式推荐、2 篇判别式推荐、1 篇检索),工业 1 篇(阿里)、学术 4 篇,主线是「如何构造更好的物品 token / Semantic ID,并让检索与排序在同一框架里协同」。
精读代表作 **TSGR**(阿里淘宝搜索)是这条主线上最完整的工业落地:它把商业价值同时注入两端——用 Query-awar...
📅 2026-07-21
7 篇 · 精读 2
工业级推荐:统一大模型骨干与标签去偏双线并进
今日共 7 篇,判别式推荐 5 篇、生成式 1 篇、其他 1 篇;工业界与学术界各占半壁,2 篇精读均来自头部工业系统。Meta 的「WHALE」把 Wukong(非序列高阶特征交互)与 HSTU(长行为序列)两个可扩展骨干在每一层内同时保活,用「Wukong 交互表示 query HSTU 序列表示」的跨分支注意力做逐层渐进式融合,配 shared-KV、非对称反向、shared-gate Sw...
📅 2026-07-20
2 篇 · 精读 1
LLM 工业推荐:从显式推理到有状态记忆与潜意图压缩
今日入选 2 篇工业推荐论文(1 篇生成式、1 篇判别式),均属工业界产出,其中 1 篇完成精读。当日绝对主角是阿里淘宝 RecGPT-V3(9 分重磅精读),它针对 V1/V2 暴露的三大瓶颈给出系统性回应:其一「Memory Hub」用结构化压缩加演化维护把无状态行为建模升级为有状态记忆,planner 算力直降 55.8%;其二「Hybrid-modal Foundation Model」在...
📅 2026-07-17
3 篇 · 精读 1
LLM 重排在真实房产平台的轻装落地
今日清淡,共 3 篇入选(1 精读 + 2 简评),其中工业界 1 篇、学术方法学 2 篇。精读的 QuintoAndar「LLM-Based Re-Ranking for Real Estate Search」是当日主线:拉美房产平台在其对话式助手 Concierge 里引入 zero-training、纯 prompt 的 point-wise LLM 重排器,只动重排、不碰召回栈,把自然语言...
📅 2026-07-16
3 篇 · 精读 2
工业级判别式推荐:统一架构解耦与访问习惯去偏
当日入选 3 篇论文,节奏清淡:2 篇工业判别式推荐(均已精读),1 篇学术评估工具包。两篇工业精读不约而同押注「正交解耦」这一手法来修复统一建模中的信号污染。阿里天猫的 TMallGS 直面 LLM 式一体化搜索精排架构的异构性鸿沟,用层次化校准 tokenization、Per-Field QKV 门控骨干、Decoupled FiLM 后融合与正交 Bias Net 把特征与序列信号「交互解...
📅 2026-07-15
8 篇 · 精读 4
工业界检索 Scaling、个性化瘦身与生成式训练信号扩展
今日入选 8 篇(判别式 5 篇、生成式 3 篇),其中 4 篇工业界论文精读,头部平台(Pinterest / Instagram / 淘系 / 美团)集中发力。Pinterest 的 MESH 针对「异构 Scaling Bias」提出模块化架构+门控偏置校正,为稀疏内容开辟受保护梯度路径,使新鲜物品幂律 scaling 指数提升 14 倍,十亿级 Related Pins 上新鲜物品 rep...
📅 2026-07-14
15 篇 · 精读 3
工业电商三巨头齐发力:生成式检索、多模态排序与特征工程框架
当日共 15 篇入选、3 篇精读,判别式推荐 5 篇、LLM 4 篇、生成式检索 2 篇、其余 4 篇,工业界成果集中且分量最重。三篇精读全部来自淘宝与京东,勾勒出电商搜推的三条主线。阿里淘宝 CRID 把生成式检索的 DocID 解耦为「语义聚类前缀 + 簇内业务价值序数」,只替换最后一级码本便同时消除碰撞、对齐成交目标并支持免重训的簇内增量更新,300M 淘宝语料上超越含最强 EBR 的全部基...
📅 2026-07-13
1 篇 · 精读 0
生成式推荐信息利用:从 raw ID 到 semantic ID 与语义规划
今日仅 1 篇相关提交(生成式推荐方向,工业视角的立场/综述),无重磅工作、无精读报告,属清淡日。这篇《From Raw IDs to Semantic Planning》(评分 6)以「系统如何在规模化约束下利用信息」为主线,梳理推荐系统的演进脉络:从语义不透明的 raw ID,到把内容、多模态、跨域信号封装进 semantic ID,并进一步提出「语义规划」——先预测下次曝光的语义目标,再实例...
📅 2026-07-10
6 篇 · 精读 3
工业级推荐与 LLM 双线:算力扩展、生成式检索提速、回归校准
今日共 6 篇,精读 3 篇、略读 3 篇;类别上 LLM 3 篇、判别式推荐 2 篇、生成式推荐 1 篇,工业界主导(腾讯、快手、阿里三家大厂占据全部精读名额)。腾讯 WeChat AI 的 Hidden Decoding(2607.08186)在固定 Transformer 骨干上沿序列长度维度扩算力,把每个 token 展成 n 条独立 embedding 流并配合 Stream-Facto...
📅 2026-07-09
3 篇 · 精读 0
LLM 推理效率、多模态智能体推荐与联邦学习鲁棒性
今日入选 3 篇,全部为学术工作(2 篇 LLM、1 篇系统方向),无工业界署名,主题分散但共同指向大模型与推荐系统的效率、记忆与鲁棒性。MMEACR(Cong 等)提出多模态记忆增强的智能体协作推荐框架,用双轨记忆分离可解释的智能体推理与细粒度多模态嵌入匹配,经加权倒数排名融合(RRF)整合两路输出,在三个真实域上优于多个 LLM/agent 基线,视觉相关场景提升尤为明显。Fractal KV...
📅 2026-07-08
1 篇 · 精读 0
小模型级联逼近前沿:低成本 KOL 检索重排推理
当日仅 1 篇相关提交,归入"其他"类,偏工业落地的检索排序方向,未做深度精读。核心工作 InfluMatch 面向泰语 KOL(意见领袖)匹配,完全用开源小模型搭建"检索→4B pointwise 重排→4B 推理逐条打分"的低成本级联:重排阶段以单个 Yes token 的对数概率作为相关性分,推理阶段仅对候选短名单精排,最终以约 35× 更少的输出 token 逼近前沿模型 Kimi-K2....
📅 2026-07-07
5 篇 · 精读 1
生成式推荐主导:Semantic ID 统一检索排序与 LLM 推荐偏置校正
今日 5 篇:3 篇生成式推荐、2 篇 LLM 相关、1 篇 agent scaling;工业 1 篇(阿里),其余 4 篇均为学术。重点:UniSGR(阿里 Lazada)把 semantic-ID 生成式检索与多目标排序统一进单个 MoE encoder-decoder,排序模块直接长在生成 decoder 上共享表示,用价值加权并行多 token 预测与漏斗感知对比学习把生成对齐到 clic...
📅 2026-07-06
5 篇 · 精读 1
快手异构生成式推送落地,学术侧聚焦用户建模边界
当日入选 5 篇,生成式推荐、判别式推荐、LLM 各 1 篇,其他 2 篇;工业工作只有快手 1 篇,其余均为学术,但那篇工业论文分量很重。HGenPush 用一条 decoder-only 主干融合 feed 长短期与推送点击、下发行为,在序列尾部挂两个 cls 锚点分别驱动视频与作者双分支;作者侧先用 InfoNCE 把作者表征对齐到用户兴趣,再经 RQ-Kmeans 离散化,并与目标视频首层...
📅 2026-07-03
3 篇 · 精读 0
召回规划与 LLM 数据工程:把静态流水线重构为可导航结构
今日共 3 篇论文,全部为学术工作,分布为判别式推荐召回 1 篇、LLM 2 篇。Planning over Matrix-Factorization MDPs(2607.02115)把 top-K 召回建模为 implicit-ALS 后验上的 MDP,用闭式 rank-one fold-in 做状态转移,在固定 CF embedding 上以一步前瞻或 horizon-K MCTS 超越静态 ...
📅 2026-07-02
4 篇 · 精读 1
LLM 语义驱动的工业召回负采样,兼及大模型量化与在线对齐
今日共 4 篇入选:生成式推荐 1 篇、LLM 2 篇、其他 1 篇;工业界 1 篇(Meta)领衔,余 3 篇为学术工作。重点是 Meta 的 Cluster GOOBS,从正样本所在的 LLM 多模态语义簇内实时采难负样本,并以 O(1) 哈希物品池 GOOBS 免除全局 ANN 索引,即可支撑十亿级双塔召回负采样;公开数据集全面超越 in-batch、DNS、CBNS、ANCE,线上 A/B...
📅 2026-07-01
3 篇 · 精读 2
工业级生成式推荐:端到端序列建模与 LLM 化推理
当日共 3 篇论文,全部属生成式推荐(generative-rec)且清一色来自工业界(Netflix、Meta、淘宝),其中 2 篇精读、1 篇速读。Netflix 的 GenPage 用单个 decoder-only Transformer 把用户/请求上下文当 prompt,自回归生成整张结构化多行首页,以 LLM 式 NTP 预训练 + WBC/RL 后训练替代多阶段推荐栈,线上 A/B ...
📅 2026-06-30
8 篇 · 精读 2
工业推荐召回/检索的实时化与图导航重构,兼及 LLM 推荐诊断
本日共 8 篇:生成式推荐 2、判别式推荐 3、LLM 3、其他 2,工业界由快手两篇精读论文领跑,余为学术探索。快手 POEM 把召回阶段忽视的下游 CTR/CVR/时长排序分逆排名融合成偏序、分组随机采样构造动态序列,与历史序列双编码器融合,配系统偏好正样本蒸馏与 Swing 图硬负采样,实现每请求实时兴趣刷新,全量上线人均时长 +0.249%。同组 IID-Nav 把召回从静态相似度抽取重构...
📅 2026-06-29
6 篇 · 精读 1
推荐系统上下文构造、重排与LLM推理:工业与学术并进
本日共 6 篇论文,判别式推荐 2 篇、LLM 相关 2 篇、理论/基准 2 篇,工业与学术大致各半,仅 Meta 的 CMSL 完成精读。核心亮点是 CMSL(判别式序列推荐):它把"读取单条单调用户历史"改为"主动构造 K 条主题一致的隐子序列"以对抗上下文污染,每条子序列用近似 HSTU 的线性时间注意力单独建模,已在排序与 U2U 召回、跨 5 个 surface 部署,是把"上下文工程"...
📅 2026-06-26
6 篇 · 精读 4
Agent 驱动工业推荐自迭代与 model-centric 扩参双线
今日共 6 篇相关论文,4 篇精读、2 篇略读;类别上 LLM 与判别式推荐各 2 篇、生成式推荐 1 篇、其他 1 篇,工业界(快手×2、腾讯)与学术界各占其半。UniFormer(快手)把工业推荐建模空间显式拆为特征空间 FIM 与任务空间 TIM 分别堆叠扩参,将 scaling 范式从组件级推进到 model-centric。NOVA(腾讯)提出“验证感知”LLM 多智能体框架,把架构演进...
📅 2026-06-25
2 篇 · 精读 1
推荐即生成与序列意图建模:工业、学术双线推进
今日收录 2 篇推荐系统论文,生成式推荐与判别式(序列)推荐各一,恰好对应一工业、一学术两条线。重点是快手的 RaG(Recommendation-as-Generation):它提出“解耦语义 ID”(D-SIDs,把内容与创意分离),让生成式推荐模型(GRM)预测的兴趣 ID 不再用于检索固定库存,而是经多智能体视频生成(VGAs)与跨域奖励学习 GDPO 解码为全新个性化视频,在 4 亿日活...
📅 2026-06-24
4 篇 · 精读 0
Scaling law 透视:LLM 蒸馏、可塑性与基础模型再评测
本日共收录 4 篇论文,3 篇属 LLM、1 篇为图学习,全部来自学术界,主线围绕“规模化”展开。Scaling Laws for Task-Specific LLM Distillation 推导面向特定领域的压缩经验 scaling law,量化迭代结构化剪枝下领域内/通用性能随数据量与压缩比的变化,并提出 blended CoT 监督损失稳定 KL 蒸馏、恢复剪枝抹去的通用知识,附带发布量化...
📅 2026-06-23
8 篇 · 精读 0
推荐扩展的代价与 LLM 驱动的评估新范式
当日共 8 篇,全部出自学术界、无工业参与且均为简评未精读;类别上判别式推荐 3 篇、LLM 2 篇、其他 2 篇(对话推荐评估与轨迹推荐)、生成式推荐 1 篇。重点之中,SPRINT 揭示 Transformer 序列推荐扩参时精度上升却同时放大流行度偏置,根因是注意力聚合与 FFN 投影协同引发的预测“谱坍缩”,通过约束注意力得分矩阵的最大列和与 FFN 谱范数,在 0.05M–0.34B 规...
📅 2026-06-22
3 篇 · 精读 0
推荐基础算子的高效化与偏置分离
当日共收录3篇论文,判别式推荐2篇、LLM方向1篇,全部来自学术研究,暂无工业部署成果。
Mem-GF以Krylov子空间近似图滤波,无需保存完整物品相似图,最高节省5.74倍内存并加速4.38倍。秩一流行度分离方法揭示点积推荐分数中的物品边际先验,将流行度对齐能量降低98.6%。Fast-TurboQuant用符号翻转和快速Walsh-Hadamard变换实现无乘法量化,报告19.7倍加速并改...
📅 2026-06-19
3 篇 · 精读 1
大模型表征的结构化与冗余精简
当日共 3 篇,1 篇精读、2 篇速读;类别上生成式推荐 1 篇、LLM 2 篇,工业界仅 Meta 1 篇,其余为学术。重点是 G2Rec(Meta):消去 user 节点构造稀疏 item 共参与图,谱稀疏化把边压到 O(M log M),在图上做可微软模块度聚类得到每个 item 的兴趣原型软成员,再把连续兴趣画像 token 与 item 嵌入交替成序列喂 Llama2-13B 自回归推荐...
📅 2026-06-18
3 篇 · 精读 2
冷启动推荐双线攻坚:隐式反馈去噪与多模态召回
当日共收录 3 篇推荐系统论文,其中 2 篇精读、1 篇略读;按类别分为生成式推荐 1 篇与判别式推荐 2 篇,工业界(快手、Zalando)占两篇、学术界一篇。DIF(快手)提出模型无关的冷启动隐式反馈去噪框架,用内容相似暖物品的协同表征生成置信度加权伪标签,再以相对熵与冷启动状态估计样本不确定性自适应修正噪声标签,十亿级线上部署显著提升冷启动商业指标。VCG(Zalando)是一套 zero-...
📅 2026-06-17
6 篇 · 精读 0
检索与推荐的重新形式化:联合解码、闭环茧房与曝光设计
本日共 6 篇,以检索与推荐为主(other 4、生成式推荐 1、LLM 1),整体偏学术,仅一篇含真实工业平台田野实验。NNN(2606.17910)把稠密检索重构为联合解码,用非负弹性网让文档 embedding 稀疏非负地共同重建 query,显式建模语料相关性与冗余,理论证明严格优于内积检索并带端到端训练增益。RecLoop(2606.17707)用 LLM 用户模拟器搭闭环,对比生成式推...
📅 2026-06-16
12 篇 · 精读 5
工业级 Transformer 原生推荐架构与生成式范式双线推进
本日共收录 12 篇论文,以判别式推荐为主(8 篇),生成式推荐(3 篇)与 LLM(2 篇)为辅,工业界参与度高(Shopee、快手、腾讯、网易云音乐)。OneRank(Shopee)把多任务推理内化进 Transformer 栈,以任务 token 互不可见、候选感知上下文化与带梯度解耦的跨任务注意力消除编码器-预测器分离,线上 GMV/UU +1.01%;OneBar(快手)用单个 BART...
📅 2026-06-15
5 篇 · 精读 2
Semantic ID 生成式推荐:隐式推理与显式时序注入
本日共收录 5 篇推荐系统论文(2 篇精读),生成式推荐 2 篇、判别式推荐 1 篇、其他 2 篇,工业界(Snap、Meta)与学术研究并存。Snap 的 PauseRec 诊断出显式 CoT 在 SID 生成式推荐中失败的三大根因(世界知识难言语化、文本-SID 嵌入错位、rationale 脆弱),改用可训练 <pause> token 做隐式 latent 推理替代显式 rationale...
📅 2026-06-12
5 篇 · 精读 1
LLM 与生成式推荐:工业可编辑检索与内容污染鲁棒性
当日共 5 篇,类别分布为生成式推荐 1 篇、LLM 相关 3 篇、判别式推荐 1 篇,仅 1 篇出自工业界(快手)其余均为学术,1 篇精读。重点为快手 OneRetrieval:首个"可编辑"生成式电商检索,用 Keyword-Aligned Encoding 把每个 SID 位置绑定到可解释属性词并预留空槽,运营无需重训即可注入新词,深召回与最强生成式基线 OneSearch 打平、干预命中率...
📅 2026-06-11
5 篇 · 精读 1
LLM 推荐检索工业落地:蒸馏与压缩的降本提效
今日 5 篇论文(生成式推荐 1、LLM 1、其他 3),工业与学术大致各半,仅 1 篇精读。主线是大模型如何被蒸馏与压缩塞进工业推荐/检索的实时服务链路。Google 的 LLM-Based User Personas 在十亿级视频平台实时生成自然语言用户兴趣画像(总结兴趣+探索兴趣),把 Gemini Pro 蒸馏到 Nano 并经异步生成与量化压上线,线上观看时长 +0.04%、活跃用户 +...
📅 2026-06-10
5 篇 · 精读 1
LLM 语义驱动推荐与 2-bit 极致量化双线推进
当日共 5 篇:推荐系统 3 篇(生成式 2、判别式 1)、LLM 量化 2 篇;工业界仅快手 1 篇,其余 4 篇为学术,精读 1 篇。重点上,快手 AIR 把基于 LLM 的跨域意图推理离线化为“原子行为-意图对”缓存,在线仅做意图树检索、目标感知检索与 MHA 融合,以约 400 倍吞吐换取实时 LLM 语义,电商场景取得 +3.446% GMV,是当日唯一工业落地。GenAIR 用 LLM...
📅 2026-06-09
15 篇 · 精读 6
工业级生成式推荐的强化偏好对齐与判别式 CTR 扩展双线
本日 15 篇、6 篇精读;生成式推荐 6、判别式推荐 3、LLM 与其他各 3,工业界(JD、Netflix、Yandex、OPPO、Meta)主导。JD 的 AdaGRPO 把生成式推荐 RL 对齐从“均匀施奖”改为“选择性准入”,用 sample-level clip 只在策略不确定且奖励可信处放行梯度,离线 HR@10 11.01%→12.18%、线上 effective IPV +0.4...
📅 2026-06-08
7 篇 · 精读 2
Semantic ID 驱动的生成式与判别式推荐工业落地
今日共收录 7 篇推荐相关论文(生成式检索 4、判别式 1、其他 2),其中 2 篇精读、5 篇略读,工业界由阿里淘宝、Yandex 领衔。SSRLive(阿里)提出生成式-判别式混合的直播粗排,为每个直播间生成刻画主播稳定属性的静态 Semantic ID,与追踪实时人气的动态 SID(实时特征经 RQ-KMeans+EMA 在线码本量化),全量服务数亿用户,线上观看时长 +3.38%、GMV ...
📅 2026-06-05
4 篇 · 精读 2
工业生成式推荐迈向强化推理,冷启动与去噪并进
本日共收录 4 篇推荐系统论文,生成式与判别式各 2 篇,其中 2 篇工业论文获深度精读、2 篇学术论文仅略读。重点上,快手 OneRec 团队的 OneReason 以四粒度感知预训练、三层认知 CoT(人格抽象→兴趣扩展→转移推理)的 SFT 及"专精后统一"的 RL 配方(域内 GRPO→RFT/MOPD),首次让生成式推荐的"思考模式"稳定超越非思考模式,并已在快手本地生活广告线上部署、R...
📅 2026-06-04
11 篇 · 精读 3
大模型语义表征与行为基础模型 scaling 重塑工业推荐
今日共收录 11 篇,类别分布为生成式推荐 2、判别式推荐 3、LLM 4、其他 2,其中 2 篇工业论文经过精读,整体呈工业重磅与学术探索并行之势。快手 RGCD-Rep 把冻结大教师 MLLM 的结构化跨域推理蒸馏进轻量学生模型,经“可迁移残差”查询感知聚合与行为/语义双信号路由,学出可离线落库的短视频→直播跨域表征,已全量服务 4 亿+日活;阿里 DSIRM 把语义 ID 从生成式检索目标重...
📅 2026-06-03
7 篇 · 精读 2
推荐与 LLM 建模的效率帕累托权衡
当日共收录 7 篇,涵盖生成式推荐 1、判别式推荐 3、LLM 2 及其他 1,其中 2 篇精读,工业界(快手、ShareChat)与学术界大致各半。Taiji(快手)是工业级 LLM-as-Enhancer 框架,用逆向工程 CoT 与 PPL 拒绝采样提升推理数据质量,再以 POPO 在 GRPO 中对语义奖励与 CTCVR 协同奖励做帕累托最优加权,7B 模型离线超越 32B 教师,线上取得...
📅 2026-06-02
15 篇 · 精读 4
工业级推荐落地:Semantic ID 量化与生成式建模双线突破
今日共 15 篇,判别式推荐 6 篇、LLM 7 篇、生成式推荐 2 篇,4 篇精读全部出自工业界。快手 FlowTime 提出“连续生成式回归”新范式,以一步式 VAE 加基于观看时长分位数历史的条件 Normalizing Flow 把高斯先验 warp 成个性化多峰分布,避免点回归均值坍缩与离散化误差,线上视频播放时长 +1.044% 并开源 TimeRec 基准。LinkedIn 的 RQ...
📅 2026-06-01
9 篇 · 精读 3
工业级推荐:统一检索排序架构与 Semantic ID 编码
当日共收录 9 篇,精读 3 篇;类别上以判别式推荐(5)为主,生成式推荐(2)、LLM(2)与其他(1)并存,工业界 3 篇(Pinterest×2、Meta)、学术界 6 篇。重点首推 Pinterest 的 UniPinRec——首个全栈统一检索与排序的生产系统,以单输入格式、单共享骨干、单阶段联训,借 Masked Action Modeling 与跨进程 KV-cache 共享,实现线上...
📅 2026-05-29
4 篇 · 精读 2
工业推荐与搜索排序的参数缩放及高效落地
当日共 4 篇论文,判别式推荐与 LLM 推荐各 2 篇;工业界(ByteDance、Coupang)2 篇均经精读,学术 2 篇仅略读。重点上,ByteDance 的 Rec-Distill 把蒸馏收益分解为“教师 scaling 收益 × 可迁移性 η”,以解耦双塔学生、黑盒 CE 蒸馏、学生侧去偏与批流混合流水线,将 24B 参数 / 20K 序列教师的缩放收益迁移给轻量部署学生,峰值可迁移...
📅 2026-05-28
6 篇 · 精读 2
LLM 与世界模型驱动推荐:工业落地与偏好对齐
本日共 6 篇,类别为 LLM 推荐 3 篇、判别式 2 篇、生成式 1 篇,工业界 2 篇、学术界 4 篇,其中精读 2 篇。Pinterest 的工作把微调开源 LLM 当作“广告主预测器”而非排序器,从用户画像与转化历史预测高意图广告主并同时注入召回与排序,线上美区 Shopping RoAS 提升 4.94%/6.69%。LUCID 部署的 AMRS 用因果 Transformer 世界模...
📅 2026-05-27
5 篇 · 精读 2
端侧 MoE 推理提效与工业级推荐流量治理
本日共 5 篇论文,类别分布为 llm、判别式推荐各 1 篇与 other 3 篇;工业界(Meta、Alibaba)2 篇、学术 3 篇,其中 2 篇完成精读。重点上,Meta 的 MobileMoE 提出首个 sub-billion 激活的端侧 MoE 模型族,基于联合内存+算力约束的端侧扩展律确立“适中稀疏+细粒度+共享专家”甜点架构,经四阶段配方与 INT4 QAT,在 14 个 benc...
📅 2026-05-26
15 篇 · 精读 6
工业推荐系统:测试时扩展、生成式重排与效率优化
今日 15 篇,精读 6 篇;判别式推荐 8、生成式推荐 2、LLM 3、其他 2,工业界(阿里/腾讯/蚂蚁/Taboola)为精读主力。阿里 UTTSI 是首个免训练、模型无关的测试时计算扩展框架,按实例不确定性分配特征探索路径,线上 +5.3% CTR;阿里 DeGRe 用前瞻评估器离线挖掘高价值排列并混合蒸馏稠密监督,单次贪心解码逼近全局最优,淘宝闪购 GMV +3.75%;腾讯 SIREN...
📅 2026-05-25
8 篇 · 精读 3
工业推荐的规模化扩展与长尾冷启动
今日共 8 篇:判别式推荐 4、生成式推荐 1、LLM 2、其他 1;3 篇精读全为工业界(阿里/Netflix/腾讯),5 篇略读偏学术。Netflix 把生成式推荐骨干从 2M 扩到 1B,提出任务相关 offset 幂律 scaling law 作“还有多少剩余空间”的诊断,并配采样 softmax、d/8 解码头、多 token 预测与语义物品塔把规模红利传导到下游,1B 全面胜出、冷启动...
📅 2026-05-22
5 篇 · 精读 2
LLM 显式推理与生成式检索重塑推荐召回
本日 5 篇均围绕推荐/检索召回,3 篇生成式、2 篇判别式,2 篇精读,工业界(快手、Meta)与学术界各半。快手 RPORec 用文本接口解耦“生成显式 CoT 的 LLM backbone”与轻量检索头 Rechead,两阶段交替训练,以冻结 Rechead 作稠密可验证奖励并用 GRPO 精炼推理,规避隐状态扭曲与文本→item 语义鸿沟,工业广告 A/B 营收 +1.348%。Meta ...
📅 2026-05-21
6 篇 · 精读 2
工业直播推荐新范式与 LLM 训练标度律
本日共 6 篇:判别式推荐 3 篇、LLM 训练 2 篇、其他 1 篇,工业与学术约各半,其中 2 篇完成精读。工业直播线两篇最亮眼:字节跳动的 PEARL 把直播 watch-time 预测重构为非参数的每用户分位数估计,证明"当前样本是否大于一个随机历史样本"的对比指示其期望即为无偏 CDF,十亿级上线带来 +2.10% 观看时长并显著改善低活用户;FLUID 首次在生产级直播排序中彻底弃用候...
📅 2026-05-20
4 篇 · 精读 1
向量量化双线推进,推荐与推理理论同台
本日共 4 篇论文,1 篇精读 3 篇略读;类别分布为 LLM 2 篇、判别式推荐 1 篇、其他 1 篇,全部来自学术机构。重点是首尔国立大学的 BlockQuant(2605.19972),把 rotation-based 向量量化的码本从 coordinate-wise scalar 推广到 block-on-sphere,按球面均匀分布解析推导块边缘分布并做 K-means,在 MSE 与内...
📅 2026-05-19
12 篇 · 精读 6
生成式推荐多维突破:冷启动、长尾去偏与可变长 SID
本日共 12 篇论文,其中 6 篇精读、6 篇浅读;类别分布以生成式推荐为主(6 篇),判别式推荐 2 篇、LLM 3 篇、其他 1 篇,工业(Alibaba/Kuaishou/Huawei)与学术机构并举。重点工作中,阿里 Taobao 的 GrowthGR 首次把可持续新品增长拆为 ItemLTV 反事实 uplift 与 MultiGR/MoPO 多价值 GRPO 变体,线上 2 个月获得新...
📅 2026-05-18
6 篇 · 精读 0
全学术小日子:量化理论、泛化机制与智能体扩展律
当日入选 6 篇,LLM 3 篇、其他 2 篇、判别式推荐 1 篇;全部为无公司署名的学术工作,既无线上部署也无精读,偏理论与机制分析。GenLI 针对 CTR 长期兴趣建模中两阶段检索的缺陷,直接生成多个与目标无关的实时兴趣分布,并把加权检索退化为一次查表。PrismQuant 为高斯混合源重建了构造性的率失真理论,指出混合结构只额外带来一个分量标签的代价,并据此用分量匹配的变换加标量量化给出实...
📅 2026-05-15
6 篇 · 精读 3
Semantic ID 驱动的生成式推荐工业化与排序-召回统一
本日共收录 6 篇论文,其中生成式推荐 3 篇、判别式排序 1 篇、LLM 推荐 2 篇、其他 1 篇,工业界出品占据全部 3 篇精读重点。美团 DIG 把 RQ tokenizer 嵌入 DIN+DCNv2+MoE 判别式排序器内部,用 BCE loss 端到端驱动 SID codebook 构造,配合特征分配 taxonomy 与 MLP_u2t 蒸馏让同一模型既排序又通过 beam sear...
📅 2026-05-14
14 篇 · 精读 4
扩展律牵引的训练方法论,与生成式推荐的系统级提速
今日 14 篇:LLM 7 篇、生成式推荐 2 篇、判别式推荐 1 篇、其他 6 篇(含跨类);仅华为 TurboGR 一篇标有公司归属,其余为学术工作;四篇精读中三篇属 LLM 扩展律与训练方法论。Duke 等四校的理论工作(2605.13687)用树上广播过程造出分布已知的层次化语言,论证忠实采样长度 n 的序列需 Ω(n) 上下文,而仅 Θ(log n) 位工作记忆的推理模型即可精确采样,惟...
📅 2026-05-13
11 篇 · 精读 3
生成式推荐多路径演进与工业级表格预训练并举
今日共收录 11 篇论文,3 篇完成精读,覆盖生成式推荐(3)、判别式推荐(3)、LLM 推荐(3)及通用方向(5),工业与学术成果并存。重点工作 MaskTab(蚂蚁集团 MyBank × 浙大)以专用 [MASK]/[MISS] token 把"缺失即信号"编码进统一表格预训练框架,孪生双路监督消除 train-test mismatch,MoE 重建头自适应扩容高维特征交互,TabReD 8...
📅 2026-05-12
10 篇 · 精读 6
工业级推荐系统全栈突破与 LLM 缩放/几何理论双线深化
本日共 10 篇论文,6 篇精读 4 篇略读,覆盖 LLM(3 篇)、判别式/生成式推荐(4 篇)与系统/检索(3 篇),工业与学术约各半。Arena Physica 的 "Practical Scaling Laws" 提出 8 参数闭合形式 L(N,D,T),将 loss 分解为 undercapacity/undertraining/overfitting 并在 5 个公开 LLM grid...
📅 2026-05-11
5 篇 · 精读 2
生成式推荐基准审计与对话式语义ID落地
本日共 5 篇论文,2 篇精读、3 篇略读;类别分布上生成式推荐 2 篇、判别式推荐 1 篇、LLM 推荐 1 篇、其他 1 篇,工业界(腾讯、Airbnb)与学术界各半。重点论文方面,腾讯 NewsRec-Chat 提出 Generate-then-Match 范式,让 7B LLM 直接生成 3 层分层 Semantic ID 前缀,对 24h 滚动新闻池做模糊匹配,从架构上保证 0% 幻觉,...
📅 2026-05-08
6 篇 · 精读 2
生成式推荐表达力与价值对齐双线突破
本日共收录 6 篇论文,涵盖生成式推荐 2 篇、判别式推荐 2 篇、LLM 与检索各 1 篇,工业与学术贡献各占一半。重点工作集中在生成式推荐(GR)方向:UCSD 与 Snap 联合提出的 Latte(2605.06331)从理论上揭示了自回归 Semantic ID 解码受 tree-distance 概率耦合约束、无法表达 rank-reversal 与 forced-transitivit...
📅 2026-05-07
6 篇 · 精读 5
生成式推荐与服务系统全栈优化:Semantic ID、对齐与 HBM 调度协同推进
今日共 6 篇论文,5 篇精读、1 篇略读;类别上 generative-rec 占 3 篇,llm、other、discriminative-rec 各 1 篇,工业系(Alibaba 主导)与学术系基本对半。建模侧:CapsID 用 capsule 软路由替代 RQ-VAE 的硬 argmax 并配合置信驱动变长 SID 与 SemanticBPE 双门控合并,在 35M item 工业目录上...
📅 2026-05-06
2 篇 · 精读 0
AI 生成音乐流行度预测与 Agentic 工作流编排
本日共 2 篇论文均为学术界产出,类别分布偏向其他方向,无工业界深度精读论文。APEX(新加坡科技设计大学)基于冻结的 MERT 自监督音乐表征,在 21 万首 Suno/Udio 生成音乐上构建多任务框架,联合预测流行度信号与五维美学质量,并在 Music Arena 偏好预测上验证了美学特征对 OOD 泛化的增益。From Intent to Execution 提出一个自动化多智能体编排框架...
📅 2026-05-05
9 篇 · 精读 5
Scaling Laws 三连发与领域 Foundation Model 实践
本日共 9 篇论文,3 篇 LLM、3 篇判别式推荐、3 篇 other,工业(ByteDance/Meta/Tencent)与学术(Cornell/Yale/清华)各占半壁,主线集中在 Scaling Law 的精细化与跨域 Foundation Model 实践。三大 Scaling Law 工作中,ByteDance 的 InfoLaw 把训练重写为信息累积过程,用 quality dens...
📅 2026-05-04
3 篇 · 精读 0
推荐系统负样本挖掘与多模态鲁棒性
本日共 3 篇推荐系统论文,2 篇判别式 + 1 篇生成式,工业与学术各占其一。DynamicPO 针对 LLM 推荐 DPO 训练中"偏好优化坍塌"现象,理论归因于 easy negatives 主导梯度,提出动态选择决策边界附近信息性负样本并按边界模糊度自适应 beta 系数,在三个公开数据集上稳定提升。IKEA.com 的稠密检索工业实践利用商品分类层级和属性构造结构化 hard negat...
📅 2026-05-01
2 篇 · 精读 1
LLM 生成式推荐的推理加速与列表重排
今日共 2 篇论文,均聚焦 LLM 推荐方向,分布于 generative-rec 与 llm 两类,全部来自学术机构。重点论文 PAD-Rec(中科大等)针对 SID 列表式生成推荐的推理瓶颈,在 speculative decoding 草稿模型中注入 within-item slot 与 draft-step 两类位置嵌入并以轻量门控融合,使草稿端结构感知化,在四个公开数据集上获得最高 3....
📅 2026-04-30
8 篇 · 精读 3
生成式与 LLM 推荐:语义 ID、压缩重排与因子化潜推理
今日共 8 篇论文,3 篇精读、5 篇略读;类别分布为判别式推荐 4 篇、生成式推荐 2 篇、LLM 检索/重排 1 篇、隐私 1 篇,整体以学术为主。重点精读三篇均围绕"生成式 / LLM 范式下的表征与推理瓶颈"展开:CARD(电子科大)把文本、视觉与协同信号渲染为统一卡牌图像,由 SigLIP2 编码后引入可学习可逆的非均匀变换(Kumaraswamy CDF / scaled logist...
📅 2026-04-29
3 篇 · 精读 2
生成式推荐的动作空间与信息缺口修补
当日仅 3 篇入库,是个很小的日子:生成式推荐 2 篇、LLM 推荐 1 篇,仅 1 篇有线上证据。两篇精读都出自快手系,且都在追问生成式推荐“该输出什么、缺了什么信息”。GloRank(快手 + 港城大 + UCSD)证明 list-wise 重排“选第 k 个候选”的局部动作空间,会给输出层注入与编码器无关的映射方差,遂改用 RQ Semantic ID 的 4×256 固定全局词表生成物品标...
📅 2026-04-28
16 篇 · 精读 6
Semantic ID 工业落地与长序列 KV 压缩双线推进
本日共 16 篇,6 篇精读、10 篇仅简评;按类别分布生成式推荐 4 篇、判别式推荐 3 篇、LLM 3 篇、其他 6 篇,工业-学术比约 4:12,快手、美团、苹果三家工业方贡献了最重的几篇。重点论文上,快手 KSA(2604.24432,reading_score 9)通过插入可学习 summary token 实现 O(n/k) 语义级 KV 压缩,与 GQA/MLA 完全正交可叠加 8×...
📅 2026-04-27
7 篇 · 精读 3
RL 重塑 LLM 生成式推荐与检索重排
本日共 7 篇论文,3 篇精读、4 篇略读;类别分布以生成式推荐(3)与 LLM 检索(2)为主,工业(华为、阿里)与学术(USTC×Meta 等)双线并进。重点论文中,华为 ReCast 把生成式推荐 RL 的瓶颈从"奖励稀疏"前推至"group 可学性退化",用 ground-truth anchor 修复 all-zero 组并以 hardest 正负对边界对比替代全组归一化;阿里 Qwen...
📅 2026-04-24
1 篇 · 精读 0
LLM 离线知识蒸馏赋能传统序列推荐
今日仅 1 篇相关 ArXiv 提交,属学术界工作,同时归入"LLM"与"判别式推荐"两类。重点论文为 Severin 等人提出的 LLM-蒸馏序列推荐框架(arxiv 2604.21536):利用预训练 LLM 在离线阶段为用户生成文本化画像,作为额外监督信号蒸馏进传统序列推荐模型,在线服务时完全无需 LLM 推理,也不改动既有模型架构,从而在保留传统模型低延迟优势的同时引入 LLM 的语义理解...
📅 2026-04-23
2 篇 · 精读 0
LLM 自博弈扩展与 Agent 记忆结构化生成
本日共 2 篇 LLM 方向学术论文,均未精读,聚焦 LLM 训练扩展与 Agent 基础设施两个子方向。Scaling Self-Play with Self-Guidance(SGS,Stanford,Hashimoto/Tengyu Ma 组)在传统 Conjecturer/Solver 双角色自博弈之外引入第三方 Guide 角色,对合成问题的相关性与自然度打分以抑制 Conjecture...
📅 2026-04-22
7 篇 · 精读 3
工业级推荐系统的结构创新与 scaling 新维度
今日共纳入 7 篇论文,4 篇判别式推荐 + 3 篇 LLM 相关,工业-学术比约 4:3,其中 3 篇完成精读且评分均达 8 分。Alibaba 的 LoopCTR 把共享层递归复用提升为正交于深度/宽度/输入的第四种 scaling 维度,配合 Hyper-Connected Residuals、MoE 与多深度 process supervision,实现 train-multi-loop ...
📅 2026-04-21
12 篇 · 精读 3
工业排序表征质量提升与生成式推荐理论基础双线并进
2026-04-21 共收录 12 篇论文,判别式推荐 6 篇、LLM 方向 3 篇、其他 2 篇、生成式推荐 1 篇;精读论文 3 篇均来自国内大厂,工业落地色彩浓厚。
重点论文方面,腾讯 RankUp(2604.17878)从「有效秩」视角系统解决 MetaFormer 排序器的表征坍缩问题,提出随机置换分片、多嵌入表、全局 token 等五项机制,在微信三大广告场景实现 3.41–4.81...
📅 2026-04-20
6 篇 · 精读 2
工业推荐的表征升级与生成式范式的理论奠基
当日入选 6 篇,判别式推荐 3 篇、生成式推荐 1 篇、LLM 2 篇;工业界仅美团与快手各 1 篇,其余 4 篇为纯学术工作,篇幅不大但两篇精读分量很足。美团 SIF 把历史序列 token 从物品级升级到样本级:离线用分组自适应的层次量化 HGAQ 将每条历史交互的完整特征快照压成 648 比特的 Token Sample,在线只需查码本还原,再由 SIF-Mixer 做 token 级与样...
📅 2026-04-17
1 篇 · 精读 1
工业级生成式推荐:训练信号、序列压缩与强化对齐
2026年4月17日共收录1篇论文,类别集中于生成式推荐(generative-rec),来自工业界。
重点论文 GenRec(京东)系统性回应了大规模生成式检索在工业部署中的三大核心瓶颈:(1)训练信号稀疏——提出页粒度 NTP(Page-wise Next-Token Prediction),将有效训练信号密度显著提升;(2)语义ID序列过长——设计非对称 Token Merger,以约2倍...
📅 2026-04-16
8 篇 · 精读 2
序列推荐统一建模与时序特征工程的多路并进
2026-04-16 共收录 8 篇推荐系统论文,判别式推荐占主导(6 篇),生成式检索与 LLM 推荐各 1 篇;工业级论文 3 篇,学术论文 5 篇。
本日最受关注的是腾讯提出的 TokenFormer(精读分 8),其核心贡献在于通过 BFTS(Bottom-Full-Top-Sliding)分层注意力与 NLIR 非线性门控机制,将多域特征交叉与序列行为建模统一到单一 Transform...
📅 2026-04-15
13 篇 · 精读 4
工业推荐的算力分摊与信息补全,兼及语言模型的循环扩展律
今日 13 篇,4 篇精读;判别式推荐 4 篇、生成式推荐 3 篇、LLM 3 篇、其他 4 篇,带线上部署的工业工作仅 Shopee、美团、Meta 三篇,余下 10 篇为学术。UniRec(Shopee)在 SID 之前先解码类目属性、并给码本加曝光加权容量约束,离线命中与线上 GMV 同升,但实验只覆盖类目一类属性,所称的逐步熵下降无实测值。HILL(Meta)联合训练分层索引与检索基础模型...
📅 2026-04-14
11 篇 · 精读 4
重算力移出在线路径:语义 ID 与离线表征的工业落地
本期 11 篇:判别式推荐 6 篇、生成式推荐 3 篇,另有 3 篇偏检索与重排;4 篇来自 Meta、Walmart、快手、字节且均已上线,也是仅有的精读对象,其余 7 篇为纯学术工作。Meta 的 SOLARIS 借投机解码思路,用线上垂直模型打分当 verifier,后台异步算好基础模型表征写入带 TTL 的缓存,推理期当普通特征消费,但覆盖率数字前后不一、后台算力成本未披露。Walmart...
📅 2026-04-13
5 篇 · 精读 1
工业级用户行为序列建模与学术推荐表示优化并行推进
今日共收录 5 篇论文,涵盖判别式推荐(4 篇)与 LLM/MoE 理论(1 篇),工业落地论文 1 篇,学术探索论文 4 篇。
重点论文为字节跳动的 **IAT**(Instance-As-Token),该工作将用户历史交互的全量特征压缩为紧凑实例 token,以两阶段解耦框架(Source Instance Transformer 压缩 + 标准序列模型建模)突破传统手工特征序列的信息瓶颈。...
📅 2026-04-10
7 篇 · 精读 3
工业级生成式与判别式推荐双线突破:可扩展稀疏 + 稳定嵌入
本期日报覆盖 2026-04-09 ArXiv 提交,共 7 篇推荐相关论文(3 篇精读 + 4 篇摘要归档),类别均衡分布在生成式、判别式、LLM 三大范式。三篇重点论文均来自工业 / 学术深度结合:Alibaba (AliExpress) 的 SSR 框架以显式稀疏取代 Wukong/RankMixer 的密集架构,在亿级 CTR 数据上实现真正的 scaling law,连续超越 RankM...
📅 2026-04-09
2 篇 · 精读 0
冷启动与 persona 建模成为今日推荐议题主线
今日 7 篇候选均未达到精读门槛(>=7)。两篇进入摘要归档:ACARec 用 artist catalog attention 解决音乐冷启动,将问题重构为 semi-cold 范式,相比纯内容基线 Recall/NDCG 翻倍,方法清晰但偏应用向;persona-driven SBRS 把 LLM 物品嵌入与异构 KG 融合,通过 HDGI 学习匿名 session 的 latent pers...
📅 2026-04-08
10 篇 · 精读 4
生成式推荐工业落地与序列推荐评测反思
本期日报覆盖 2026-04-07 ArXiv 提交,共 10 篇推荐相关论文(4 篇精读 + 6 篇摘要归档)。两篇高分工业论文聚焦生成式推荐落地:阿里 STAMP 提出双端语义稀疏化(输入 SAP + 输出 MAP)解决 SID-GR 的 Semantic Dilution 问题,1.23-1.38× 提速 + 17-55% 显存节省;美团 NSGR 用基于树的 next-scale 生成式重...
📅 2026-04-07
4 篇 · 精读 3
生成式推荐的去偏、加速与检索增强
本期日报覆盖 2026-04-06 ArXiv 提交,共 4 篇推荐相关论文(3 篇精读 + 1 篇摘要归档)。三篇核心论文聚焦生成式推荐范式的关键瓶颈与对话推荐的检索增强。CRAB 从语义 token 化的角度剖析生成式推荐中的流行度偏差,指出不均衡的 codebook 会继承并放大历史交互的偏差,提出通过拆分过热 token 并引入树结构正则化保持语义一致性,是一项后处理去偏方案。FAVE 直...
📅 2026-04-06
14 篇 · 精读 4
Semantic ID 与生成式推荐工业实践
本期日报覆盖 2026-04-03 至 04-05 三天 ArXiv 提交,共 14 篇推荐相关论文(4 篇精读 + 10 篇摘要归档)。主线聚焦在生成式推荐与 Semantic ID 的工业落地:腾讯发布 Tencent Advertising Algorithm Challenge 2025(TencentGR-1M/10M)—— 首个公开的全模态工业级生成式推荐数据集,包含真实广告日志的协同...