← 返回报告列表

2026-W34 周报

周报 📅 2026-08-17 ~ 2026-08-23
语义 ID 分头改造结构侧与消费侧,工业证据强度集体走低
semantic-id industrial pretrained-lm quantization inference-serving cross-domain
📊 共 44 篇 · 精读 14

2026-W34 周报

日期范围: 2026-08-17 ~ 2026-08-23

主题: 语义 ID 分头改造结构侧与消费侧,工业证据强度集体走低

标签: semantic-id · industrial · pretrained-lm · quantization · inference-serving · cross-domain

📊 统计: 共 44 篇 · 精读 14 · 覆盖 6 个工作日

周度综述

本周 6 份日报共入库 44 篇、精读 14 篇;按日报口径(含跨类重复)判别式推荐 17、生成式推荐 15、LLM 8、其他 6,工业界 14 篇、纯学术 30 篇,而 14 个精读名额几乎全被有线上系统的公司占满。第一条主线是 Semantic ID 在同一周里裂成两侧:快手从结构本身下手,线上三级 SID 的第二级语义码条件利用率仅 2.48%,遂改为单层大码本加一位恒定哈希消歧码,解码由三步降到两步、FLOPs 降约 48%,5 天 2.5% 流量 A/B 主消费指标 +0.792%;DoorDash 反其道,完全不碰 tokenizer,把一次学出的三层层次同时喂给个性化排序与搜索查询改写两个不共享参数的系统,离线消融 MRR@5 为 +6.98% 对 +2.10%,改写侧三项线上指标的 95% 置信区间均不跨零。耐人寻味的是,DoorDash 所用的前缀 n-gram 加 SentencePiece 方法族,正是快手四月 SID-Coord 拿来当批评对象的基线。第二条主线是本周罕见地出了两篇否定性工作:Spotify 用 2×2 受控实验证伪「轨迹质量决定推荐效果」,八任务对齐把轨迹质量推到最高 3.51 却把 R@10 打到最差,复合 judge 奖励让效果反超基线时轨迹质量纹丝不动(2.22→2.23),真正的操作变量是奖励密度;学术侧 PCTM 以近因加权成对探针质疑序列推荐基准是否真需高阶建模。第三条主线是同公司互不引用一周出现三例:Meta 的 UniDot 与自家 WHALE 骨架几乎同构却零引用,且对「逐层跨分支交换」给出相反的消融信号;美团 SA-RSQ 未引三个月前同厂的 DIG;阿里 CRRN 与 SAM 作者重叠三人、问题同构却互不援引。与之呼应的是工业读数的证据质量:SA-RSQ 的流量计数、置信区间与 p 值全被生产系统扣留且报的是跨配置峰值,CRRN 对最强 baseline 只高 0.29 个 AUC 点且无显著性检验,本周最高分 DuELRec(SK Telecom,线上 CTR 0.90% 提到 1.33%)宣称的「全域缓解负迁移」也只在 HR@5 口径下成立。其余重点包括 Google Discover 的 SDF(两年部署使陈旧举报降 54.9%)与 Kakao 的超参迁移(定学习率成本仅约全量训练的 1%)。

每日概览

2026-08-18

  • 主题: 排序模型之外发力:上游候选过滤与跨域统一用户表征
  • 论文数: 11 · 精读: 2

2026-08-19

  • 主题: 端到端生成式 slate 推荐落地,兼看紧凑 LLM 与 agent 委托
  • 论文数: 3 · 精读: 1

2026-08-20

  • 主题: 推荐排序工业落地三线:统一底座、LLM 蒸馏与延迟预算
  • 论文数: 7 · 精读: 3

2026-08-21

  • 主题: 训练与检索降本:廉价结构化信号替代大模型计算
  • 论文数: 8 · 精读: 2

2026-08-24

  • 主题: Semantic ID 双线工业实践:重构码本结构与跨系统复用层次
  • 论文数: 4 · 精读: 2

2026-08-25

  • 主题: 生成式推荐回到 item 表示,工业侧用显式先验治干扰
  • 论文数: 11 · 精读: 4