2026-W35 周报
日期范围: 2026-08-24 ~ 2026-08-30
主题: 语义 ID 病根之争逐级抬高,收束于先修表示不修量化器
标签: semantic-id · quantization · pretrained-lm · inference-serving · industrial
📊 统计: 共 60 篇 · 精读 21 · 覆盖 6 个工作日
周度综述
本周 6 份日报共入库 60 篇、精读 21 篇;按日报口径(含跨类重复)判别式推荐 24、生成式推荐 19、其他 10、LLM 9,精读名额仍主要落在有线上系统的公司。本周罕见地走出一条弧线:“离散化的病根到底在哪”被逐级抬高,末端局部收敛。起点是 08-26 的三方分歧——清华与腾讯的 Tlow 用可逆流把语义嵌入掰成标准正态,就此离开残差量化、改用并行 PQ;快手 PRQ-KMeans 把病根定在层间传递算子(全码字相减留下残差夹带),用带正交约束的投影残差留在层级里修;快手更早的 Dynamic PV-S2 则认定层级结构本身是原罪,砍一层换单级大码本。三家诊断同一症状却开出互斥处方,前两篇还同日发布、互不引用。08-27 Meta 的 AMBER 把问题抬高一层:不是怎么修量化,而是要不要离散化——其消融显示富 item 表征下去掉 semantic ID 是中性的,遂押注根本不需要码本,改用连续稠密 token 对齐 LLM 嵌入空间,代价是离散路线没有的表征漂移。到 09-01 出现独立共识:高德 HF-SID 的量化器一行未改,Hit@200 的 26.77 个点全部来自表征侧,线上 PV_CVR +6.74%;Google 的 RSLM 从 ANN 索引侧走到同处,还给出结构性理由——MIPS 必须保内积,变换只能正交,免训练是约束的推论而非效率选择。但这两篇与 PRQ-KMeans、AMBER 问题不同源、不构成对照,只与 Tlow 在“表示整形优先于量化器设计”一条方法论轴上同构,路线之争远未解决。第二条线是一周内三次评分校准:快手 HubMixer 由 8 压到 6,主打的 latent hub 在论文自家消融里单独为负收益;美团 CHAP 由 8 压到 6,因果主张的三个对齐损失全是二元组、无一含用户行为序列,码本还全程冻结;Snap 内容探索由 7 上调到 8,靠一年多的生产随机对照与生态识别理论,把共享语料的 SUTVA 违背从偏倚重定性为估计量的改变。其余值得点名:淘天 TransRetrieval 坚持判别式召回,与同集团 7 月的 TMallGS 在要不要放弃参数共享上结论相反且互不引用;AI VK 的 VK-GNN 在 194M 用户、28B 边的好友图上,用 multi-hash 把嵌入表从 202.88GB 压到 2GB 且效果不降反升,两周 A/B 好友添加 +16.0%;本周最高分是阿里 Qwen3.8-Flash-Next(9 分)。
每日概览
2026-08-25
- 主题: 生成式推荐回到 item 表示,工业侧用显式先验治干扰
- 论文数: 11 · 精读: 4
2026-08-26
- 主题: 语义 ID 残差量化的路线分歧与工业推荐对齐
- 论文数: 10 · 精读: 6
2026-08-27
- 主题: 工业推荐 Transformer 扩容:事件 token 化与判别式召回的互斥押注
- 论文数: 7 · 精读: 2
2026-08-28
- 主题: 在线延迟约束下的重活外挪:离线刷新与权重内化
- 论文数: 9 · 精读: 2
2026-08-31
- 主题: 工业排序换用 latent hub 交互,收益归因被消融推翻
- 论文数: 4 · 精读: 1
2026-09-01
- 主题: 语义 ID 与 ANN 双线会师:先修表示,不修量化器
- 论文数: 19 · 精读: 6