← 返回报告列表

2026-08 月报

月报 📅 2026-08-01 ~ 2026-08-31
语义 ID 路线走完一轮:从分头改造到先修表示,工业证据强度同步校准
semantic-id quantization industrial pretrained-lm inference-serving parameter-scaling knowledge-distillation
📊 共 172 篇 · 精读 58

2026-08 月报

日期范围: 2026-08-01 ~ 2026-08-31

主题: 语义 ID 路线走完一轮:从分头改造到先修表示,工业证据强度同步校准

📊 统计: 共 172 篇 · 精读 58

类别分布: - 生成式推荐: 53 篇 - 判别式推荐: 64 篇 - 其他: 27 篇 - LLM: 36 篇

月度综述

本月共归档 172 篇、精读 58 篇,产出 21 期日报与 4 期周报,是迄今最大的一个月。判别式推荐 64 篇、生成式推荐 53 篇、LLM 36 篇、其他 27 篇;纯学术 111 篇、有线上系统的工业工作 61 篇,精读名额几乎被后者占满。

最完整的一条弧线属于语义 ID 与离散化,全月走完了“分头改造—病根之争—方法论收敛”一轮。月初 SID 仍在下沉为系统骨架:快手 UniGD 把 SID 生成与相关性打分统一进同一 decoder-only 骨干替掉线上级联,一周 A/B 广告收入涨 5.78%。月中转入分头改造:快手 Dynamic PV-S2 实测三级 SID 第二级语义码利用率仅 2.48%,砍层换单级大码本,解码 FLOPs 降约 48%;DoorDash 反其道不碰 tokenizer,把一套三层层次复用到排序与查询改写两个系统。08-26 升级为三方分歧:清华与腾讯的 Tlow 用可逆流把语义嵌入掰成标准正态、离开残差量化改用并行 PQ,快手 PRQ-KMeans 把病根定在层间传递算子、留在层级里修,Dynamic PV-S2 则认定层级结构本身是原罪——同一症状、互斥处方,前两篇还同日发布、互不引用。次日 Meta 的 AMBER 把问题抬高一层:不是怎么修量化,而是要不要离散化,其消融显示富 item 表征下去掉 semantic ID 是中性的。月末出现独立共识,高德 HF-SID 量化器一行未改,Hit@200 的 26.77 个点全部来自表征侧,线上 PV_CVR +6.74%;Google 的 RSLM 从 ANN 索引侧走到同处,理由是 MIPS 必须保内积、变换只能正交。但只有 Tlow 与这两篇在“表示整形优先于量化器设计”一轴上同构,PRQ-KMeans 与 AMBER 问题不同源、不构成对照,路线之争远未收束。

第二条贯穿全月的线索是工业证据强度:多篇工业论文只交得出内部相对提升,置信区间与显著性检验普遍缺席(SA-RSQ 报的还是跨配置峰值),月末三次评分校准坐实了这一点——快手 HubMixer 由 8 压到 6,主打的 latent hub 在其自身消融里单独为负收益;美团 CHAP 由 8 压到 6,标题的因果主张无消融支撑;Snap 内容探索由 7 上调到 8,靠一年多的生产随机对照与生态识别理论,把共享语料的 SUTVA 违背从偏倚重定性为估计量的改变。并列本月最高分的 Qwen3.8-Flash-Next 亦然:头条的 1/9 训练 FLOPs 是算术推导、零 GPU-hours 实测,最硬的反而是稳定性一节。

第三条线是增量落点外移与重活外挪。Google Discover 的 SDF 在排序上游做非个性化候选过滤,两年部署使陈旧举报降 54.9%、回收 8.74% 算力;反向极点是 Yandex Music 的 SONA,一个模型替掉 15 个以上召回器加粗排精排,活跃用户 +4.53%。字节 TM20K 让教师缓存 20K 全量 token 的 logits、学生零参数 merge 压到 1.8K,线上 ADSS +1.036% 而延迟仅 +5.6%;Shopee KGD 靠读写参数解耦让 encoder 每日刷新而不失效下游适配,单用户 GMV +1.75%;AI VK 的 VK-GNN 在 194M 用户、28B 边的好友图上用 multi-hash 把嵌入表从 202.88GB 压到 2GB 且效果不降反升,两周 A/B 好友添加 +16.0%。

学术侧则是标度律分头归因:FAIR 的 Skaling 给 Chinchilla 加性律补上耦合外指数,同门的 Small-Scale 把小规模律不可靠改判为超参未调优,Amazon 把归因移到集群可交付算力,三篇互不引用。值得跟踪的还有淘天 TransRetrieval 坚持判别式召回,与同集团 7 月的 TMallGS 结论相反且互不引用;服务时延与显著性是否披露,正成为衡量工业工作的分水岭。

周度回顾

2026-W32

  • 单模型替级联、重算力挪离线:生成式推荐工业化的收敛
  • 论文 35 篇

2026-W33

  • 工业增量绕开排序主模型,学术侧标度律分头归因
  • 论文 55 篇

2026-W34

  • 语义 ID 分头改造结构侧与消费侧,工业证据强度集体走低
  • 论文 44 篇

2026-W35

  • 语义 ID 病根之争逐级抬高,收束于先修表示不修量化器
  • 论文 60 篇

每日索引

  • 2026-08-04 — 生成式推荐工业化:预训练刷新、离线后训练与服务加速 (13 篇)
  • 2026-08-05 — 语义 ID 下沉为系统骨架,扩散 MoE 立 scaling 律 (6 篇)
  • 2026-08-06 — 工业排序的价值定义之变:跨请求探索与延迟信号分离 (5 篇)
  • 2026-08-07 — 统一模型与智能体重构推荐检索链路,兼论可审计性 (6 篇)
  • 2026-08-10 — 把重计算挪到离线:超长序列蒸馏、标度律与后训练对齐 (5 篇)
  • 2026-08-11 — 工业推荐的控制层转向:LLM 生成可执行策略而非物品序列 (14 篇)
  • 2026-08-12 — 真实约束重塑最优解:单模型化、系统感知与分组校准 (11 篇)
  • 2026-08-13 — 训练信号精细化:超参调优前沿与 token 级信用分配 (6 篇)
  • 2026-08-14 — 训练动力学极小模型与工业排序去噪的双线分野 (7 篇)
  • 2026-08-17 — 无线上部署的学术日:机理诊断、过程监督与新基准三线并行 (6 篇)
  • 2026-08-18 — 排序模型之外发力:上游候选过滤与跨域统一用户表征 (11 篇)
  • 2026-08-19 — 端到端生成式 slate 推荐落地,兼看紧凑 LLM 与 agent 委托 (3 篇)
  • 2026-08-20 — 推荐排序工业落地三线:统一底座、LLM 蒸馏与延迟预算 (7 篇)
  • 2026-08-21 — 训练与检索降本:廉价结构化信号替代大模型计算 (8 篇)
  • 2026-08-24 — Semantic ID 双线工业实践:重构码本结构与跨系统复用层次 (4 篇)
  • 2026-08-25 — 生成式推荐回到 item 表示,工业侧用显式先验治干扰 (11 篇)
  • 2026-08-26 — 语义 ID 残差量化的路线分歧与工业推荐对齐 (10 篇)
  • 2026-08-27 — 工业推荐 Transformer 扩容:事件 token 化与判别式召回的互斥押注 (7 篇)
  • 2026-08-28 — 在线延迟约束下的重活外挪:离线刷新与权重内化 (9 篇)
  • 2026-08-31 — 工业排序换用 latent hub 交互,收益归因被消融推翻 (4 篇)
  • 2026-09-01 — 语义 ID 与 ANN 双线会师:先修表示,不修量化器 (19 篇)