← 返回报告列表

2026-W38 周报

周报 📅 2026-09-14 ~ 2026-09-20
工业增量式上线成主流,收益归因取决于对照组
industrial semantic-id inference-serving parameter-scaling pretrained-lm moe
📊 共 41 篇 · 精读 12

2026-W38 周报

日期范围: 2026-09-14 ~ 2026-09-20

主题: 工业增量式上线成主流,收益归因取决于对照组

标签: industrial · semantic-id · inference-serving · parameter-scaling · pretrained-lm · moe

📊 统计: 共 41 篇 · 精读 12 · 覆盖 6 个工作日

周度综述

本周 41 篇、精读 12(覆盖 9/15–9/22 六个更新日):generative-rec 14、llm 13、discriminative-rec 12、other 6(含交叉计数),工业界 11 篇、学术 30 篇。工业稿高度集中在 9/15、9/17、9/22 三天,9/16 与 9/18 则全为学术且零精读,节奏两极。三条技术主线。其一,语义标识与码本设计仍在被反复改写:淘天 VARG 用簇内价值序做第三位 token,让生成式召回绕开粗排直通最终排序,14 天 A/B GMV +1.45%;百度 UNIQUE 用同容量 16,384 的单层平坦码本替换 128×128 分层 RQ,工业码本资源方差 1510.85→389.57、三场景全量时长 +0.96%;腾讯 ANGLE 干脆改用意图×摘要的两级文本标识做搜索广告召回,消耗 +1.81%。与之呼应的是学术侧那篇 semantic ID 复现研究:效应普遍非单调,没有哪种设计通吃。其二,在固定时延预算下重排成本。阿里 LazFormer 以零初始化残差适配器把生成式预训练迁进工业排序栈,92.63% 稀疏下 A10 吞吐仅降 12.1%;高德 IntBMoE 把 MoE 拆成参与度/执行量/物化量三量,离线物化与输入无关的 block,19ms 均值、P99 38ms 全量上线;Google 则把 YouTube Music 发现位的 Gemini 推理整体离线化,在线只留低延迟 fetch。其三,增量叠加式改造成为上线主路径:Meta LIGE-GR 不动现有 pointwise 排序栈,只在缓存候选表示上叠因果注意力与时长感知 beam 解码,三处改动均可回退,IG Reels 时长 +1.14%。本周值得单记一笔的,是四篇有真实线上部署的工业论文在精读后被下调:UNIQUE 四个消融中三个单独移除即跌破最强 baseline;百度 MuSeR 报 DAU +0.26%,但去掉新引入的 ERNIE+BGE 文本信号后 Recall@500 反低于 baseline NANN,收益来自文本信号而非标题主打的时间压缩与多兴趣;Google 自家 holdback 显示 LLM 提名对互动中性,位级 +22.43% 来自理由文案;Netflix 的反事实可观测性框架则不报任何业务数字。它们共通的缺口是没有等架构对照臂,头条增益归不到标题所主张的机制上——这是对这四篇的观察,不是对工业论文整体的判断。学术侧另有两篇值得跟:Q Labs Untied-Grow 用单轴对照分离模型生长、边界算子与权重共享对 scaling 指数的贡献(惟指数差仅 0.003–0.006,与换优化器同量级);MoME 把记忆寻址从 surface form 改成 hidden state 条件的槽位路由,等参下 val bpb 优于 Bigram 与 VEmbedding。

每日概览

2026-09-15

  • 主题: 工业推荐的收益归因:对照组决定结论成色
  • 论文数: 12 · 精读: 4

2026-09-16

  • 主题: 改模型的没上线,上了线的没改模型:本期零精读
  • 论文数: 6 · 精读: 0

2026-09-17

  • 主题: 增量叠加式改造:真正的杠杆常不在署名机制
  • 论文数: 6 · 精读: 3

2026-09-18

  • 主题: 三篇简读:agent 选数据、几何图 RAG 与画像推荐复现
  • 论文数: 3 · 精读: 0

2026-09-21

  • 主题: 落地约束下的效率取舍:MoE 物化解耦与轻量化建模
  • 论文数: 6 · 精读: 1

2026-09-22

  • 主题: 工业推荐扎堆上线,收益难归因到所提机制
  • 论文数: 8 · 精读: 4