← 返回报告列表

2026-W33 周报

周报 📅 2026-08-10 ~ 2026-08-16
工业增量绕开排序主模型,学术侧标度律分头归因
industrial parameter-scaling knowledge-distillation pretrained-lm cross-domain
📊 共 55 篇 · 精读 15

2026-W33 周报

日期范围: 2026-08-10 ~ 2026-08-16

主题: 工业增量绕开排序主模型,学术侧标度律分头归因

标签: industrial · parameter-scaling · knowledge-distillation · pretrained-lm · cross-domain

📊 统计: 共 55 篇 · 精读 15 · 覆盖 6 个工作日

周度综述

本周 6 份日报共入库 55 篇、精读 15 篇;按日报口径(存在跨类重复)判别式推荐 18、LLM 15、生成式推荐 14、其他 9,其中两批共 12 篇无一涉及线上系统,其余四批的精读名额基本被有线上验证的工业论文占满。第一条主线是工业增量的落点集体移出了排序主模型:Google Discover 的 SDF 把「陈旧性」拆成取代与衰减,用非个性化的物品级过滤器在排序上游剪候选、服务时只查表,两年部署使陈旧举报降 54.9% 并回收 8.74% 服务算力;PayPal 的 SAGA 把六类触点行为归一到统一 schema 预训练,冻结嵌入接下游排序器;快手的 DrEM 纠正融合排序中 pxtr 的双侧噪声,推理零开销;淘宝的 MetaStrategy 让 LLM 生成可执行的排序策略而非物品序列。反向的极点是本周最高分 SONA(Yandex Music),单模型替掉 15 个以上召回器加粗排精排,活跃用户增 4.53%。一边整条吞掉级联、一边绕开排序器在外围加层,共同点是排序主模型自身不再是增量来源。第二条主线是三篇互不引用的论文沿不同轴分头归因 scaling law:MIT 与 EPFL 的 NQF 明确只处理「损失对训练时间」、把「损失对规模」划给他人;FAIR at MSL Meta 与纽约大学的 Small-Scale Experiments 把「小规模律不可靠」的病因从规模改判为超参,每规模 4 个配置时测试 MSE 为 1.30e-2、到 256 个配置才降至 3.70e-6;Amazon 的系统感知扩参把归因移到集群,纯 model-FLOPs 预算下最优稀疏度只贴在边界,换成可交付 FLOPs 后内点最优才浮现。第三条主线是同题异答:SAGA 与已归档 Meta 的 Mosaic 拓扑一致而结论针锋相对,Mosaic 报告专家舰队胜过单一大通才,SAGA 恰恰是那个单一大通才;Small-Scale 与 W32 的 Skaling 同出 FAIR、相隔 5 天互不引用,却分别把外推不可信归因于超参失调与函数形式误设。此外多篇工业论文只有内部数据与相对提升,交不出可复现的基准数字。其余重点是 Meta 的 MARCO,用点击意图分解把分组校准误差消除超 99%。

每日概览

2026-08-11

  • 主题: 工业推荐的控制层转向:LLM 生成可执行策略而非物品序列
  • 论文数: 14 · 精读: 6

2026-08-12

  • 主题: 真实约束重塑最优解:单模型化、系统感知与分组校准
  • 论文数: 11 · 精读: 4

2026-08-13

  • 主题: 训练信号精细化:超参调优前沿与 token 级信用分配
  • 论文数: 6 · 精读: 1

2026-08-14

  • 主题: 训练动力学极小模型与工业排序去噪的双线分野
  • 论文数: 7 · 精读: 2

2026-08-17

  • 主题: 无线上部署的学术日:机理诊断、过程监督与新基准三线并行
  • 论文数: 6 · 精读: 0

2026-08-18

  • 主题: 排序模型之外发力:上游候选过滤与跨域统一用户表征
  • 论文数: 11 · 精读: 2