6.2 单步对多步


6.2 单步对多步

本节摘要:单步只估下一时间步,误差不滚入下一步输入。多步要一段未来轨迹,SOURCE 列出迭代、直接多输出、混合。迭代实现简单、误差累积;直接多输出无滚雪球、输出头更大;混合折中。策略选择能翻转模型族排名:循环解码的 LSTM 多步差,不一定是 LSTM 差。

本节目标

阅读完本节,你应当能够:

  1. 画出迭代把预测值喂回输入的路径,并指出累积从哪一步开始显眼
  2. 对照直接多输出的头尺寸与步间一致性
  3. 在 horizon 短、中、长三档给出默认策略
  4. 按 horizon 报告误差,拒绝只报一个平均

一、单步是干净题,多步才是产品题

公交下一班间隔、冷库下一拍温度,单步够用。变电站未来 96 点、港口未来 14 日,是多步。SOURCE 把单步和多步并列,不是进阶关系。很多人用单步模型赢了比赛,上线却要滚 96 步,两套题被焊成一套。

迭代(Recursive):模型只学一步,推理时把 y_hat 当作下一步的 x。训练和推理不一致——训练吃真值(教师强制),推理吃自己的错。错在第一步是小的,滚到第四十步,负荷可能已经离开物理范围。教师强制让训练好做,也掩盖了上线形态。对照应至少有一条“推理时关闭教师强制”的验证曲线。

直接多输出:最后一层吐 H 个数。训练推理一致,无滚雪球。代价是:H 变了要改头;各步损失若简单平均,模型可能牺牲峰值步去讨好容易的近步。可对更远或更贵的步加权。步与步之间没有显式平滑,轨迹可能抖,可用轻平滑或把相邻步差加进损失。

迭代: 训练用真值下一步;推理用预测值下一步 → 训练推理不一致 直接: 训练推理都输出长度为 H 的向量 → 一致,头随 H 变 混合: 前 h 步直接,后面迭代;或分段直接

图 迭代滚雪球对照直接吐出整段

图 迭代滚雪球对照直接吐出整段

二、混合与 Seq2Seq 生成

混合:前几步直接出(准),后面迭代(灵活)。或把长 horizon 切成几段,每段一个直接头。SOURCE 允许混合。我倾向:H 不超过窗口四分之一,直接;更长分段直接;只有不能重训、必须复用旧单步模型时,才纯迭代。

Seq2Seq 把多步看成序列生成:编码器看历史,解码器逐步吐未来。无注意力时有固定向量瓶颈;有注意力则每步可看历史。生成式解码仍可能用教师强制,同样存在训练推理差。计划采样:训练中逐渐用自己的预测替换真值,缓解不一致。这是策略补丁,不是新模型族。

策略 训练推理一致 累积 改 H 的成本 默认当
单步 下一拍决策
迭代 权宜
直接多输出 改头 固定 H
分段直接 段间仍有 长 H
Seq2Seq+注意力 视强制 可减轻 可变长生成

三、按 horizon 报,才能看见策略而不是神话

同一 LSTM,单步 RMSE 低、迭代 96 步已经不可用,结论应写“迭代策略失败”,不要写“LSTM 不能做负荷”。换直接多输出后若误差平了,族可以保留。这是本文集对照主调在 horizon 轴上的落点。

远步本质更难:信息衰减、不确定性涨。带子变宽是诚实,强行把远步 RMSE 压到近步水平,多半过拟合近段形态。业务若其实只决策前 16 步,把损失权重放前 16 步,不要被 96 步平均绑架。

⚠️ 常见坑:验证时用教师强制滚动,数字接近单步;上线关掉强制才发现漂。验证必须模拟上线。
💡 关键直觉:多步首先是策略问题。策略没对照,模型族排名没有意义。

港口 14 日预测,前 3 日直接头、后面用季节朴素或迭代,往往比 14 维一次吐出更稳,因为远日主要是星期结构,不需要网络即兴发挥。

四、策略对照表要和族对照表分开存

两张表。一张锁策略、换族;一张锁族、换策略。混在一张表里,会出现“Transformer 迭代 96 步”对 “MLP 直接 96 步”,胜负无法归因。最小交叉是:MLP 直接、GRU 直接、GRU 迭代。若 GRU 直接已经接近 MLP 直接,迭代再差,结论写策略。若直接全面差,才写族。

教师强制关闭后的验证曲线是多步任务的真实曲线。强制开启的曲线只说明“给定真值前缀时一步预测”的能力,那是单步能力。用单步能力投标多步项目,是切分卡没更新。计划采样作为中间态,要报采样比例,否则不可复现。

远步变宽是诚实。若业务其实只用前几步,把 H 缩短,题目变简单,所有族的误差都会降,这不是进步是改题。改 H 必须改切分卡版本。分段直接:前段网络、后段季节朴素,常常是产品最优。后段不需要即兴发挥时,不要强迫网络即兴。

Seq2Seq 可变长生成适合 H 经常变的场景。H 固定时,直接头更简单,瓶颈故事也不一定成立。不要因为翻译常用编解码,就把预报也做成编解码。形态轴上,固定 H 与可变 H 是不同格。

五、两张表分开:锁策略换族,锁族换策略

最小交叉:MLP 直接、GRU 直接、GRU 迭代。GRU 直接已近 MLP 直接而迭代差,结论写策略。直接全面差才写族。关强制后的曲线才是多步真曲线,开强制只是单步能力。改 H 是改题,必须升切分卡版本。远步变宽诚实;业务只用前几步就缩短 H。分段直接加后段季节朴素常常产品最优。固定 H 不必做成编解码。验证必须模拟上线,否则数字撒谎。

六、策略能翻转族排名

同一 LSTM 单步很好、迭代 96 步不可用,应写迭代失败不是 LSTM 不能做负荷。换直接多输出若平了,族可留。验证关教师强制。H 不超过窗口四分之一优先直接;更长分段;不能重训才纯迭代。近远步损失扯皮时对贵的步加权。远步本质更难,强行压到近步水平多半过拟合。改 H 升切分卡版本。Seq2Seq 适合可变长生成,固定 H 用直接头更简单。两张表分开存,禁止 Transformer 迭代对 MLP 直接这种无法归因的比赛。

问题:验证很好上线漂是不是网络不行?

先问验证有没有关教师强制、有没有按 horizon 报。开强制的好数字是单步能力。迭代抬头写策略失败。直接多输出近远扯皮则加权或分段。改 H 是改题要升版本。H 相对窗口过长时后段季节朴素常常更稳。两张表分开,禁止不同策略不同族混比。SOURCE 写迭代累积、多输出一次吐出、混合结合。产品题是多步时,内部单步比赛的奖杯不能带上线。策略没对照,族排名无意义。

多步对照必须把策略表和族表分开。最小交叉是全连接直接出整段、门控直接出整段、门控迭代。直接已经接近而迭代差,结论写策略;直接全面差才写族。验证关闭教师强制,开强制的好数字只是单步能力。按预测步数报误差,平均会藏后面的漂。长度不超过输入窗口四分之一优先直接;更长分段;不能重训才纯迭代。后段若主要是星期结构,季节朴素可能比网络即兴更稳。改预测步数是改题,切分卡升版本。固定步数不必做成编解码器。产品已经是多步时,内部单步比赛的奖杯不能带上线。策略没对照,模型族排名没有意义。

把策略实验做成交叉表打印件:行是族,列是单步、直接、迭代。禁止只填对角线。验证列注明强制是否关闭。误差按步数画三条曲线。切分卡上的步数与表头一致,改步数即改题。后段季节朴素可以作为第四列策略。打印件缺格不得写某族不能做多步。产品已是多步时,单步奖杯不得出现在部署页。交叉表是为了归因:差在策略还是差在族。归因不清的比赛作废。教师强制关闭是验证模拟上线的最低要求,开着等于没测多步。把打印件钉在切分卡后面,两页一起走版本号。

交叉表缺格不得写不能做多步。强制关闭必须在表注里看见。三条误差曲线贴在表后。第四列季节朴素后段若更好,采用混合策略并升卡。产品多步时部署页删除单步奖杯。归因不清作废。打印件与切分卡同号。改步数先改卡再改表,禁止先改表头充进步。模拟上线是关强制,不是关电脑去值班室看一眼。

交叉表缺格不许下结论。表注必须看见强制关闭。三条曲线贴表后。后段季节朴素更好就采用并升卡。部署页删除单步奖杯。归因不清作废。改步数先改卡。模拟上线等于关强制。打印件与卡同号。禁止先改表头充进步。产品已是多步时,内部单步比赛的数字不得出现在给调度的页上。策略表与族表分开钉在卡后。

关强制的验证若没有单独文件,视为没测多步。曲线抬头而表上只报平均,视为隐瞒策略失败。升卡而未改表头,视为改题充进步。部署页出现单步奖杯,退回。这四条比再解释一遍迭代定义更能挡住上线漂。打印件缺格就不要开会讨论谁不能做多步。

开会前先数交叉表格子。缺格、缺强制关闭注释、缺抬头曲线,三缺一不开会。开了会也只允许补表,不允许当场给某族定罪。定罪必须等到表满且关强制的文件能打开。把这一条写进会议须知,比会后补实验更省事。

须知贴在会议室门上:表不满不开会,开了会只补表。定罪文件必须能打开关强制的验证记录。做不到这三句,多步对照没有资格进入部署讨论。

七、迭代抬头不是网络耻辱

误差随步数抬头,首先是信息衰减,不是循环网络丢人。把抬头当成换注意力结构的理由,会跳过直接多输出和后段季节朴素这两条更便宜的策略。只有直接头也抬头、且后段朴素也抬,才进入这条序列的远步本质上不可预报的结论,那时候应缩短预测步数或改决策,而不是加层。冷库单步题上讨论抬头没有意义,那是切分卡写错。

温故知新

  • 单步不累积;多步才进入产品形态
  • 迭代简单、训练推理不一致、误差抬头
  • 直接多输出一致、头随 H 变、近远步会扯皮
  • 混合与计划采样是策略补丁
  • 按 horizon 报误差,平均会藏漂
  • 验证关闭教师强制,否则数字撒谎

下一节把输出从点拉成区间:调度和备货真正要的往往是带子,不是中心那个点。


作者与出处
原作者: 灏天文库
来源:灏天文库
整理: 灏天文库整理
由灏天文库平台收录,内容或由平台用户上传,仅供学习交流
发布者: 作者: 灏天文库 转发
评论区 (0)
U