DLinear
概述
DLinear 由香港中文大学曾爱玲等提出(AAAI 2023 Oral),用一个简单到令人尴尬的线性模型击败了几乎所有 Transformer 时间序列变体,引发了对"Transformer 是否真的适合时间序列预测"的深刻反思。
关键内容
-
历史背景:2021-2022 年 Transformer 在时间序列预测领域掀起"军备竞赛"——Informer、Autoformer、FEDformer 等纷纷声称取得 SOTA。学术界达成共识:自注意力机制能捕捉长距离依赖,天然适合长期预测。
-
核心质疑:自注意力机制是"置换不变的"(permutation-invariant),而时间序列的核心恰恰是顺序。位置编码这种"事后补救"是否真正有效?
-
DLinear 设计:仅包含单层线性层 + 趋势-季节分解。将输入序列分解为趋势分量和季节分量,分别用线性层映射到预测结果。结构简单到令人尴尬。
-
实验结果:在多个基准数据集上全面超越 Informer、Autoformer、FEDformer 等 Transformer 变体,证明"简单模型 + 正确归纳偏置 > 复杂架构"。
来源
- 16-dlinear-2023-are-transformers-effective — 皇帝的新衣?一个线性模型掀翻了整个 Transformer 时间序列帝国
相关
- Informer — contradicts
- Transformer架构 — contradicts
- PatchTST — compares_to