状态空间模型 Mamba 金融时序:把「历史」压缩成一个状态向量,选择性地记住该记的
Transformer 的注意力是 O(N²) 且训练时看不到未来、推理时还得把整段重新过一遍;RNN 虽是线性复杂度却有梯度消失、难以并行。状态空间模型(SSM,Gu et al. 2021)走中间路线:用连续系统的离散化,把历史压成一个状态向量 h_t 沿时间递推。Mamba(Gu & Dao 2023)再加一招「选择性」——让扫描步长 Δ 由输入决定,模型自己决定「记住什么、忘掉什么」。本文用纯 numpy+scipy 从零实现零阶保持离散化、递归扫描与卷积视角,在「目标被 130 步前事件驱动」的长程依赖合成序列上实测:带持久循环状态的选择性 SSM 预测 MSE=0.50,相对 120 窗口线性基线(2.93)降 82.9%、相对 AR(1)(1.34)降 62.7%——因为循环状态携带了窗口外的回声;并诚实拆穿线性读出下 SSM 不赢线性基线、Δ 选择性是演示近似、状态维度 N 受限、训练不稳、长程衰减五类真实陷阱(中阶)。