精读笔记
Problem Setting
这篇论文处理的是 GNSS-denied 场景下 ground vehicle 的 proprioceptive localization:只有 IMU 和车辆已有本体传感器时,如何在分钟级 outage 内抑制惯导漂移。关键矛盾不是“有没有状态估计器”,而是没有外部绝对 correction 时,IMU bias/noise 会把速度误差积分成位置漂移;而如果引入外部速度传感器、视觉、LiDAR 或基础设施,又违背低成本、易部署的目标。
以前方法卡在两个位置:传统运动学轮速模型便宜但假设太硬,遇到轮胎滑移、动态载荷、非线性侧向运动会失效;学习式 inertial odometry 可以改善短时漂移,但长 outage 里缺少稳定的外部约束。论文实际选择了一个中间路线:不直接学习位姿,而是学习一个可被 EKF 消化的速度量测。这个选择把开放的 localization problem 降维成 velocity correction problem,是全文最重要的建模决策。
Motivation
作者的动机不是 Mamba 本身,而是车上已有 CAN/OSD 信号被低估了。轮速、方向盘角、横摆率、侧向加速度、制动压力这些信号虽然不是高精度定位传感器,但它们对车辆速度,尤其是车体系速度,有强约束。传统模型无法充分利用这些信号之间的非线性和时序关系,外部传感器又带来部署成本。
关键缺口是“可用于滤波的 learned velocity sensor”:已有学习方法可以回归车辆状态,但通常没有给递归估计器一个可信的量测噪声;已有 uncertainty learning 又较少被放进 proprioceptive velocity correction 这个具体闭环里。论文试图补的不是一个单独模块,而是 learned virtual sensor 与经典 ES-EKF 之间的接口。
Core Idea
论文真正的核心思想是:把 onboard vehicle signals 看作一个隐式车辆动力学观测序列,用高效长序列模型估计当前车体系速度,并同时估计该速度量测的不确定度;然后把这个速度作为外部速度传感器的替代品注入 ES-EKF。这样,学习模型负责从复杂本体信号中提取难以建模的动态关系,滤波器负责维持物理一致的状态传播和误差闭环。
和 prior 的本质区别在于它没有让神经网络直接输出轨迹,也没有只做 wheel odometry correction,而是引入了一个“可带协方差的虚拟量测层”。这个 inductive bias 很强:车辆短时定位最需要的是速度约束;速度又正好是车载信号最容易间接观测的量;把不确定度作为 measurement covariance 传给 EKF,可以让网络错误至少在形式上被滤波器调权。Mamba 的角色是让这个虚拟传感器能利用较长历史,同时保持 edge 端实时性。
Method
方法的关键机制可以压缩成三层。
第一层是 sequence-to-one velocity estimation。输入不是 IMU,而是车载 OSD 时间窗口;输出是车体系下平面速度。它解决的是瞬时运动学模型表达力不足的问题。历史窗口允许模型利用转向、制动、横摆、轮速差等动态线索,而不是依赖单帧几何关系。
第二层是 evidential velocity regression。网络不只输出速度均值,还输出 NIG 分布参数,并由此得到 aleatoric 与 epistemic 形式的不确定度。它的必要性在于 EKF 需要 measurement noise;如果 learned velocity 总是以固定置信度进入滤波器,错误预测会直接污染状态。这里的核心变化是把神经网络输出从 point estimate 扩展为 filter-consumable measurement。
第三层是 ES-EKF integration。IMU 仍然做 propagation,EVC-Mamba 只作为车体系速度量测更新状态。这个设计把学习模块的责任边界控制得比较窄:它不需要学习重力、姿态积分或 bias 演化,只需要提供速度 correction。零垂向速度约束也利用了 ground vehicle 的结构先验,但这同时限制了方法适用范围。
Key Insight / Why It Works
这篇论文有效的最可能原因不是 Mamba 的“新颖性”,而是问题分解正确:在 GNSS outage 中,控制速度误差比直接回归位置更稳定;车辆 OSD 对速度有强信息含量;ES-EKF 能把速度约束转化为位置漂移抑制。换句话说,核心贡献是把 learned vehicle dynamics 放在 measurement model,而不是 state propagation 或 pose output。
Mamba 可能带来两类收益:一是长窗口建模下的线性复杂度,使 250-step 级别历史在 edge 上可用;二是 selective SSM 对输入依赖动态有更合适的 inductive bias,能根据转向/制动/轮速状态改变记忆更新。但文中没有充分证明 Mamba 是不可替代的。与 Transformer 的差距存在,但缺少 LSTM、TCN、GRU、S4、轻量 attention 的系统比较;因此“增益来自 selective SSM”这个归因并不完全干净,可能主要来自模型容量、训练设置、窗口长度或数据分布。
Evidential uncertainty 的工程价值很明确:单次 forward 得到量测协方差,适合实时滤波。但它是否真正提升定位鲁棒性,文中证据不足。论文展示了 calibration plot 和 error correlation,但没有给出固定 covariance、learned scalar covariance、ensemble、MC dropout、oracle covariance 等对照,也没有报告滤波一致性指标。因此 uncertainty-aware 更像合理接口设计,而不是已被充分隔离验证的核心性能来源。
最值得迁移的 insight 是 representation alignment:让网络输出经典滤波器天然需要的中间物理量,并附带可信度,而不是端到端替代整个估计系统。这比简单扩大模型或直接学习轨迹更可控,也更容易部署到安全相关系统中。
Relation To Prior Work
这篇工作最接近三条路线:wheel/vehicle odometry correction、learning-based inertial navigation、virtual sensor / vehicle state estimation。它与传统轮速运动学方法的区别是不用固定车辆模型解释所有工况,而是从数据中学习 OSD 到速度的非线性映射。它与 AI-IMU / IONet 类方法的区别是没有直接学习 IMU drift 或位姿增量,而是利用车辆额外本体信号提供速度 correction。它与外部速度传感器方案的区别是用软件虚拟传感器替代硬件 Correvit。
看似新的部分里,Mamba、NIG evidential regression、ES-EKF 都是已有技术;论文的新意主要在组合位置和接口定义:Mamba 用于车载本体信号到速度的时序回归,evidential uncertainty 被转换成 EKF 量测噪声,最终形成一个可部署的 learned correction pipeline。实质创新不是单个算法模块,而是把车辆动态学习、uncertainty quantification 和 error-state filtering 组织成一个虚拟速度传感器框架。
从技术谱系看,它属于 hybrid learning-based state estimation:学习非线性 measurement model,保留 Bayesian filtering 的物理状态递推。相比端到端 inertial odometry,这条路线更保守,但在安全鲁棒场景更可信。
Dataset / Evaluation
Evaluation 使用真实车辆 ReV-StED,包含 IMU、外部速度传感器、RTK/INS ground truth 和车载 OSD,这一点比纯公开视觉/IMU benchmark 更贴近论文 claim。实验也覆盖不同 GNSS outage duration,并用 Correvit 作为实际硬件上界,因此能说明:在该车辆、该数据集、该传感器配置下,虚拟速度 correction 确实能显著降低漂移,并接近专用速度传感器。
但 benchmark 的支撑范围有限。训练/验证/测试来自同一数据源和同一平台,不能证明跨车辆、跨传感器布置、跨路面附着、跨轮胎状态或跨驾驶风格的泛化。任务也主要是单一 localization setting,而不是多城市、多天气、多平台的 deployment benchmark。论文声称 real-time onboard deployment 是可信的,因为 Orin latency 和 FLOPs 给出了证据;但“安全鲁棒”的 claim 只被部分支持,尚未经过故障注入、OOD 工况和滤波一致性验证。
另外,最大位置漂移是合理但不充分的指标。对 uncertainty-aware filtering 来说,更关键的是 calibration 在闭环滤波中的作用,例如创新统计、NEES/NIS、一致性、错误高置信预测时的恢复能力。文中未充分说明这些。
Limitation
第一,方法强依赖 OSD 与目标速度之间的稳定统计关系。换车、换轮胎、改变底盘控制、传感器标定漂移、低附着路面或强滑移时,这个映射可能明显变化。论文未来工作提 transfer learning,实际上说明当前泛化还没有解决。
第二,核心能力可能主要来自数据覆盖。ReV-StED 如果覆盖的动态范围有限,模型学到的可能是该平台上的经验映射,而不是可迁移车辆动力学。所谓长时序建模在常规驾驶中也可能主要是在做 implicit regime recognition,而非真正物理状态推断。
第三,不确定度的可靠性没有被闭环证明。Evidential regression 容易产生看似 calibrated 的分布,但在 OOD 下可能过度自信;如果协方差错误,EKF 会以错误权重融合虚拟量测。文中没有充分说明 uncertainty 在极端场景下是否能保护滤波器。
第四,增益归因不清。EVC-Mamba 优于 Transformer 和 OSD baseline,但缺少足够 ablation 来区分 Mamba、窗口长度、模型大小、loss、uncertainty covariance、EKF 调参各自贡献。部分性能提升可能只是 engineering / scaling,而不是方法论突破。
第五,方法把问题从“需要外部传感器”转移为“需要高质量平台数据和维护 learned virtual sensor”。这在量产部署中不是免费成本:数据采集、标定、域适配、在线监控和安全验证都会成为主要难点。
Takeaway
- 1. 最值得记住的是建模边界:让学习模块预测 velocity measurement,而不是整条轨迹,是一个很强且实用的 inductive bias。
- 2. 对 GNSS-denied vehicle localization,车载本体信号本身可能足以构造接近外部速度传感器的 correction;未来价值不在更大网络,而在跨平台泛化和 OOD 可信度。
- 3. Evidential uncertainty 与 EKF 的接口方向值得迁移,但必须用闭环一致性和故障场景验证,否则它只是一个漂亮的 covariance generator。
- 4. Mamba 在这里的意义主要是高效长历史建模。
一句话总结
这篇论文把 GNSS-denied 车辆定位中的学习问题重新定位为“带不确定度的虚拟速度传感器”构建,是一类保守但实用的 hybrid learning-state-estimation 演化,而非端到端定位模型的突破。
