精读笔记
Problem Setting
这篇论文真正解决的是 AHP pairwise comparison matrix 中一致性指标的 size comparability:当评价项数量 n 改变时,一个 consistency index 的数值是否仍表示同等程度的不一致。
真正困难点不是构造一个满足“完全一致时为 0、否则非负”的指标,这类指标已经很多;困难在于给“规模无关”一个数学上可检验的定义。Saaty CI 用主特征值偏离 n 来度量 inconsistency,但其归一化因子 n-1 并不能说明跨 n 的数值可比。CR 进一步用随机矩阵平均 RI(n) 归一化,但这是一种经验校准,依赖随机生成机制和 Saaty scale 分布,不能直接说明相同 CR 在不同 n 下代表同一结构性不一致。
关键矛盾是:PCM 的一致性约束本质上由三元关系 a_ij a_jk = a_ik 决定,而主流实践用全局谱量和经验阈值来判断。局部三元 inconsistency 与全局规模归一化之间缺少桥接原则。
Motivation
已有路线不够的地方在于,它们默认不同 size 的 PCM 可以用同一阈值比较,但没有说明这个比较应满足什么结构性质。CI≤0.1 或 CR≤0.1 是实践规则,不是 size independence 的定义。
作者的核心观察是:如果一个 n×n PCM 删除一个 item 得到 n 个 (n-1)×(n-1) sub-PCMs,那么这些 sub-PCMs 与原矩阵共享大量 pairwise comparisons。若一个指标声称跨规模可比,它至少应该在这种最自然的嵌套关系下表现稳定。换言之,跨 n 可比不应先从随机矩阵总体均值谈起,而应先从同一判断系统内部的 super/sub 关系谈起。
关键缺口是缺少一个 linking axiom:把 n 维矩阵的一致性值和其 n-1 维主子矩阵的一致性值联系起来。本文的 average-preserving property 就是在填这个空。
Core Idea
论文的核心思想是:把 size independence 定义为 leave-one-out 子矩阵平均一致性的保持。给定 super-PCM A,删除每个 item 得到 A^(s)。如果 c 是规模无关的一致性指标,则要求 c(A)=1/n Σ_s c(A^(s))。这个条件不是从实验拟合来的,而是把“删除一个 item 不应系统性改变一致性尺度”形式化为一个平均不变性约束。
这个想法之所以可能有效,是因为 PCM 的一致性恰好可以分解到三元组上。每个三元组 (i,j,k) 对应一个局部闭环误差 a_ij a_jk / a_ik 及其倒数形式。删除一个 item 后,不包含该 item 的三元组仍然存在。于是每个原三元组会出现在恰好 n-3 个 sub-PCMs 中。只要把总三元误差除以三元组数量 C(n,3),super 的平均局部误差就等于 sub 的平均局部误差均值。
和 prior 的本质区别是:本文不是再发明一个 consistency formula,而是给 CI* 这类三元平均指标补上 size-independence 的公理化解释。它引入的 inductive bias 是“inconsistency 是均匀定义在三元闭环上的局部误差,并应按闭环数量平均”,而不是“inconsistency 是谱半径相对 n 的偏离”。
Method
1. sub-PCM / super-PCM 建模:解决不同矩阵规模之间缺少可比映射的问题。通过删除同一 PCM 的一个 item,作者构造了最小规模变化下的嵌套比较对象。其必要性在于,任意两个不同 n 的 PCM 没有共享结构,无法判断指标差异来自规模还是判断内容。
2. average-preserving property:解决“size-independent”定义不清的问题。它要求 super-PCM 的 index 等于所有 sub-PCMs index 的平均。核心变化是把跨规模可比性从经验阈值转为函数方程。
3. c3 的三元组展开:解决如何找到满足该性质的指标。c3(A)=Σ_{i<j<k}(2-r-r^{-1}),其中 r=a_ij a_jk/a_ik。这个展开把 inconsistency 显式分解为三元闭环误差,使组合计数成为可能。
4. 组合归一化:解决未归一化 -c3 随三元组数量增长而膨胀的问题。由于 sub-PCMs 的 c3 总和为 (n-3)c3(A),选择 p(n)=6/[n(n-1)(n-2)]=1/C(n,3) 后,平均保持恰好成立。结果等价于 CI*。
5. 对 CI 的谱上界分析:解决 CI 与 sub-PCM 关系完全未知的问题。利用主子矩阵谱半径不超过原矩阵谱半径,得到 sub-PCM CI 的线性上界。但这只是 bound,不是 average-preserving。
Key Insight / Why It Works
最关键的 insight 是:AHP 一致性不是天然的 n 维全局对象,而是由所有 3-cycle 的闭环条件生成的。只要接受这一点,size-independent 的自然尺度就不是 n-1,也不是随机 RI(n),而是三元组数量 C(n,3)。CI* 成立的原因不是更复杂,而是其归一化单位和一致性约束的最小生成单元一致。
这篇论文最实质的贡献是把 CI* 的 C(n,3) 归一化从“看起来合理的平均”提升为 super/sub 平均保持的必要结构。这里的有效性来自 better inductive bias:把 inconsistency 建模为三元局部结构的平均,而不是谱半径偏移或随机基准校准。
CI 和 CR 的部分表现更像 scaling 结果。CI 的谱量当然和不一致有关,但它混合了全局矩阵结构、Perron root sensitivity 和维度效应,不保证 leave-one-out 平均稳定。CR 用 RI(n) 修正维度漂移,实验中 n≥5 更接近平均保持,但文中没有给出理论机制。CR 的这部分表现可能主要来自 scaling,与随机 Saaty-scale 分布下的经验均值匹配有关,不应被解读为真正满足 size independence。
辅助部分是随机实验和 CI 上界。实验只是可视化理论结论,不能替代理论证明;CI 上界说明谱指标不会完全失控,但界不紧,且没有解释平均行为。
Relation To Prior Work
最接近的路线有三条:Saaty 的 CI/CR,Shiraishi-Obata-Daigo 基于 characteristic polynomial c3 的指标,以及 Peláez-Lamata 的 CI*。
本文与 Saaty 路线的本质差异在于,Saaty 从 Perron eigenvalue 出发,把不一致看作 λ_max 相对 n 的偏离;本文从三元组闭环出发,把不一致看作局部 cycle error 的平均。CI/CR 的跨规模处理主要是归一化,尤其 CR 是相对于随机矩阵均值的经验校准;本文的跨规模处理是 super/sub 组合不变性。
和 c3 / CI* 路线相比,公式本身并不新。-c3 与 CI* 的比例关系已有文献指出,CI* 本来就是三元误差平均。本文真正新增的信息是:为什么除以 C(n,3) 是 size-independent 的正确归一化,原因是 leave-one-out 子矩阵集合中每个三元组出现 n-3 次。
因此这篇论文属于 consistency index axiomatization / structural normalization 这条谱系,不是新的优化算法,也不是新的 AHP elicitation 方法。看似新的 sub/super-PCM 概念本身比较直接,实质创新在于把它用于定义 average-preserving property,并用它重解释 CI*。
Dataset / Evaluation
实验使用随机生成的 Saaty 17-point scale PCM,规模 n=4 到 7,每个规模若干样本,比较 super-PCM 与 sub-PCMs 在 CI*、CI、CR 下的关系。任务覆盖范围很窄:只覆盖随机离散尺度矩阵,不覆盖真实 AHP 判断数据、不同 elicitation protocol、不同噪声模型或决策后果指标。
evaluation 对核心 claim 的支持是有限但足够的:CI* 的核心 claim 已由定理证明,实验只是验证散点图中 sub 平均落在 y=x。CI/CR 的实验结果只能说明在该随机生成机制下的经验行为,不能证明其一般 size-independence。
benchmark 没有验证更强问题,例如 index 数值是否对应真实决策质量、权重恢复误差、排序稳定性、人工判断修正成本,或是否能定位具体错误比较。论文声称 sub-PCM analysis 可用于发现 impairing comparisons,但实验没有系统验证这一诊断能力。
Limitation
最大限制是 average-preserving property 本身的规范性地位。它是一个清晰、优雅、可证明的公理,但文中未充分说明为什么它应该是 size independence 的核心定义,而不是众多可能定义之一。特别是在实际 AHP 中,删除一个 item 可能改变决策者对剩余 item 的相对判断;sub-PCM 作为“如果一开始就没有该 item 时会得到的矩阵”的假设很强,现实中未必成立。
第二,CI* 的成功依赖于三元闭环误差是唯一或主要 inconsistency 单元。数学上完全一致确实可由所有三元条件刻画,但应用上用户可能关心的是 priority vector 的稳定性、top-rank robustness 或 decision regret。平均三元误差可能掩盖少数极端冲突;论文自己也提到同一 super index 下 sub-index 分布可能差异很大,这意味着单一平均指标并不足以描述结构风险。
第三,CR 的行为解释不足。实验显示 CR 在 n≥5 时更接近 average-preserving,但没有理论说明。增益来源不清,可能主要来自 RI scaling 在该随机分布上的经验匹配。
第四,数值实验不构成强 empirical validation。规模小、随机模型单一、没有真实数据,也没有和错误定位或判断修复任务闭环。它验证的是图形直觉,不是实际 AHP workflow 中的有效性。
第五,本文没有解决阈值问题。即使 CI* 跨 n 平均保持,也不说明 CI*=某个数值时应接受或拒绝判断。size-independent scaling 和 decision threshold calibration 是两个问题。
Takeaway
- 1. 最值得迁移的 insight 是:当一个指标声称跨规模可比时,应先寻找对象之间的嵌套关系,并要求指标在该嵌套操作下满足不变性或平均保持,而不是直接做经验归一化。
- 2. 对 PCM consistency 来说,三元组是更自然的最小结构单元。
- 任何跨 n 指标如果没有按三元闭环数量处理,都会面临尺度解释问题。
- 3. CI* 的价值不在于公式新,而在于它和 consistency constraint 的生成结构对齐。
一句话总结
这篇论文把 AHP 一致性指标的跨规模可比性从经验阈值问题改写为 super/sub-PCM 的组合平均保持问题,并由此给 CI* 的三元组归一化提供了结构性 justification。
