SHAP 与 LIME 是最常用的两类模型可解释性方法。SHAP 基于博弈论 Shapley 值做严格加性的特征归因:
ϕi=∑S⊆N∖{i}∣N∣!∣S∣!(∣N∣−∣S∣−1)![v(S∪{i})−v(S)],其中
v(S) 是特征子集
S 的预测期望,权重
∣N∣!∣S∣!(∣N∣−∣S∣−1)! 是特征
i 在联盟序列中的排列占比;Shapley 值是唯一同时满足效率性、对称性、虚拟性与可加性的归因解,输出被精确分解为
∑iϕi=f(x)−E[f]。TreeSHAP 利用树结构在
O(TLD2) 内精确计算(无需采样),LIME 则拟合局部可解释替代模型
mingL(f,g,πx),在实例
x 的
πx 加权邻域内用稀疏线性/决策树
g 近似
f。