多维尺度分析中的广义欧几里得模型及相关模型解析
1. 广义欧几里得模型概述
广义欧几里得距离是对加权欧几里得距离的扩展。在广义欧几里得模型中,个体空间定义为 (X_k = G T_k),其中 (T_k) 是一个 (m \times m) 的实值矩阵,不一定是对角矩阵。
1.1 广义欧几里得模型的解释
- 基于奇异值分解的解释 :考虑 (T_k) 的奇异值分解 (T_k = P \Lambda Q’),则变换 (G T_k = G P \Phi Q’) 可以解释为:先对群体空间 (G) 进行 (P) 旋转,然后沿其维度进行 (\Phi) 拉伸。由于我们关注的是 (G T_k) 的距离,最终的 (Q’) 旋转无关紧要。这表明在广义欧几里得模型中,每个个体 (k) 先对群体空间进行旋转和/或反射,然后进行拉伸。与加权欧几里得模型相比,每个个体可以对群体空间的不同维度集进行加权,因此该模型的限制相对较少。
- 其他分解的解释 :Tucker(1972)和 Harshman(1972)提出将 (T_k) 分解为 (T_k = D_k M_k),其中对角矩阵 (D_k) 包含 (T_k) 列元素的标准差。这样,(M_k’ M_k) 的对角元素为 1,可以看作是相关矩阵或斜交维度之间夹角的余弦矩阵。使用这种分解对广义欧几里得模型的解释是,个体空间 (X_k) 可以通过先对群体空间 (G) 的维度进行 (D_k) 拉伸,然后进行 (M_k) 斜交旋转得到。Harshman 和 Lundy(1984)提出了一个所有个体共用一个 (M) 的模型,但该模型与广义欧几里得模型不等价。
1.2 广义欧几里得模型作为距离模型的条件
如果将广义欧几里得模型解释为 (G) 中的距离模型,即 (d_{ijk}^2(G) = (g_i T_k - g_j T_k)’(g_i T_k - g_j T_k) = (g_i - g_j)’ C_k (g_i - g_j)),则 (C_k) 必须是正定的,而不仅仅是半正定的。否则,即使 (i \neq j),也可能得到 (d_{ijk}(G) = 0)。也就是说,如果我们希望每个个体 (k) 从加权欧几里得距离族(数学家有时称之为椭圆距离族)中选择自己特定的距离函数,那么所有维度权重必须为正。如果某些权重为零,则需要稍微改变解释,即个体 (k) 先将 (G) 缩减为子空间,然后在这个可能进一步变换的子空间中计算距离。前者被称为主观度量模型,后者被称为主观变换模型。从实际角度来看,这些区别并不重要,因为在主观度量模型中,通过为某些维度选择极小的权重,(G) 可能几乎被缩减为低秩。
1.3 通过应力拟合广义欧几里得模型
最小化广义欧几里得模型应力的方法与加权欧几里得模型通过应力最小化的方法相同,只是 (X_k) 被限制为 (X_k = G T_k),其中 (T_k) 可以是任何实值的 (m \times m) 矩阵。在算法的第二步,通过最小化 (\sum_k tr (G T_k - X_k)’(G T_k - X_k)) 来施加限制。设 (n \times mK) 矩阵 (X) 包含相邻堆叠的 (X_k),(m \times mK) 矩阵 (T) 包含相邻堆叠的 (T_k),则上述式子等于 (tr (G T - X)’(G T - X))。通过对 (X = P \Phi Q’) 进行奇异值分解,并设置 (G = P_m) 和 (T = \Phi_m Q_m’)(下标 (m) 表示仅取前 (m) 个奇异值和向量),可以解析求解该式。
1.4 Idioscal 模型
广义欧几里得模型在标量积框架中广受欢迎,这种独特的加权模型也称为 Idioscal 模型。在标量积表示中,该模型最小化 (L_{IDIO}(G, T_1, T_2, \ldots, T_K) = \sum_{k=1}^K | B_k - (G T_k)(G T_k)’ |^2 = \sum_{k=1}^K | B_k - G T_k T_k’ G’ |^2 = \sum_{k=1}^K | B_k - G C_k G’ |^2),其中 (T_k T_k’ = C_k) 且 (C_k) 是半正定的。
求解 (C_k) 和 (G) 时,存在多个解。为了得到更唯一的解,Schönemann(1972)提出施加限制 (\frac{1}{K} \sum_{k=1}^K C_k = I)。给定一组任意的 (C_k^ ),可以通过选择变换矩阵 (A) 使得 (K A A’ = C_1^ + \cdots + C_K^*) 来施加该限制。如果该限制成立,则 (\frac{1}{K} \sum_{k=1}^K B_k = G G’)。对于无误差数据,可以通过经典缩放立即求解该方程得到群体空间 (G)。求解每个个体的 (C_k) 也很简单,通过求解 (B_k = G C_k G’) 可得 (C_k = (G’ G)^{-1} G’ B_k G (G’ G)^{-1})。Chaturvedi 和 Carroll(1994)对 (G) 施加了额外的限制,即每行仅包含一个 1,其余为 0,使得 (G) 成为指示矩阵。这种模型称为 Indclus,介于聚类和多维尺度分析之间。
2. 多维尺度分析中的三维模型概述
为了对各种三维模型有更直观的几何理解,下面通过一个简单的例子展示它们如何将公共空间与每个受试者的个体空间联系起来。
2.1 模型介绍
| 模型名称 | 模型表达式 | 特点 |
|---|---|---|
| 恒等模型 | (X_k = G) | 每个受试者空间应等于公共空间,等价于计算平均相异度并进行普通的多维尺度分析。权重图显示所有受试者在所有维度上的维度权重为 1。 |
| 伸缩模型 | (X_k = w_k G) | 允许每个受试者有一个伸缩因子,插入伸缩因子确保个体配置的大小反映拟合度。由于权重在各维度上不变化,权重图中个体的点在一条直线上。 |
| 加权欧几里得模型 | (X_k = G W_k) | 允许每个受试者对公共空间的固定维度进行加权。例如,对于受试者 1,权重 (w_{111} = 1.5) 和 (w_{221} = 0.5);受试者 2,权重 (w_{112} = 0.8) 和 (w_{222} = 1.5);受试者 3,权重 (w_{113} = 1) 和 (w_{223} = 0.3)。权重图将每个受试者显示为一个点,其坐标为维度权重。该模型通过允许每个受试者在各维度上有不等的权重,推广了伸缩模型。 |
| 广义欧几里得模型 | (X_k = G T_k W_k) | 公共空间先旋转到每个个体的主方向,然后进行加权得到个体空间。例如,对于受试者 1,旋转矩阵 (T_1 = \begin{bmatrix} 0.866 & -0.500 \ 0.500 & 0.866 \end{bmatrix}),权重矩阵 (W_1 = \begin{bmatrix} 1.2 & 0.0 \ 0.0 & 0.5 \end{bmatrix}),对应旋转 30°。权重图显示如何从公共空间得到受试者空间,每个受试者的权重向量夹角为 90°,这些向量通过 (T_k’ W_k) 得到。 |
| 降秩模型 | (X_k = G T_k W_k) | 个体空间的秩可以低于公共空间,其中 (G) 是 (n \times m) 矩阵,(T_k) 是 (m \times q) 旋转投影矩阵((q < m)),(W_k) 是 (q \times q) 对角矩阵。例如,公共空间是 3D 立方体,个体空间是 2D((m = 3),(q = 2))。权重图的解释与广义欧几里得模型相同,每个向量的长度表示沿其方向拉伸或收缩以获得该受试者维度的加权因子。 |
2.2 模型关系流程图
graph LR
A[恒等模型] --> B[伸缩模型]
B --> C[加权欧几里得模型]
C --> D[广义欧几里得模型]
D --> E[降秩模型]
通过这个流程图可以清晰地看到这些模型之间的逐步发展和推广关系。恒等模型是最基础的模型,伸缩模型在恒等模型的基础上允许伸缩因子,加权欧几里得模型进一步允许对维度进行加权,广义欧几里得模型增加了旋转操作,降秩模型则允许个体空间的秩低于公共空间。
3. 维度加权模型的代数分析
3.1 Indscal 拟合指标的局限性
Indscal 提供的拟合指标是原始标量积(由 (K) 个矩阵 (B_k) 给出)与再现标量积(由 (\hat{B}_k = G W_k^2 G’) 计算)之间的相关性。MacCallum(1976)通过生成违反 Indscal 模型的数据发现,即使模型不适用,这些相关性通常也非常高。这引发了对该指标能否衡量 Indscal 模型对给定数据集适用性的质疑。
3.2 共同空间条件
3.2.1 数据所需性质
对于主观度量解释,要求 (rank(B_k) = m)(因为 (rank(C_k) = m) 且 (rank(G) = m)),并且 (rank(T_k) = m)。即使在主观变换模型中 (rank(C_k) < m),每个个体空间 (X_k = G T_k) 也必须位于 (G) 的列空间中,即 (X_k) 的列必须是 (G) 的列的线性组合。
3.2.2 实际应用中的近似
在实际应用中,通常只使用 (G) 的前几个维度。但由于模型要求 (rank(B_k) = rank(G) = m),仅使用 (G) 的子空间时,每个 (B_k) 只能被近似。不过,如果丢弃的维度仅代表误差,那么低维的 (G) 应该能够解释每个 (B_k) 的大部分方差,或者至少比随机预期解释更多的方差。
3.2.3 共同空间指标的构建
从几何角度来看,如图 22.2 所示,向量 (x) 投影到由 (G) 的列向量张成的平面上,投影向量 (x_p = G w)(其中 (w’) 是权重向量),残差向量 (x_r = x - x_p) 与 (x_p) 正交。通过一系列推导可得投影矩阵 (P_G),使得 (x_p = P_G x)。
共同空间指标 (v_k) 定义为:(v_k = \frac{tr (P_G B_k P_G)^2}{tr B_k^2}),该指标衡量了共同空间条件在经验上的满足程度。在考虑将 Idioscal 族中的任何模型作为个体数据的解释之前,要求该指标接近 1 或“高”。
3.3 对角条件
3.3.1 条件设定与 (G) 的求解
对维度加权模型 (B_k = G W_k^2 G’) 进一步施加条件 (\frac{1}{K} \sum_{k=1}^K W_k = I),可得到 (\frac{1}{K} \sum_{k} B_k = G G’),从而直接求解 (G)。
3.3.2 (W_k) 的计算与对角化
计算 (W_k) 比计算 (C_k) 更复杂,因为 (W_k) 必须是对角矩阵。首先找到 (C_k),然后尝试将其“对角化”。由于 (G) 仅由一个正交矩阵 (S) 确定(即 (G^ (G^ )’ = G G’)),我们希望找到使 (C_k) 对角化的 (S),即 (S C_k S’ = W_k^2)。这意味着 (S) 和 (W_k^2) 分别是 (C_k) 的特征向量矩阵和特征值矩阵。
3.3.3 对角指标的定义与应用
为了检查数据违反对角条件的程度,定义对角指标 (\delta_k = \frac{tr [\tilde{W}_k^2 - I]^2}{(m - 1)m}),其中 (\tilde{W}_k^2) 是 (W_k^2) 的归一化形式。如果 (W_k) 是对角矩阵,则 (\delta_k = 0);否则,(\delta_k > 0),需要判断其是否仍然可以接受。
3.4 实证应用:Helm 颜色相似性
使用 Cospa 程序对 Helm 颜色数据进行缩放,并计算每个 (k) 的共同空间指标 (v_k) 和对角指标 (\delta_k)。结果如表 22.2 所示。如果模型严格适用,所有个体的 (v_k) 应等于 1,(\delta_k) 应等于 0。虽然实际并非如此,但所有 (v_k) 值都较高,大多数 (\delta_k) 值较小。
颜色缺陷受试者的 (v_k) 指标通常低于颜色正常受试者,这可能是因为前者的数据中“小”维度解释了相对更多的方差,可能是由于数据中的误差方差较大。此外,受试者 s13 的 (\delta_k) 值最差,这反映了该受试者在表 21.3 中的相对较低的公共度值。
Schönemann 等人(1979)通过计算机模拟在各种误差条件下得出了这些指标的统计规范。在最宽松的情况下(相对于模型的“零假设”情况),对于 (m = 2),(n = 10) 和 (N = 16),发现 90% 的 (v_k) 值小于 0.40,而对角指标 90% 的值大于 0.04。Helm 数据的指标分布在随机条件下极不可能出现,这些测试为判断模型适用性提供了大致的指导。
4. 总结
4.1 模型总结
| 模型名称 | 核心特点 | 应用场景 |
|---|---|---|
| 广义欧几里得模型 | 个体空间 (X_k = G T_k),(T_k) 为实值矩阵,可进行旋转和拉伸操作,允许个体对不同维度加权 | 适用于需要考虑个体对维度不同处理方式的场景 |
| Idioscal 模型 | 在标量积框架中,最小化 (L_{IDIO}(G, T_1, \ldots, T_K)),通过施加限制可得到更唯一解 | 用于分析个体独特加权情况 |
| 恒等模型 | (X_k = G),每个受试者空间等于公共空间 | 基础模型,用于简单的平均相异度分析 |
| 伸缩模型 | (X_k = w_k G),允许伸缩因子 | 考虑个体配置大小与拟合度关系的场景 |
| 加权欧几里得模型 | (X_k = G W_k),允许对维度加权 | 分析个体对维度不同权重的情况 |
| 广义欧几里得模型(扩展) | (X_k = G T_k W_k),增加旋转操作 | 处理需要旋转和加权的复杂情况 |
| 降秩模型 | (X_k = G T_k W_k),个体空间秩可低于公共空间 | 适用于个体空间维度较低的场景 |
4.2 指标总结
| 指标名称 | 定义 | 作用 |
|---|---|---|
| 共同空间指标 (v_k) | (v_k = \frac{tr (P_G B_k P_G)^2}{tr B_k^2}) | 衡量数据满足共同空间条件的程度,值接近 1 表示模型可能适用 |
| 对角指标 (\delta_k) | (\delta_k = \frac{tr [\tilde{W}_k^2 - I]^2}{(m - 1)m}) | 检查数据违反对角条件的程度,值接近 0 表示模型可能适用 |
通过对这些模型和指标的深入理解和应用,可以更准确地分析多维数据,揭示数据中的潜在结构和个体差异。同时,在实际应用中,需要根据具体的数据特点和研究目的选择合适的模型和指标进行分析。
超级会员免费看


被折叠的 条评论
为什么被折叠?



