1. 置换矩阵
上一讲限制了矩阵A可逆且不需要行交换进行LU分解,本节考虑需要行交换情况。
置换矩阵P(Permutation Matrix),即用来完成行交换的矩阵。
若有
n
∗
n
n*n
n∗n的单位矩阵
I
I
I,其总共有
n
!
n!
n!种置换矩阵,
将其中任意两个相乘,结果依然在它们中,并且置换矩阵的逆等于其转置。
对于任意可逆矩阵A(需要行交换),有
P A = L U PA=LU PA=LU
该描述概括了需要行交换以完成LU分解的情况
示例 1:
设
3
×
3
的
I
,其总共有
6
种置换矩阵
P
1
=
[
1
0
0
0
1
0
0
0
1
]
,
P
2
=
[
0
1
0
1
0
0
0
0
1
]
,
P
3
=
[
0
0
1
0
1
0
1
0
0
]
P
4
=
[
1
0
0
0
0
1
0
1
0
]
,
P
5
=
[
0
0
1
1
0
0
0
1
0
]
,
P
6
=
[
0
1
0
0
0
1
1
0
0
]
\begin{aligned} &\text{设}3\times3\text{的}\mathrm{I},\text{其总共有}6\text{种置换矩阵}\\ P_1&=\begin{bmatrix} 1 & 0 & 0\\ 0 & 1 & 0\\ 0 & 0 & 1 \end{bmatrix}, P_2=\begin{bmatrix} 0 & 1 & 0\\ 1 & 0 & 0\\ 0 & 0 & 1 \end{bmatrix}, P_3=\begin{bmatrix} 0 & 0 & 1\\ 0 & 1 & 0\\ 1 & 0 & 0 \end{bmatrix}\\ P_4&=\begin{bmatrix} 1 & 0 & 0\\ 0 & 0 & 1\\ 0 & 1 & 0 \end{bmatrix}, P_5=\begin{bmatrix} 0 & 0 & 1\\ 1 & 0 & 0\\ 0 & 1 & 0 \end{bmatrix}, P_6=\begin{bmatrix} 0 & 1 & 0\\ 0 & 0 & 1\\ 1 & 0 & 0 \end{bmatrix} \end{aligned}
P1P4设3×3的I,其总共有6种置换矩阵=
100010001
,P2=
010100001
,P3=
001010100
=
100001010
,P5=
010001100
,P6=
001100010
对于
P
6
P_6
P6,我们可以得出
P
6
P
6
T
=
I
P_6P_6^T=I
P6P6T=I,所以
P − 1 = P T P^{-1}=P^T P−1=PT
2. 转置矩阵
给一个 m ∗ n m*n m∗n的矩阵A,它的转置矩阵(Transpose Matrix)为一个 n ∗ m n*m n∗m的矩阵,记作 A T A^T AT。
示例 2:
A
=
[
1
3
2
3
4
1
]
,
A
T
=
[
1
2
4
3
3
1
]
(1)
\begin{aligned} A = \left[ \begin{matrix} 1 & 3\\ 2 & 3\\ 4 & 1 \end{matrix} \right], A^T = \left[ \begin{matrix} 1 & 2 & 4\\ 3 & 3 & 1 \end{matrix} \right] \end{aligned} \tag{1}
A=
124331
,AT=[132341](1)
即矩阵的列由对应行构成
2.1 对称矩阵
对于一个矩阵A,如果它的转置等于它本身,那么该矩阵为对称矩阵(Symmetric Matrix),即
A T = A A^T=A AT=A
示例 3:
A
=
[
3
1
7
1
2
9
7
9
4
]
,
A
T
=
[
3
1
7
1
2
9
7
9
4
]
A = \begin{bmatrix} 3 & 1 & 7\\ 1 & 2 & 9\\ 7 & 9 & 4 \end{bmatrix}, A^T = \begin{bmatrix} 3 & 1 & 7\\ 1 & 2 & 9\\ 7 & 9 & 4 \end{bmatrix}
A=
317129794
,AT=
317129794
可以看到它的转置等于它本身,该矩阵即对称矩阵。
那么如何由一个非对称矩阵得到对称矩阵呢?
对于一个非对称矩阵 A A A,我们可以左乘或右乘 A T A^T AT来得到一个对称矩阵。
示例 4:
对例1中的
A
A
A和
A
T
A^T
AT,有
A
A
T
=
[
1
3
2
3
4
1
]
[
1
2
4
3
3
1
]
=
[
10
11
7
11
13
11
7
11
17
]
AA^T = \begin{bmatrix} 1 & 3\\ 2 & 3\\ 4 & 1 \end{bmatrix} \begin{bmatrix} 1 & 2 & 4\\ 3 & 3 & 1 \end{bmatrix}= \begin{bmatrix} 10 & 11 & 7\\ 11 & 13 & 11\\ 7 & 11 & 17 \end{bmatrix}
AAT=
124331
[132341]=
1011711131171117
而
A
T
A
=
[
1
2
4
3
3
1
]
[
1
3
2
3
4
1
]
=
[
21
13
13
19
]
A^TA = \begin{bmatrix} 1 & 2 & 4\\ 3 & 3 & 1 \end{bmatrix} \begin{bmatrix} 1 & 3\\ 2 & 3\\ 4 & 1 \end{bmatrix}= \begin{bmatrix} 21 & 13\\ 13 & 19 \end{bmatrix}
ATA=[132341]
124331
=[21131319]
可以看到左乘和右乘我们可以得到两个不同的对称矩阵。
想要证明此性质,可以用到转置矩阵定理
由于 ( A B ) T = B T A T 且 ( A T ) T = A (AB)^T=B^TA^T且(A^T)^T=A (AB)T=BTAT且(AT)T=A,那么
( A A T ) T = A A T (AA^T)^T=AA^T (AAT)T=AAT
或
( A T A ) T = A T A (A^TA)^T=A^TA (ATA)T=ATA
3. 向量空间和子空间
3.1 向量空间
探讨向量空间,需要用到加法和数乘两种向量运算,本讲这里讨论的均为实向量空间,所有标量均为实数
定义:
一个向量空间(Vector Spaces)是一个非空的对象集合 V V V,这些对象被称为向量(Vector),在其上定义了两种运算,称为加法和数乘(标量为实数),并且满足以下十条公理(或规则)。对于 V V V中的所有向量 u , v , w u,v,w u,v,w 以及所有标量 c c c 和 d d d:
1. u 与 v 的和,记为 u + v ,属于 V 2. u + v = v + u 3. ( u + v ) + w = u + ( v + w ) 4. V 中存在一个零向量 0 ,使得 u + 0 = u 5. 对 V 中的每个 u ,都存在一个向量 − u ,使得 u + ( − u ) = 0 6. u 与标量 c 的数乘,记为 c u ,属于 V 7. c ( u + v ) = c u + c v 8. ( c + d ) u = c u + d u 9. c ( d u ) = ( c d ) u 10.1 u = u \begin{aligned} &1. u与v的和,记为u+v,属于V\\ &2. u+v=v+u\\ &3. (u+v)+w=u+(v+w)\\ &4.V中存在一个零向量0,使得u+0=u\\ &5. 对V中的每个u,都存在一个向量-u,使得u+(-u)=0\\ &6. u与标量c的数乘,记为cu,属于V\\ &7.c(u+v)=cu+cv\\ &8. (c+d)u=cu+du\\ &9.c(du)=(cd)u\\ &10. 1u=u\\ \end{aligned} 1.u与v的和,记为u+v,属于V2.u+v=v+u3.(u+v)+w=u+(v+w)4.V中存在一个零向量0,使得u+0=u5.对V中的每个u,都存在一个向量−u,使得u+(−u)=06.u与标量c的数乘,记为cu,属于V7.c(u+v)=cu+cv8.(c+d)u=cu+du9.c(du)=(cd)u10.1u=u
简而言之,向量空间必须对加法和数乘两种向量运算是封闭的。
规定 R n \mathbb{R}^n Rn为所有 n n n维实向量构成的向量空间。
示例 5:

那么,所有向量空间中都必须存在零向量。
如果我们只取 R 2 \mathbb{R}^2 R2中第一象限的部分作向量集合,对其中某一向量加法或数乘,结果可能不会在该集合中,可知它不构成向量空间。
3.2 子空间
对于 R 2 \mathbb{R}^2 R2,如果取其一部分,不论对其中向量做加法还是数乘,其结果依然在这部分中,那么这就是所谓的子空间(Subspaces),称作 R 2 \mathbb{R}^2 R2中的向量空间或 R 2 \mathbb{R}^2 R2的向量子空间。
示例 2:
在 R 2 \mathbb{R}^2 R2上,设有过原点的直线 l 1 l_1 l1和不过原点的直线 l 2 l_2 l2。

对于
l
1
l_1
l1上的任意向量,进行加法或数乘,所得结果仍在
l
1
l_1
l1上,可知直线
l
1
l_1
l1是
R
2
\mathbb{R}^2
R2的一个子空间。
而
l
2
l_2
l2上的向量乘以
0
0
0,其结果不是
0
0
0,所以
l
2
l_2
l2不构成子空间。
显然,
R
2
\mathbb{R}^2
R2中的直线是子空间当且仅当直线过原点。
现在,我们可以列出 R 2 \mathbb{R}^2 R2中所有子空间:
-
R 2 \mathbb{R}^2 R2, R 2 \mathbb{R}^2 R2 自身是 R 2 \mathbb{R}^2 R2 的子空间(平面)
-
R 2 \mathbb{R}^2 R2 中所有过原点的直线(直线 l l l)
-
零向量(原点 Z Z Z)
接下来想象下, R 3 \mathbb{R}^3 R3的子空间都有哪些:
-
R 3 \mathbb{R}^3 R3, R 3 \mathbb{R}^3 R3自身是 R 3 \mathbb{R}^3 R3的子空间(三维平面)
-
R 3 \mathbb{R}^3 R3中所有过原点的平面(二维平面)
-
R 3 \mathbb{R}^3 R3中所有过原点的直线(直线 l l l)
-
零向量(原点 Z Z Z)
3.2.1 列空间的定义
现在,我们知道了什么是子空间,接下来学习如何从矩阵中构造出一个子空间
首先我们知道向量空间对加法和数乘是封闭的,而列的线性组合包含了加法和数乘两种运算。
由此我们有定义:
矩阵A的列空间(Column Space),记作 C o l A Col A ColA或 C ( A ) C(A) C(A),由 A A A所有列的线性组合构成。
示例 6:
对于矩阵 A = [ 1 3 2 1 4 1 ] ,其列属于 R 3 对于矩阵A = \begin{bmatrix}1&3\\2&1\\4&1\end{bmatrix},其列属于 \mathbb{R}^3 对于矩阵A= 124311 ,其列属于R3
那么该矩阵
A
A
A的所有列线性组合构成了一个
R
3
\mathbb{R}^3
R3中的子空间。
对此的解释是:
向量 [ 1 2 4 ] \begin{bmatrix}1\\2\\4\end{bmatrix} 124 和 [ 3 1 1 ] \begin{bmatrix}3\\1\\1\end{bmatrix} 311 分别构成一条 R 3 \mathbb{R}^3 R3中过原点的直线。
而这两直线构成一个 R 3 \mathbb{R}^3 R3中过原点的平面,该平面即矩阵 A A A的列空间 C ( A ) C(A) C(A)。

2666

被折叠的 条评论
为什么被折叠?



