导读:
行列式是由矩阵元素构成的标量值,用于描述矩阵的性质,如可逆性和线性变换的面积或体积变化。本文将全面解读全面解读行列式,包括行列式的定义,行列式的起源,行列式的性质以及应用,行列式的本质,行列式与方阵可逆。阿基米德曾经说过:“给我一个支点,我可以翘起地球”。在我看来,行列式就是一个支点,它可以撬动整个线性代数这个学科。我希望,广大的考研学子以“行列式”为中心,串联其他的知识点,从而吃透线性代数,最终在考试过程中考出高分。本文内容丰富,总计有15小节,日后还会增加更多内容,大家记得多回来看看!
1、行列式的定义
设 $A=(a_{ij})$是数域 $P$ 上的 $n$ 阶矩阵,则由矩阵 A的所有元素构成的行列式称为矩阵 $A$ 的行列式,记作 $|A|$或 $det(A)$。需要注意的是:行列式是一个标量,而矩阵本身是一个二维数组。
2、行列式符号$det(A)$的起源故事
det 是英文 determinant(行列式)的缩写,它之所以叫这个名字,是因为它最初的核心作用就是决定(determine)一个线性方程组是否有唯一解。
这个命名来自法国数学家柯西(Cauchy),他在1812年左右系统地定义了现代意义上的行列式并使用了“determinant”一词。而选择这个词,是因为在此之前,数学家们已经发现,在解线性方程组时,一个由系数组成的特定算式扮演着决定性的角色。
这个决定性体现在哪里呢?最直接的例子就是克莱姆法则(Cramer's Rule),它用于求解未知数个数和方程个数相等的线性方程组。
对于方程组 $Ax = b$,克莱姆法则给出了每个未知数的解:
$$x_i = \frac{\det(A_i)}{\det(A)}$$
- 分母是关键:所有解的分母都是系数矩阵 $A$ 的行列式 $\det(A)$。
- 决定解的情况:如果 $\det(A) \neq 0$,方程组就有唯一解;如果 $\det(A) = 0$,方程组就没有解或者有无穷多解。
因此,正是这个算式决定了方程组解的结构和性质,所以柯西用“determinant”来命名它,意即“决定因素”。
顺着这个思路,你就能理解为什么行列式的值在很多地方都扮演着“决定者”的角色:
- 它决定了矩阵是否可逆($\det(A) \neq 0$ 则可逆)。
- 它决定了矩阵的列(或行)向量组是否线性相关($\det(A) = 0$ 则相关)。
- 它也决定了线性变换对图形面积或体积的缩放比例。
至于中文名“行列式”,则是从日文翻译而来,与“determinant”的“决定性”含义并无直接关系。
3、为什么用绝对值$|A|$来表示行列式呢?
这是一个非常敏锐的观察。从严格的数学符号学来说,行列式记号中的两条竖线 |A| 与“绝对值”并无任何关系,它们只是恰好“撞脸”了。
这纯粹是一个历史遗留的符号冲突,原因如下:
(1)历史渊源:由“长度”衍生而来
行列式的早期雏形诞生于莱布尼茨和克拉默的时代,当时它被用来表示线性方程组解的分母(一个由系数构成的特定算式)。那个时代的数学家习惯用两边的竖线来表示一个“确定的数值”或“模”(类似于向量的长度)。柯西在正式定义行列式时,沿用了这种记号,用 $|A|$ 来代表那个由矩阵元素计算出的确定数值。
(2)冲突的根源:两个“竖线”诞生于不同领域
问题的关键在于,“绝对值”的概念比“行列式”出现得晚。19世纪中期,数学家魏尔斯特拉斯(Weierstrass)才正式引入了“绝对值”的概念,用来表示实数或复数到原点的距离,并选用了两条竖线 $|x|$ 作为记号。此时,行列式的记号 $|A|$ 已经在数学界使用了近半个世纪,并且已经固定下来。
(3)为什么没有改掉它?
尽管后来的数学家意识到了这个符号冲突(甚至伟大的数学家外尔(Weyl)曾明确批评过这个记号容易引起混乱),但约定俗成的力量太强大了。在纯粹的代数教材中,作者可以通过语境轻松区分:如果竖线里是一个数(如 $|-5|$),那就是绝对值;如果竖线里是一个方阵(如 $|A|$),那就是行列式。为了避免这种混淆,现代很多高等教材(尤其是国际版)已经开始用 $\det(A)$ 来代替 $|A|$。只有在手写或初等线性代数课本中,为了书写方便,才保留了两条竖线的写法。
结论:用 $|A|$ 表示行列式,并不是因为它有“绝对值”的几何意义(行列式表示体积缩放,而绝对值表示距离),纯粹是因为发明行列式记号时,绝对值这个概念还没诞生。等到绝对值需要选符号时,发现“好用的竖线”已经被占用了,于是就形成了现在这种“同一个符号,不同含义”的尴尬局面。
4、行列式这个概念感觉很抽象,是怎么被发明出来的呢?
行列式确实是一个比较抽象的概念,但它的诞生其实非常“接地气”——它源于解线性方程组的需求。
4.1、最初的动机:解二元一次方程组
考虑一个简单的二元线性方程组:
$$ \begin{cases} a_1 x + b_1 y = c_1 \\ a_2 x + b_2 y = c_2 \end{cases} $$
用消元法解出 $x$ 和 $y$,我们会得到:
$$ x = \frac{c_1 b_2 - c_2 b_1}{a_1 b_2 - a_2 b_1}, \quad y = \frac{a_1 c_2 - a_2 c_1}{a_1 b_2 - a_2 b_1} $$
人们发现,分母中的表达式 $a_1 b_2 - a_2 b_1$ 反复出现。如果它等于零,方程组就没有唯一解。于是数学家给这个表达式起了一个名字——行列式。
对于二元情形,它对应着系数矩阵:
$$ \begin{vmatrix} a_1 & b_1 \\ a_2 & b_2 \end{vmatrix} = a_1 b_2 - a_2 b_1 $$
4.2、历史脉络
莱布尼茨(17 世纪)
德国数学家莱布尼茨在 1693 年前后,在研究解线性方程组时,独立地发现了用行列式表示解的方法。不过他的工作当时没有公开发表,所以影响有限。
关孝和(17 世纪)
几乎同时期,日本数学家关孝和也在研究方程组时独立引入了行列式的概念,并且推广到了更高阶的情形。这体现了数学发展中的“殊途同归”。
克莱姆(18 世纪)
瑞士数学家克莱姆在 1750 年发表了著名的克莱姆法则,用行列式系统性地表示线性方程组的解。虽然莱布尼茨和关孝和更早触及这一概念,但克莱姆的工作让行列式真正进入了数学主流。
范德蒙德、拉普拉斯、柯西(18–19 世纪)
随后,范德蒙德将行列式从解方程组的工具中独立出来,作为独立的研究对象进行研究。拉普拉斯发展了行列式的展开定理。到了柯西,他首次使用了现代意义上的“行列式”(déterminant)这一术语,并建立了系统的理论。
4.3、从“工具”到“独立概念”
行列式最初只是解方程组时的一个“副产品”——一个出现在分母里的表达式。但数学家逐渐发现,这个表达式本身具有非常优美和深刻的结构:
- 它只依赖于系数矩阵,与等号右边的常数项无关
- 它可以判断方程组有没有唯一解
- 它满足乘法性质:$\det(AB) = \det(A) \det(B)$
- 它与面积、体积有着天然的几何联系
于是行列式从“解方程的工具”逐渐演变为线性代数中的核心研究对象。
4.4、几何直觉的呼应
以二阶行列式为例:
$$ \begin{vmatrix} a & b \\ c & d \end{vmatrix} = ad - bc $$
它的绝对值恰好等于由向量 $(a, c)$ 和 $(b, d)$ 张成的平行四边形的有向面积。这一几何解释让行列式不再只是代数符号的堆砌,而具有了直观的意义:它衡量线性变换对空间“体积”的伸缩效应。
4.5、总结
行列式的发明路径可以概括为:
解方程组 → 发现反复出现的表达式 → 给它命名 → 研究它的性质 → 发现它的几何意义 → 成为独立的核心概念
所以,行列式看似抽象,但它的“出生证明”上写得很清楚:它是为了解线性方程组而生的,后来才被赋予了更广泛的数学意义。
5、行列式的数学定义是什么?
行列式的定义有多种等价方式,从具体到抽象、从计算到理论,层层递进。
5.1、二阶与三阶:最直观的定义
二阶行列式
对于 $2 \times 2$ 矩阵:
$$ A = \begin{pmatrix} a_{11} & a_{12} \\ a_{21} & a_{22} \end{pmatrix} $$
其行列式定义为:
$$ \det(A) = \begin{vmatrix} a_{11} & a_{12} \\ a_{21} & a_{22} \end{vmatrix} = a_{11}a_{22} - a_{12}a_{21} $$
三阶行列式
对于 $3 \times 3$ 矩阵,可以用对角线法则(萨鲁斯法则)记忆:
$$ \begin{vmatrix} a_{11} & a_{12} & a_{13} \\ a_{21} & a_{22} & a_{23} \\ a_{31} & a_{32} & a_{33} \end{vmatrix} = a_{11}a_{22}a_{33} + a_{12}a_{23}a_{31} + a_{13}a_{21}a_{32} - a_{13}a_{22}a_{31} - a_{12}a_{21}a_{33} - a_{11}a_{23}a_{32} $$
但这种方法不能推广到四阶及以上。
5.2、一般定义:按行(列)展开(递归定义)
对于 $n \times n$ 矩阵 $A = (a_{ij})$,行列式可以递归地定义:
按第一行展开
$$ \det(A) = \sum_{j=1}^{n} (-1)^{1+j} a_{1j} M_{1j} $$
其中 $M_{1j}$ 是划去第 1 行和第 $j$ 列后剩下的 $(n-1) \times (n-1)$ 子矩阵的行列式,称为余子式。
更一般地,按第 $i$ 行展开:
$$ \det(A) = \sum_{j=1}^{n} (-1)^{i+j} a_{ij} M_{ij} $$
按第 $j$ 列展开:
$$ \det(A) = \sum_{i=1}^{n} (-1)^{i+j} a_{ij} M_{ij} $$
其中 $C_{ij} = (-1)^{i+j} M_{ij}$ 称为代数余子式。
一阶行列式(递归终点)
$$ \det(a_{11}) = a_{11} $$
这样,任意高阶行列式都可以逐步降阶,最终化为一阶行列式的计算。
6、递归思想求解任意高阶行列式
我们知道,任意高阶行列式都可以逐步降阶,最终化为一阶行列式的计算。很多人对此感到疑惑,其实,大家感到困惑是很正常的,因为这涉及到递归的思想。请看下文的一步步拆解。
6.1、什么是“递归”?
递归就是:用更小规模的同类问题来定义当前问题。
对于行列式来说:
- 计算 $n$ 阶行列式,需要先会算 $(n-1)$ 阶行列式
- 计算 $(n-1)$ 阶行列式,需要先会算 $(n-2)$ 阶行列式
- ……
- 一直降到 $1$ 阶行列式,而 $1$ 阶行列式的定义直接给出了答案
6.2、一阶行列式是什么?
一个 $1 \times 1$ 的矩阵就是一个单独的数:
$$ A = (a_{11}) $$
它的行列式被定义为这个数本身:
$$ \det(a_{11}) = a_{11} $$
这是整个递归过程的终点,也是最底层的“地基”。
6.3、一个具体的降阶例子:三阶行列式
假设我们要计算:
$$ D = \begin{vmatrix} 1 & 2 & 3 \\ 4 & 5 & 6 \\ 7 & 8 & 9 \end{vmatrix} $$
第一步:按第一行展开(降到二阶)
$$ D = (-1)^{1+1} \cdot 1 \cdot \begin{vmatrix} 5 & 6 \\ 8 & 9 \end{vmatrix} + (-1)^{1+2} \cdot 2 \cdot \begin{vmatrix} 4 & 6 \\ 7 & 9 \end{vmatrix} + (-1)^{1+3} \cdot 3 \cdot \begin{vmatrix} 4 & 5 \\ 7 & 8 \end{vmatrix} $$
现在问题变成了计算三个二阶行列式。
第二步:计算二阶行列式(降到一阶)
以第一个二阶行列式为例:
$$ \begin{vmatrix} 5 & 6 \\ 8 & 9 \end{vmatrix} = 5 \cdot 9 - 6 \cdot 8 = 45 - 48 = -3 $$
注意,二阶行列式 $ad - bc$ 本质上也是按第一行展开:
$$ \begin{vmatrix} a & b \\ c & d \end{vmatrix} = (-1)^{1+1} a \det(d) + (-1)^{1+2} b \det(c) = ad - bc $$
这里的 $\det(d) = d$ 和 $\det(c) = c$ 就是一阶行列式。
第三步:继续算出其余二阶行列式
$$ \begin{vmatrix} 4 & 6 \\ 7 & 9 \end{vmatrix} = 4 \cdot 9 - 6 \cdot 7 = 36 - 42 = -6 $$
$$ \begin{vmatrix} 4 & 5 \\ 7 & 8 \end{vmatrix} = 4 \cdot 8 - 5 \cdot 7 = 32 - 35 = -3 $$
第四步:代回第一行的展开式
$$ D = 1 \cdot (-3) - 2 \cdot (-6) + 3 \cdot (-3) = -3 + 12 - 9 = 0 $$
所以:
$$ \begin{vmatrix} 1 & 2 & 3 \\ 4 & 5 & 6 \\ 7 & 8 & 9 \end{vmatrix} = 0 $$
6.4、降阶过程的直观图示
三阶行列式
│
│ 按第一行展开
▼
三个二阶行列式
│
│ 每个二阶行列式按第一行展开
▼
若干个一阶行列式(就是单独的数)
│
│ 直接取值
▼
得到最终结果
6.5、关键点总结
- $1$ 阶行列式是递归的终点:$\det(a_{11}) = a_{11}$,不需要再展开
- $2$ 阶行列式可以看作两个 $1$ 阶行列式的组合:$ad - bc = a \cdot \det(d) - b \cdot \det(c)$
- $3$ 阶行列式可以看作三个 $2$ 阶行列式的组合
- $n$ 阶行列式可以看作 $n$ 个 $(n-1)$ 阶行列式的组合
所以“任意高阶行列式都可以逐步降阶,最终化为一阶行列式的计算”的意思就是:通过反复套用展开公式,把大行列式拆成小行列式,直到拆成一个个单独的数,然后直接取值,再逐层代回算出结果。
7、行列式的本质是什么?
行列式本质上是一个数,它由一个方阵计算而来,用来刻画这个方阵所代表的线性变换对空间“体积”的伸缩程度。
可以从三个角度来理解:
- 1、代数角度:行列式是矩阵的一个标量函数,它包含了矩阵的很多关键信息。最重要的性质是:一个方阵可逆当且仅当其行列式不等于零。
- 2、几何角度:对于一个 $n \times n$ 的矩阵,它代表一个线性变换。这个变换作用在空间中的几何体上,会把原来的“体积”放大或缩小。行列式的绝对值就是这个体积的缩放倍数。如果行列式为负数,说明空间的方向发生了翻转;如果行列式为零,说明空间被“压扁”了,维度降低,信息丢失,变换不可逆。
- 3、历史角度:行列式最早是在解线性方程组时被发现的。对于方程组 $Ax = b$,解的分母中会出现一个由系数矩阵决定的表达式,这个表达式是否为零决定了方程组有没有唯一解。这个表达式后来就被称为行列式。
所以简单说:行列式是方阵的一个数值,它告诉你这个矩阵对空间体积的影响,也告诉你这个矩阵是否可逆。
8、行列式的性质
行列式是线性代数中一个非常重要的概念,它有很多有用的性质。掌握这些性质,可以大大简化行列式的计算,并帮助理解矩阵的特性。以下是行列式的主要性质,我们以 $n \times n$ 的方阵 $A$ 为例,记其行列式为 $\det(A)$ 或 $|A|$。
(1)行列式与转置:一个矩阵的行列式等于其转置矩阵的行列式。
$$\det(A) = \det(A^T)$$
这意味着,行列式中行和列的地位是对称的。所有对“行”成立的性质,对“列”也同样成立。
(2)行列式的乘法性质:两个矩阵乘积的行列式等于它们各自行列式的乘积。
$$\det(AB) = \det(A)\det(B)$$
由此可以推出(当 $A$ 可逆时):
$$\det(A^{-1}) = \frac{1}{\det(A)}$$
(3)初等变换对行列式的影响,这是计算行列式最核心的性质。矩阵的三种基本行变换对行列式的影响如下:
- (3.1)交换两行(或列):行列式的值变号。
$$R_i \leftrightarrow R_j \implies \det(A) \rightarrow -\det(A)$$ - (3.2)某一行(或列)乘以一个标量 $k$:行列式的值变为原来的 $k$ 倍。
$$R_i \rightarrow kR_i \implies \det(A) \rightarrow k\det(A)$$ 由此可以推出:$\det(kA) = k^n \det(A)$。 - (3.3)某一行(或列)的倍数加到另一行(或列)上:行列式的值不变。
$$R_i \rightarrow R_i + kR_j \implies \det(A) \rightarrow \det(A)$$ 这是化简行列式最常用的性质。
(4)行列式的结构性质
- (4.1)单位矩阵:单位矩阵 $I$ 的行列式为 1。
$$\det(I) = 1$$ - (4.2)对角矩阵和三角矩阵:其行列式等于主对角线上所有元素的乘积。
$$\det(A) = a_{11} \cdot a_{22} \cdots a_{nn}$$ - (4.3)零行或零列:如果矩阵有一行或一列全为零,则行列式为零。
- (4.4)两行(列)相等或成比例:如果矩阵有两行或两列完全相同或成比例,则行列式为零。
- (4.5)线性相关性:如果矩阵的任意一行(列)是其他行(列)的线性组合(即行或列向量线性相关),则行列式为零。这与“矩阵不可逆”是等价的。
9、行列式的实际应用
这些性质的主要应用在于:
1、计算化简:利用“倍加不变”和“交换变号”的性质,将矩阵化为上三角矩阵,然后计算对角线的乘积即可。这是计算机和手算最常用的方法。
2、判断可逆性:
$$A \text{ 可逆} \iff \det(A) \ne 0$$
3、求解特征值:通过求解特征方程 $\det(A - \lambda I) = 0$ 来找到矩阵的特征值。
4、几何意义:对于一个 $n \times n$ 矩阵,其行列式的绝对值表示由列(或行)向量张成的 $n$ 维平行多面体的“有向”体积。
10、为什么矩阵可逆跟行列式有关系?
这个问题问到了线性代数的核心。要理解“矩阵可逆”和“行列式不为零”为什么等价,我们不能只记住公式,要从几何意义和代数本质两个层面来看。本文尽量用直观的方式帮大家把这个问题“看”明白。
10.1、从几何角度看(最直观)
把矩阵想象成一个“空间变换器”。一个 $n \times n$ 的矩阵,作用在向量上,就是对空间进行拉伸、旋转、挤压。
- 行列式的绝对值:代表变换后,空间的“体积”变成了原来的多少倍。
- 行列式的正负:代表变换后,空间有没有被“翻转”(比如左手系变右手系)。
现在回答你的问题:
- 如果 行列式 $\neq 0$,意味着变换后体积没有变成 0。这说明原来的空间被映射后,仍然是一个完整的 $n$ 维空间。既然是满射,变换就是一一对应的,所以你能找到唯一的逆变换把它变回来——矩阵可逆。
- 如果 行列式 $= 0$,意味着变换后体积被压扁了(比如三维空间被压成了一个平面或一条线)。这时候,很多不同的输入向量会映射到同一个输出点上,信息丢失了。既然无法区分输入,自然就找不到唯一的逆变换——矩阵不可逆(奇异)。
一句口诀:行列式是“缩放因子”,只要没把空间压扁(因子不为0),就能原路退回去(可逆)。
10.2、从解方程的角度看(最代数)
我们解方程 $Ax = b$。
- 如果 行列式 $\neq 0$,根据克莱姆法则,每一个未知数 $x_i$ 都能写成两个行列式的比值,分母正是 $\det(A)$。分母不为 0,方程有唯一解。既然对任意 $b$ 都有唯一解,那 $A$ 自然可逆。
- 如果 行列式 $= 0$,那么齐次方程 $Ax = 0$ 一定有非零解(因为矩阵列向量线性相关)。这意味着 $A$ 把非零向量映射成了零向量,相当于“杀死”了这些向量。一个会“杀死”向量的矩阵,不可能有逆矩阵(因为逆矩阵没法把零变回那个非零向量)。
10.3、从行列式的乘积性质看(最本质)
数学上最核心的一个性质是:
$$ \det(AB) = \det(A) \cdot \det(B) $$
如果 $A$ 可逆,那么存在 $A^{-1}$ 使得 $A \cdot A^{-1} = I$(单位矩阵)。
两边同时取行列式:
$$ \det(A) \cdot \det(A^{-1}) = \det(I) = 1 $$
从这个等式你可以直接看出:两个数的乘积等于 1,那么 $\det(A)$ 绝对不可能等于 0。反过来,如果 $\det(A) \neq 0$,我们就能构造出它的逆矩阵(即伴随矩阵除以行列式),这也证明了充分性。
10.4、总结一下三者的逻辑链
矩阵可逆 $\iff$ 变换不降维(不压扁) $\iff$ 列向量线性无关 $\iff$ 体积缩放倍数不为0 $\iff$ 行列式 $\neq$ 0
它们描述的是同一个事实的五个侧面。
11、为什么行列式只分等于零和不等于零这两种情况?
因为行列式的数值本身的大小不重要,重要的是它是否为零。这背后有深刻的数学原因:
11.1、行列式等于零 ⇔ 矩阵不可逆
这是线性代数中最核心的定理之一:
- $\det(A) \neq 0$ ⇔ 矩阵 $A$ 可逆(满秩、非奇异)
- $\det(A) = 0$ ⇔ 矩阵 $A$ 不可逆(降秩、奇异)
行列式的数值大小(比如是 3 还是 100)并没有本质区别,因为它们都只是说明“矩阵可逆”。真正关键的是零与非零的分界。
11.2、几何意义:体积是否退化
行列式的绝对值表示线性变换对体积的伸缩倍数:
- $\det \neq 0$:变换后空间没有被“压扁”,维度不变,变换可逆
- $\det = 0$:变换把空间压到了更低维度(比如三维压成平面),信息丢失,不可逆
所以本质上只有两种情况:空间有没有被压扁。
11.3、线性方程组的解
对于方程组 $Ax = b$:
- $\det(A) \neq 0$:唯一解
- $\det(A) = 0$:无解或无穷多解(需要进一步判断)
行列式只需告诉我们“能不能唯一解出”,具体数值无关紧要。
11.4、特征值角度
$$ \det(A) = \lambda_1 \lambda_2 \cdots \lambda_n $$
- $\det = 0$ ⇔ 至少有一个特征值为 0 ⇔ 存在非零向量被映射为零向量(核空间非平凡)
- $\det \neq 0$ ⇔ 所有特征值都不为零
这又是一个“有/无”的二元判断。
11.5、总结
行列式的值本身是连续的,但它的定性意义是二元的:零 vs 非零。这就像问“一个数是不是 0”——虽然数可以有很多值,但“是否为零”只有两种答案,而这个答案决定了矩阵最本质的性质。
不过,在某些应用中(如计算面积、体积的具体倍数),行列式的具体数值也是有意义的,但在判断可逆性、解的结构等核心问题时,只需要关注零与非零即可。
12、行列式不能用于任意矩阵吗?只能是方阵吗?
是的,行列式只能对方阵定义。
12.1、为什么必须是方阵?
(1)本质原因:行列式描述的是“同一个空间”的变换
一个矩阵 $A$ 代表一个线性变换。如果 $A$ 是 $m \times n$ 的,那么它把一个 $n$ 维向量变成 $m$ 维向量,即:
$$ T: \mathbb{R}^n \to \mathbb{R}^m $$
而“体积”这个概念,只有在变换前后空间维度相同时才有意义。
- 方阵($n \times n$):$\mathbb{R}^n \to \mathbb{R}^n$,可以比较变换前后同一个空间中的体积变化。
- 非方阵($m \times n$,$m \neq n$):从 $n$ 维空间到 $m$ 维空间,维度变了,“体积的伸缩倍数”这个概念就不成立了。
比如一个 $2 \times 3$ 矩阵,它把三维空间映射到二维平面。三维物体的体积被“压扁”成二维面积,你无法用一个数来表示“三维体积变成了多少二维面积”。
(2)从定义本身看
回顾行列式的定义:
- 按行展开:需要矩阵的行数和列数相等,才能每次划去一行一列后仍然得到一个方阵。
- 全排列定义:$\sum_{\sigma \in S_n} \prod_{i=1}^{n} a_{i,\sigma(i)}$,这里要求行指标 $i$ 和列指标 $\sigma(i)$ 都从 $1$ 到 $n$ 遍历,行数和列数必须相同。
- 公理化定义:要求对每一列都是线性的,交换列要变号,这同样隐含了方阵的前提。
所以从任何定义方式出发,非方阵都无法定义行列式。
(3)非方阵有没有类似的概念?
虽然行列式只对方阵有定义,但对于非方阵,人们研究了其他一些相关但不同的量:
- 秩:对所有矩阵(包括非方阵)都有定义,表示矩阵映射后像空间的维度。秩小于行数和列数中的较小值,就说明空间被“压扁”了。这在一定程度上起了类似“行列式是否为零”的作用。
- 广义行列式 / 伪行列式:在某些特定场合(如矩形对角矩阵),可以定义对角线上非零元素的乘积的平方根等,但这并不是标准的行列式。
- Gram 行列式:对于一组向量,可以构造 $A^T A$(当 $A$ 的列数少于行数时),这是一个方阵,其行列式反映了这些向量张成的平行多面体的体积的平方。
12.2、总结
| 矩阵类型 | 能否定义行列式 | 原因 |
|---|---|---|
| $n \times n$ 方阵 | 可以 | 变换前后空间维度相同,体积缩放有明确意义 |
| $m \times n$($m \neq n$)非方阵 | 不可以 | 变换改变了空间维度,“体积缩放”概念不适用 |
所以行列式是方阵专属的概念。非方阵需要用秩等其他工具来描述其性质。
13、方阵类似于实数中的什么数?
这个问题可以从不同角度来类比。最核心的类比是:
13.1、核心类比:可逆方阵 ⇔ 非零实数
这是最经典、最本质的类比。
| 实数 | 方阵 |
|---|---|
| $a \neq 0$ | $\det(A) \neq 0$(可逆方阵) |
| $a = 0$ | $\det(A) = 0$(不可逆方阵) |
| $a$ 有倒数 $a^{-1} = \frac{1}{a}$ | $A$ 有逆矩阵 $A^{-1}$ |
| $0$ 没有倒数 | 不可逆方阵没有逆矩阵 |
| $a \cdot a^{-1} = 1$ | $A \cdot A^{-1} = I$ |
| 单位元是 $1$ | 单位元是 $I$(单位矩阵) |
在这个意义上:
$$ \text{可逆方阵} \quad \leftrightarrow \quad \text{非零实数} $$
$$ \text{不可逆方阵} \quad \leftrightarrow \quad \text{零} $$
零是实数中唯一没有倒数的数,而不可逆方阵是方阵中“没有逆”的一类特殊矩阵。这就是为什么行列式只需区分“等于零”和“不等于零”——它正好对应着实数中“零”和“非零”的根本区别。
13.2、进一步类比:零因子的存在
在实数中,如果 $a \neq 0$ 且 $b \neq 0$,那么必然 $ab \neq 0$。实数中没有“零因子”。
但方阵中不一样:两个非零矩阵的乘积可能等于零矩阵。例如:
$$ A = \begin{pmatrix} 1 & 0 \\ 0 & 0 \end{pmatrix}, \quad B = \begin{pmatrix} 0 & 0 \\ 0 & 1 \end{pmatrix} $$
两者都非零,但:
$$ AB = \begin{pmatrix} 0 & 0 \\ 0 & 0 \end{pmatrix} $$
所以方阵更精确的类比不是实数,而是可以包含零因子的数系。不过,单从“是否有逆”这个角度看,可逆方阵与非零实数的类比仍然是最直观的。
13.3、更抽象的类比:方阵是实数的“非交换推广”
| 性质 | 实数 | 方阵 |
|---|---|---|
| 加法 | 有 | 有 |
| 乘法 | 有 | 有 |
| 乘法交换律 | $ab = ba$ | 一般 $AB \neq BA$ |
| 单位元 | $1$ | $I$ |
| 逆元 | 非零实数有 | 可逆方阵有 |
| 零因子 | 无 | 有 |
所以方阵可以看作实数的一种非交换推广:它们有类似“数”的运算结构,但乘法不再交换,并且存在零因子。
13.4、总结
最直接的回答是:
可逆方阵类似于非零实数,不可逆方阵类似于零。
这个类比的核心在于:
- 非零实数有倒数,可逆方阵有逆矩阵
- 零没有倒数,不可逆方阵没有逆矩阵
- 行列式是否为零,恰好对应实数是否为零
但需要注意,方阵比实数更“复杂”:两个非零方阵相乘可能得到零矩阵,而两个非零实数相乘永远不可能是零。
14、非方阵如何求逆矩阵?
非方阵不存在逆矩阵。
14.1、为什么非方阵没有逆矩阵?
(1)逆矩阵的定义决定了它必须是方阵
矩阵 $A$ 的逆矩阵 $A^{-1}$ 必须满足:
$$ AA^{-1} = I \quad \text{且} \quad A^{-1}A = I $$
其中 $I$ 是单位矩阵。
假设 $A$ 是 $m \times n$ 的矩阵:
- 如果 $A^{-1}$ 是 $n \times m$ 的,那么 $AA^{-1}$ 是 $m \times m$ 的,$A^{-1}A$ 是 $n \times n$ 的
- 要让两者都等于单位矩阵,就必须有 $m = n$
所以从矩阵乘法的维度要求来看,只有方阵才可能同时满足这两个等式。
(2)非方阵代表不可逆的变换
从线性变换的角度看:
- $m \times n$ 矩阵代表 $\mathbb{R}^n \to \mathbb{R}^m$ 的映射
- 如果 $m > n$:维度从低到高,映射不可能覆盖整个 $\mathbb{R}^m$,不是满射,所以不可逆
- 如果 $m < n$:维度从高到低,必然有多个不同向量被映射到同一个向量,不是单射,所以不可逆
逆变换要求一一对应,只有维度相同的空间之间才可能建立一一对应。
14.2、那非方阵“解不了”吗?——广义逆
虽然非方阵没有真正的逆矩阵,但在实际应用中(比如最小二乘法),人们定义了广义逆(也称伪逆,Moore-Penrose 逆)。
对于 $m \times n$ 矩阵 $A$,其伪逆记为 $A^+$,它是 $n \times m$ 的矩阵,满足以下四个条件:
- $AA^+A = A$
- $A^+AA^+ = A^+$
- $(AA^+)^T = AA^+$
- $(A^+A)^T = A^+A$
伪逆可以用来求解不相容方程组 $Ax = b$ 的最小二乘解:
$$ x = A^+ b $$
这个解使得 $\|Ax - b\|$ 最小。
14.3、总结
| 问题 | 答案 |
|---|---|
| 非方阵有普通逆矩阵吗? | 没有,逆矩阵只对方阵定义 |
| 为什么? | 逆矩阵要求 $AA^{-1} = A^{-1}A = I$,维度上只有方阵能满足 |
| 非方阵有什么替代品? | 伪逆(广义逆)$A^+$,用于最小二乘等问题 |
| 伪逆和真逆的关系? | 当 $A$ 是可逆方阵时,$A^+ = A^{-1}$,伪逆是逆的推广 |
所以简单说:非方阵没有逆矩阵,但有广义逆(伪逆)作为替代工具,用于处理一些实际中需要“反向求解”的问题。
15、行列式的常见计算方法(新人入门版)
作为新人,先介绍 5 种最基础、最常用 的行列式计算方法,每种都配有详细例题和讲解,帮助大家快速入门。
方法一:对角线法则(二、三阶行列式)
核心思想:直接套公式计算,适合低阶行列式。
二阶行列式
公式:
$$ \begin{vmatrix} a & b \\ c & d \end{vmatrix} = ad - bc $$
例题:
$$ \begin{vmatrix} 3 & 2 \\ 1 & 4 \end{vmatrix} = 3 \times 4 - 2 \times 1 = 12 - 2 = 10 $$
三阶行列式(沙路法)
公式:
$$ \begin{vmatrix} a_{11} & a_{12} & a_{13} \\ a_{21} & a_{22} & a_{23} \\ a_{31} & a_{32} & a_{33} \end{vmatrix} = a_{11}a_{22}a_{33} + a_{12}a_{23}a_{31} + a_{13}a_{21}a_{32} - a_{13}a_{22}a_{31} - a_{12}a_{21}a_{33} - a_{11}a_{23}a_{32} $$
例题:
$$ \begin{vmatrix} 1 & 2 & 3 \\ 4 & 5 & 6 \\ 7 & 8 & 9 \end{vmatrix} $$
解:
$$ \begin{aligned} &= 1 \times 5 \times 9 + 2 \times 6 \times 7 + 3 \times 4 \times 8 \\ &\quad - 3 \times 5 \times 7 - 2 \times 4 \times 9 - 1 \times 6 \times 8 \\ &= 45 + 84 + 96 - 105 - 72 - 48 \\ &= 0 \end{aligned} $$
方法二:化为上三角行列式法
核心思想:利用行列式的性质,用行变换把行列式化为上三角形式,然后对角线元素相乘。
重要性质:
- 某行乘以数加到另一行,行列式不变
- 交换两行,行列式变号
- 某行乘以 $k$,行列式变为原来的 $k$ 倍
例题:
$$ D = \begin{vmatrix} 2 & 1 & 3 \\ 4 & 5 & 6 \\ 1 & 2 & 4 \end{vmatrix} $$
解:
第 1 步:交换第 1 行和第 3 行(为了主元简单),行列式变号:
$$ D = -\begin{vmatrix} 1 & 2 & 4 \\ 4 & 5 & 6 \\ 2 & 1 & 3 \end{vmatrix} $$
第 2 步:用第一行消去下面各行的第一个元素:
$$ \xrightarrow[r_3 - 2r_1]{r_2 - 4r_1} -\begin{vmatrix} 1 & 2 & 4 \\ 0 & -3 & -10 \\ 0 & -3 & -5 \end{vmatrix} $$
第 3 步:用第二行消去第三行:
$$ \xrightarrow{r_3 - r_2} -\begin{vmatrix} 1 & 2 & 4 \\ 0 & -3 & -10 \\ 0 & 0 & 5 \end{vmatrix} $$
第 4 步:上三角行列式,对角线相乘:
$$ D = -(1 \times (-3) \times 5) = 15 $$
方法三:按行(列)展开法
核心思想:选择 $0$ 元素较多的行或列,按该行展开,降低阶数。
公式(按第 $i$ 行展开):
$$ D = \sum_{j=1}^n a_{ij} A_{ij} $$
其中 $A_{ij} = (-1)^{i+j} M_{ij}$ 是代数余子式。
例题:
$$ D = \begin{vmatrix} 3 & 0 & 2 & 1 \\ 0 & 2 & 0 & 0 \\ 1 & 0 & 4 & 2 \\ 5 & 0 & 1 & 3 \end{vmatrix} $$
解:观察第 2 行,只有一个非零元素 $a_{22}=2$,按第 2 行展开:
$$ D = 2 \times (-1)^{2+2} \begin{vmatrix} 3 & 2 & 1 \\ 1 & 4 & 2 \\ 5 & 1 & 3 \end{vmatrix} $$
计算三阶行列式:
$$ \begin{vmatrix} 3 & 2 & 1 \\ 1 & 4 & 2 \\ 5 & 1 & 3 \end{vmatrix} = 3 \times 4 \times 3 + 2 \times 2 \times 5 + 1 \times 1 \times 1 - 1 \times 4 \times 5 - 2 \times 1 \times 3 - 3 \times 2 \times 1 $$
$$ = 36 + 20 + 1 - 20 - 6 - 6 = 25 $$
因此:
$$ D = 2 \times 25 = 50 $$
方法四:行和相等型行列式
核心思想:如果各行(列)元素之和相等,把各列加到第一列,提取公因子,再化简。
例题:
$$ D = \begin{vmatrix} a & b & b \\ b & a & b \\ b & b & a \end{vmatrix} $$
解:
第 1 步:把第 2 列、第 3 列都加到第 1 列:
$$ D = \begin{vmatrix} a+2b & b & b \\ a+2b & a & b \\ a+2b & b & a \end{vmatrix} $$
第 2 步:从第 1 列提取公因子 $(a+2b)$:
$$ D = (a+2b) \begin{vmatrix} 1 & b & b \\ 1 & a & b \\ 1 & b & a \end{vmatrix} $$
第 3 步:用第一行消去下面各行的第 1 个元素:
$$ \xrightarrow[r_3 - r_1]{r_2 - r_1} (a+2b) \begin{vmatrix} 1 & b & b \\ 0 & a-b & 0 \\ 0 & 0 & a-b \end{vmatrix} $$
第 4 步:上三角行列式:
$$ D = (a+2b)(a-b)^2 $$
方法五:三对角行列式(递推法)
三对角行列式指的是这样一种行列式:它的非零元素只出现在主对角线以及紧挨着主对角线的上下两条对角线上,其余位置全都是零。在计算行列式时,如果遇到三对角行列式,通常意味着可以用递推法来求解。
核心思想:按第一行展开,建立 $D_n$ 与 $D_{n-1}$、$D_{n-2}$ 的递推关系。
例题:
$$ D_n = \begin{vmatrix} 2 & 1 & 0 & \cdots & 0 \\ 1 & 2 & 1 & \cdots & 0 \\ 0 & 1 & 2 & \ddots & \vdots \\ \vdots & \ddots & \ddots & \ddots & 1 \\ 0 & \cdots & 0 & 1 & 2 \end{vmatrix} $$
解:
按第一行展开:
$$ D_n = 2 \cdot (-1)^{1+1} D_{n-1} + 1 \cdot (-1)^{1+2} \begin{vmatrix} 1 & 1 & 0 & \cdots & 0 \\ 0 & 2 & 1 & \cdots & 0 \\ 0 & 1 & 2 & \ddots & \vdots \\ \vdots & \ddots & \ddots & \ddots & 1 \\ 0 & \cdots & 0 & 1 & 2 \end{vmatrix} $$
再对第二个行列式按第一列展开:
$$ = 2D_{n-1} - D_{n-2} $$
初始条件:
$$ D_1 = |2| = 2, \quad D_2 = \begin{vmatrix} 2 & 1 \\ 1 & 2 \end{vmatrix} = 3 $$
递推可得:
$$ D_3 = 2 \times 3 - 2 = 4 $$
$$ D_4 = 2 \times 4 - 3 = 5 $$
猜想:
$$ D_n = n+1 $$
用归纳法可证明。
总结对比
| 方法 | 适用场景 | 难度 |
|---|---|---|
| 对角线法则 | 二、三阶数字行列式 | * |
| 化为上三角 | 一般数字行列式 | ** |
| 按行展开 | 某行/列含较多 $0$ | ** |
| 行和相等型 | 行和或列和相等 | *** |
| 三对角递推 | 三对角带状行列式 | *** |
给新人的学习建议
- 1、先掌握对角线法则和上三角化法,这是最基础的
- 2、再练习按行展开法,学会选择零多的行或列
- 3、最后攻克行和相等型和三对角递推法,这些是考试中的经典题型