メインコンテンツへスキップ
見出し画像

中学でも分かる⑰「固有値と固有ベクトル」

     ここでは固有値と固有ベクトルを解説します。行列の基本事項は当たり前のように現れるので、自信のない場合は、本シリーズの中学でもわかる⑬「行列」から読み始めるとよいでしょう。最後にケイリー・ハミルトンの定理について解説します。
     まずは、特に必要な「逆行列」と、「行列を用いた連立1次方程式の解法」を復習します(中学でも分かる⑭「逆行列」)。

    <逆行列の定義>(復習)

     行列 A=(abcd)A=\begin{pmatrix} a & b \\ c & d \end{pmatrix} について

     ∣A∣=ad−bc≠0|A|=ad-bc\ne0 のとき、AA には逆行列 A−1A^{-1} が存在して

    A−1=1∣A∣(d−b−ca)=1ad−bc(d−b−ca)\begin{align*} A^{-1}&=\dfrac{1}{|A|}\begin{pmatrix*}[r] d & -b \\ -c & a \end{pmatrix*}\\[10pt] &=\dfrac{1}{ad-bc}\begin{pmatrix*}[r] d & -b \\ -c & a \end{pmatrix*} \end{align*}

    画像

     ∣A∣=ad−bc=0|A|=ad-bc=0 のとき、AA には逆行列は存在しない。

    ***

     ∣A∣|A| を行列式といいます。下図のように「たすきがけ」を実行します。

    画像

     行列式は、det⁡(A)\det(A) と表すこともあります。つまり

    det⁡(A)=ad−bc\begin{align*} \det(A)=ad-bc \end{align*}

     ”det⁡\det” は、行列式を意味する英単語 determinant(デターミナント)に由来します。
     また、行列式は成分を明示して ∣abcd∣\begin{vmatrix} a & b \\ c & d \end{vmatrix} と表すこともあります。つまり

    ∣abcd∣=ad−bc\begin{align*} \begin{vmatrix} a & b \\ c & d \end{vmatrix}=ad-bc \end{align*}

     具体的な成分計算を行う場面では、成分が明示されている方が分かりやすいこともあります。

     次に、行列を用いた連立1次方程式の解法を復習します。AX=0AX=0 の形をした連立方程式です。

    行列を用いた連立1次方程式の解法(復習)

     復習として、次の例題を与えます。後ほど固有値、固有ベクトルを求めるときにこの解法を用います。

    例題1

     次の式を満たす (xy)\begin{pmatrix} x \\ y \end{pmatrix} を求めなさい。
    (1) (2−1 43)(xy)=(00) \begin{pmatrix*}[r] 2 & -1 \\  4 & 3 \end{pmatrix*}\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix}\raisebox{3ex}{ }
    (2) (2142)(xy)=(00) \begin{pmatrix*}[c] 2 & 1 \\ 4 & 2 \end{pmatrix*}\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix}\raisebox{3ex}{ }

    指針
    (1) 2次正方行列 (2−1 43)\begin{pmatrix*}[r] 2 & -1 \\  4 & 3 \end{pmatrix*} に、逆行列があるかどうかを確認します。
     そのためには、この行列の行列式を計算して、
    (case1) 行列式が 00 でなければ、逆行列が存在し、その逆行列を左●か●ら●掛けます。
    (case2) 行列式が 00 ならば、逆行列は存在しないので、そのまま行列の連立1次方程式を計算します。

    (2) も同様です。具体的に解いていきましょう。

    解答
    (1) A=(2−1 43)A=\begin{pmatrix*}[r] 2 & -1 \\  4 & 3 \end{pmatrix*} とおくと、与式は、

    A(xy)=(00)A\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix}

     AA の行列式は
     ∣A∣=2⋅3−(−1)⋅4=6−(−4)=6+4=10≠0|A|=2\cdot3-(-1)\cdot4=6-(-4)=6+4=10\ne0
    より、AA には逆行列 A−1A^{-1} が存在して

    A−1=1∣A∣(31−42)=110(31−42)\begin{align*} A^{-1}&=\dfrac{1}{|A|}\begin{pmatrix*}[r] 3 & 1 \\ -4 & 2 \end{pmatrix*}\\ &=\dfrac{1}{10}\begin{pmatrix*}[r] 3 & 1 \\ -4 & 2 \end{pmatrix*} \end{align*}

     与式 A(xy)=(00)A\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix} の両辺に、左●か●ら● A−1A^{-1} を掛けて

    A−1A(xy )=A−1(00)\begin{align*} A^{-1}A\begin{pmatrix} x \\ y \end{pmatrix}=A^{-1}\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     行列の計算では交換法則が成り立たないので、左から掛けるか右から掛けるかをあらかじめ決めて、掛ける方向を統一します(中学でもわかる⑬「行列」、⑭「逆行列」)。

     A−1A=E=(1001)A^{-1}A=E=\begin{pmatrix} 1 & 0 \\ 0 & 1 \end{pmatrix} より

    E(xy)=A−1(00)\begin{align*} E\begin{pmatrix} x \\ y \end{pmatrix}=A^{-1}\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     単位行列 EE は掛けても変わらないので

    (xy)=A−1(00)\begin{align*} \begin{pmatrix} x \\ y \end{pmatrix}=A^{-1}\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     よって、解は

    (xy)=A−1(00)=110(31−42)(00)=110(3⋅0+1⋅0−4⋅0+2⋅0)=110(00)=(00) ⋯(答)\begin{align*} \begin{pmatrix} x \\ y \end{pmatrix}&=A^{-1}\begin{pmatrix} 0 \\ 0 \end{pmatrix}\\ &=\dfrac{1}{10}\begin{pmatrix*}[r] 3 & 1 \\ -4 & 2 \end{pmatrix*}\begin{pmatrix} 0 \\ 0 \end{pmatrix}\\ &=\dfrac{1}{10}\begin{pmatrix*}[r] 3\cdot0+1\cdot0 \\ -4\cdot0+2\cdot0 \end{pmatrix*}\\ &=\dfrac{1}{10}\begin{pmatrix*}[r] 0 \\ 0 \end{pmatrix*}\\ &=\begin{pmatrix*}[r] 0 \\ 0 \end{pmatrix*} \cdots\small{(答)} \end{align*}

    ■\blacksquare

     零ゼロベクトル (00)\begin{pmatrix} 0 \\ 0 \end{pmatrix} に逆行列 A−1A^{-1} を掛けているので、明らかに解は零ベクトル (00)\begin{pmatrix} 0 \\ 0 \end{pmatrix} になります。

    (グラフで確認)
     この解について、グラフで考えてみましょう。与式
     (2−1 43)(xy)=(00)\begin{pmatrix*}[r] 2 & -1 \\ 4 & 3 \end{pmatrix*}\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix}
    について、行列の積を計算すると

    (2x−y4x+3y)=(00)\begin{pmatrix*}[c] 2x-y \\ 4x+3y \end{pmatrix*} =\begin{pmatrix} 0 \\ 0 \end{pmatrix}

     対応する成分を比較して

    {2x−y=04x+3y=0\begin{cases} 2x-y=0\\ 4x+3y=0 \end{cases}

     この2つの直線 2x−y=02x-y=0 と 4x+3y=04x+3y=0 の交点の座標が、この連立方程式の解になります。
     すると、第1式より

    y=2xy=2x

     第2式より

    3y=−4xy=−43x\begin{align*} 3y&=-4x\\ y&=-\dfrac{4}{3}x \end{align*}

     それぞれのグラフを描くと

    画像

     この2つの直線の交点は、上図より原点 (0, 0)(0,  0) なので

    (xy)=(00) ⋯(答)\begin{align*} \begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix} \cdots\small{(答)} \end{align*}

     2つの直線は原点のみで交わることから、解は (xy)=(00)\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix} のみで、他に解は存在しません。

    (2) A=(2142)A=\begin{pmatrix*}[r] 2 & 1 \\ 4 & 2 \end{pmatrix*} とおくと、AA の行列式は
     ∣A∣=2⋅2−1⋅4=4−4=0|A|=2\cdot2-1\cdot4=4-4=0
    より、AA には逆行列が存在しません。
     このときは、与式 (2142)(xy)=(00)\begin{pmatrix*}[r] 2 & 1 \\ 4 & 2 \end{pmatrix*}\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix} について、行列の積を計算すると

    (2x+y4x+2y)=(00)\begin{pmatrix*}[c] 2x+y \\ 4x+2y \end{pmatrix*} =\begin{pmatrix} 0 \\ 0 \end{pmatrix}

     対応する成分を比較して

    {2x+y=04x+2y=0\begin{cases} 2x+y=0\\ 4x+2y=0 \end{cases}

     第2式の両辺を 22 で割ると

    {2x+y=02x+y=0\begin{cases} 2x+y=0\\ 2x+y=0 \end{cases}

     すると、同じ式 2x+y=02x+y=0 の連立方程式となるので、この 2x+y=02x+y=0 を満たすすべての (x, y)(x,  y) が、この連立方程式の解になります。
     2x+y=02x+y=0 より

    y=−2x\begin{align*} y=-2x \end{align*}

     CC を任意の実数として x=Cx=C とすると

    y=−2C\begin{align*} y=-2C \end{align*}

     よって、解は CC を任意の実数として

    (xy)=(C−2C)=C(1−2) ⋯(答)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}&=\begin{pmatrix*}[c] C \\ -2C \end{pmatrix*}\\ &=C\begin{pmatrix*}[r] 1 \\ -2 \end{pmatrix*} \cdots(答) \end{align*}

    ■\blacksquare

    (グラフで確認)
     この解について、グラフで考えてみましょう。
     2x+y=02x+y=0 と 4x+2y=04x+2y=0 は同じ式で、どちらも直線 y=−2xy=-2x を表すので、この直線上のすべての点が解となります。

    画像

     この直線 y=−2xy=-2x 上のすべての点の座標は、x=Cx=C(CC は任意の実数)とすると、y=−2Cy=-2C となるので

    (xy)=(C−2C)=C(1−2) ⋯(答)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}&=\begin{pmatrix*}[c] C \\ -2C \end{pmatrix*}\\ &=C\begin{pmatrix*}[r] 1 \\ -2 \end{pmatrix*} \cdots(答) \end{align*}

     CC は任意の実数をとるので、それに対応して (xy)\begin{pmatrix} x \\ y \end{pmatrix} は無数の解をもちます。

     一般に、AX=OAX=O の形をした連立一次方程式について、次のことがいえます。

    <AX=O の連立一次方程式の解>

    (abcd)(xy)=(00)\begin{pmatrix*}[r] a & b \\ c & d \end{pmatrix*} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix}

    の解 (xy)\begin{pmatrix} x \\ y \end{pmatrix} について、次のことが成り立つ。

    (case1) (abcd)\begin{pmatrix*}[r] a & b \\ c & d \end{pmatrix*} が逆行列をもつときは

    (xy)=(00)\begin{align*} \begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

    のみ解をもつ(他に解は存在しない)。

    <グラフの視点>
     ax+by=0ax+by=0 と cx+dy=0cx+dy=0 の2つの直線は、原点 (0, 0)(0,  0) のみで交わるので、解は (xy)=(00)\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix} のみ。

    (case2) (abcd)\begin{pmatrix*}[r] a & b \\ c & d \end{pmatrix*} が逆行列をもたないときは、ax+by=0ax+by=0 をみたす無数の解をもつ。

    <グラフの視点>
     ax+by=0ax+by=0 と cx+dy=0cx+dy=0 は原点を通る同じ直線となるので、その直線上のすべての点が解となる。

    ***

     以上のように、AX=OAX=O の解 XX は、行列 AA に逆行列が存在するかどうかよって2通りの場合に分かれます。このことを踏まえて、再び例題を与えます。

    例題2

     次の式を満たす (xy)\begin{pmatrix} x \\ y \end{pmatrix} を求めなさい。
    (1) (32−14)(xy)=(00) \begin{pmatrix*}[r] 3 & 2 \\ -1 & 4 \end{pmatrix*}\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix}\raisebox{3ex}{ }
    (2) (3264)(xy )=(00) \begin{pmatrix*}[c] 3 & 2 \\ 6 & 4 \end{pmatrix*}\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix}\raisebox{3ex}{ }

    解答
    (1) A=(32−14)A=\begin{pmatrix*}[r] 3 & 2 \\ -1 & 4 \end{pmatrix*} とおくと、与式は

    A(xy)=(00)\begin{align*} A\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     AA の行列式は
     ∣A∣=3⋅4−2⋅(−1)=12+2=14≠0|A|=3\cdot4-2\cdot(-1)=12+2=14\ne0
    より、AA には逆行列 A−1A^{-1} が存在するので

    A−1A(xy)=A−1(00)E(xy)=A−1(00)\begin{align*} A^{-1}A\begin{pmatrix} x \\ y \end{pmatrix}&=A^{-1}\begin{pmatrix} 0 \\ 0 \end{pmatrix}\\[10pt] E\begin{pmatrix} x \\ y \end{pmatrix}&=A^{-1}\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     単位行列 EE は掛けても変わらないので

    (xy)=A−1(00)=(00) ⋯(答)\begin{align*} \begin{pmatrix} x \\ y \end{pmatrix}&=A^{-1}\begin{pmatrix} 0 \\ 0 \end{pmatrix}\\ &=\begin{pmatrix*}[r] 0 \\ 0 \end{pmatrix*} \cdots\small{(答)}\\ \end{align*}

     すでに述べた通り、零ゼロベクトル (00)\begin{pmatrix} 0 \\ 0 \end{pmatrix} に逆行列を掛けているので、計算しなくても明らかに解は零ベクトル (00)\begin{pmatrix} 0 \\ 0 \end{pmatrix} です。

    (2) A=(3264)A=\begin{pmatrix*}[r] 3 & 2 \\ 6 & 4 \end{pmatrix*} とおくと、AA の行列式は
     ∣A∣=3⋅4−2⋅6=12−12=0|A|=3\cdot4-2\cdot6=12-12=0
    より、AA には逆行列は存在しません。
     よって、与式 (3264)(xy)=(00)\begin{pmatrix*}[r] 3 & 2 \\ 6 & 4 \end{pmatrix*}\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix} について、行列の積を計算すると

    (3x+2y6x+4y)=(00)\begin{pmatrix*}[c] 3x+2y \\ 6x+4y \end{pmatrix*} =\begin{pmatrix} 0 \\ 0 \end{pmatrix}

     対応する成分を比較して

    {3x+2y=06x+4y=0\begin{cases} 3x+2y=0\\ 6x+4y=0 \end{cases}

     第2式を 22 で割ると

    {3x+2y=03x+2y=0\begin{cases} 3x+2y=0\\ 3x+2y=0 \end{cases}

     すると、同じ式の連立方程式となるので、この 3x+2y=03x+2y=0 を満たすすべての (x, y)(x,  y) が、この連立方程式の解となります。
     3x+2y=03x+2y=0 より

    2y=−3xy=−32x\begin{align*} 2y&=-3x\\ y&=-\dfrac{3}{2}x \end{align*}

     CC を任意の実数として x=2Cx=2C とすると

    y=−32⋅2C=−3C\begin{align*} \\[-14pt] y=-\dfrac{3}{\cancel{2}}\cdot\cancel{2}C=-3C \end{align*}

     よって、解は CC を任意の実数として

    (xy)=(2C−3C)=C(2−3) ⋯(答)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}&=\begin{pmatrix*}[c] 2C \\ -3C \end{pmatrix*}\\ &=C\begin{pmatrix*}[r] 2 \\ -3 \end{pmatrix*} \cdots(答) \end{align*}

    ■\blacksquare

     ここから、本記事のテーマである固有値と固有ベクトルに入ります。その前に、1次変換の復習です(中学でも分かる⑮「一次変換」)。

    1次変換の定義(復習)

     a, b, c, da,  b,  c,  d を定数として

    x′=ax+byy′=cx+dy\begin{align*} x'&=ax+by\\ y'&=cx+dy \end{align*}

    によって点 P(x, y)(x,  y) と点 Q(x′, y′)(x',  y') の関係を定めると、座標平面上の1つの変換が得られます。
     一般に、この形の式によって表される変換

    f:(x, y)⟶(x′, y′)f:(x,  y) \longrightarrow (x',  y')

    を1次変換といいます。1次変換 ff は、行列を用いると

    (x′y′)=(ab cd)(xy) ⋯(∗1)\begin{align*} \begin{pmatrix} x' \\ y' \end{pmatrix} =\begin{pmatrix} a & b \\  c & d \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} \cdots (*1) \end{align*}

    と表すことができます。つまり、変換 ff は行列

    (abcd)\begin{align*} \begin{pmatrix} a & b \\ c & d \end{pmatrix} \end{align*}

    によって定まるので、この変換 ff を、行列 (abcd)\begin{pmatrix} a & b \\ c & d \end{pmatrix} で表される1次変換といいます。また、この行列のことを変換行列とよびます。

    f:P(x, y) →(abcd)1次変換   Q(x′, y′)\begin{align*} \\[-12pt] f:\mathrm{P}(x,  y)  \xrightarrow[\scriptsize \begin{pmatrix} a & b \\ c & d \end{pmatrix}]{1次変換    }  \mathrm{Q}(x',  y') \end{align*}

    画像

    ***

    一次変換をベクトルを移す変換とみなす

     この一次変換

    (x′y′)=(ab cd)(xy) ⋯(∗1)\begin{align*} \begin{pmatrix} x' \\ y' \end{pmatrix} =\begin{pmatrix} a & b \\  c & d \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} \cdots(*1) \end{align*}

    について、上の定義では (xy)\begin{pmatrix}x \\ y\end{pmatrix} は平面上の1点の座標を表していましたが、これをベクトル OP→=(xy)\overrightarrow{\mathrm{OP}}=\begin{pmatrix}x \\ y\end{pmatrix} として考えることができます。なお、OP→=(xy)\overrightarrow{\mathrm{OP}}=\begin{pmatrix}x \\ y\end{pmatrix} は、高校で習うベクトル表記 OP→=(x, y)\overrightarrow{\mathrm{OP}}=(x,  y) を縦書きにし、列ベクトルで表したものです(中学でも分かる⑬「行列」)。ベクトルの本質である向き・大きさ・成分は変わらず、行列の計算と相性をよくするために表記を変えているだけです。
     ベクトルの始点を原点に置いた場合、そのベクトルの終点の座標がベクトルの成分となります。これにより、ある点 P\mathrm{P} の座標 (xy)\begin{pmatrix}x \\ y\end{pmatrix} は、原点 O\mathrm{O} から P\mathrm{P} へのベクトル OP→=(xy)\overrightarrow{\mathrm{OP}}= \begin{pmatrix}x \\ y\end{pmatrix} と同一視することができます(中学でも分かる⑫「ベクトル」)。

    画像

     つまり、上記の (∗1)(*1) 式

    (x′y′)=(ab cd)(xy) ⋯(∗3)\begin{align*} \begin{pmatrix} x' \\ y' \end{pmatrix} =\begin{pmatrix} a & b \\  c & d \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} \cdots(*3) \end{align*}

    は、「ベクトル OP→=(xy)\overrightarrow{\mathrm{OP}}=\begin{pmatrix}x \\ y\end{pmatrix} が、変換行列 (abcd)\begin{pmatrix} a & b \\ c & d\end{pmatrix} によって、ベクトル OQ→=(x′y′)\overrightarrow{\mathrm{OQ}}=\begin{pmatrix}x' \\ y' \end{pmatrix} に変換される」とみることができます。一次変換は、「ベクトルをベクトルに写す」という新しいものの見方です。

    f:OP→=(xy) →(abcd)1次変換    OQ→=(x′y′)\begin{align*} \\[-10pt] f:\overrightarrow{\mathrm{OP}}=\begin{pmatrix}x \\ y\end{pmatrix}  \xrightarrow[\scriptsize \begin{pmatrix} a & b \\ c & d \end{pmatrix}]{1次変換    }   \overrightarrow{\mathrm{OQ}}=\begin{pmatrix} x' \\ y' \end{pmatrix} \end{align*}

    画像

     ベクトルは、向きと大きさが同じであれば、その位置に関係なく同じベクトルとみなします。したがって、どのような位置にあるベクトルも、始点が原点 O\mathrm{O} になるように平行移動して考えることができます。このとき、原点 O\mathrm{O} を始点とするベクトルを位置ベクトルといいます。
     このようにみれば、一次変換は「座標を他の座標に変換する操作」であると同時に、「位置ベクトルを他の位置ベクトルに変換する操作」、より一般には「ベクトルを他のベクトルに変換する操作」と考えることができます。

     これが、「固有ベクトル」を理解するための最初のステップです。
     以上を踏まえ、固有値と固有ベクトルの解説です。

    固有値と固有ベクトル

     まずは、行列の固有値、固有ベクトルがどのようなものか、具体例を通してみていきます。

    固有値、固有ベクトルの具体例

     例えば、1次変換の変換行列として、次のような2次正方行列 AA があるとします。

    A=(12−14)\begin{align*} A=\begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \end{align*}

     この変換行列 AA を、ある位置ベクトル OP→\overrightarrow{\mathrm{OP}} に掛けて、別の位置ベクトル OQ→\overrightarrow{\mathrm{OQ}} に変換することを考えます。すると

    (例1)
     
    OP→=(23)\overrightarrow{\mathrm{OP}}=\begin{pmatrix} 2 \\ 3 \end{pmatrix} のとき

    OQ→=A OP→=(12−14)(23)=(1⋅2+2⋅3(−1)⋅2+4⋅3)=(2+6−2+12)=(810)\begin{align*} \overrightarrow{\mathrm{OQ}}&=A\,\overrightarrow{\mathrm{OP}}\\ &=\begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \begin{pmatrix} 2 \\ 3 \end{pmatrix}\\ &=\begin{pmatrix} 1\cdot2+2\cdot3 \\ (-1)\cdot2+4\cdot3 \end{pmatrix}\\ &=\begin{pmatrix*}[c] 2+6 \\ -2+12 \end{pmatrix*}\\ &=\begin{pmatrix} 8 \\ 10 \end{pmatrix} \end{align*}

    より

    (12−14)(23)=(810)\begin{align*} \begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \begin{pmatrix} 2 \\ 3 \end{pmatrix} =\begin{pmatrix} 8 \\ 10 \end{pmatrix} \end{align*}

    画像

     上図のように、ベクトル  OP→=(23)\overrightarrow{\mathrm{OP}}=\begin{pmatrix} 2 \\ 3 \end{pmatrix} は、変換行列 (12−14)\begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} によって、別のベクトル  OQ→=(810)\overrightarrow{\mathrm{OQ}}=\begin{pmatrix} 8 \\ 10 \end{pmatrix} に写されます。

    (例2)

     OP→=(2−1)\overrightarrow{\mathrm{OP}}=\begin{pmatrix*}[r] 2 \\ -1 \end{pmatrix*} のとき

    OQ→=A OP→=(12−14)(2−1)=(1⋅2+2⋅(−1)(−1)⋅2+4⋅(−1))=(2−2−2−4)=(0−6)\begin{align*} \overrightarrow{\mathrm{OQ}}&=A\,\overrightarrow{\mathrm{OP}}\\ &=\begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \begin{pmatrix*}[r] 2 \\ -1 \end{pmatrix*}\\ &=\begin{pmatrix} 1\cdot2+2\cdot(-1) \\ (-1)\cdot2+4\cdot(-1) \end{pmatrix}\\ &=\begin{pmatrix} 2-2 \\ -2-4 \end{pmatrix}\\ &=\begin{pmatrix*}[r] 0 \\ -6 \end{pmatrix*} \end{align*}

    より

    (12−14)(2−1)=(0−6)\begin{align*} \begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \begin{pmatrix} 2 \\ -1 \end{pmatrix} =\begin{pmatrix} 0 \\ -6 \end{pmatrix} \end{align*}

    画像

     上図のように、ベクトル  OP→=(2−1)\overrightarrow{\mathrm{OP}}=\begin{pmatrix*}[r] 2 \\ -1 \end{pmatrix*} は、変換行列 (12−14)\begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} によって、別のベクトル  OQ→=(0−6)\overrightarrow{\mathrm{OQ}}=\begin{pmatrix*}[r] 0 \\ -6 \end{pmatrix*} に写されます。

     上記の例では、どちらも変換後のベクトルの「向き」と「大きさ(長さ)」は変わっています。しかし、中には

    (例3)

     OP→=(21)\overrightarrow{\mathrm{OP}}=\begin{pmatrix*}[r] 2 \\ 1 \end{pmatrix*} のとき

    Ap⃗=(12−14)(21)=(1⋅2+2⋅1(−1)⋅2+4⋅1)=(2+2−2+4)=(42)=2(21)\begin{align*} A\vec{p}&=\begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \begin{pmatrix} 2 \\ 1 \end{pmatrix}\\ &=\begin{pmatrix} 1\cdot2+2\cdot1 \\ (-1)\cdot2+4\cdot1 \end{pmatrix}\\ &=\begin{pmatrix} 2+2 \\ -2+4 \end{pmatrix}\\ &=\begin{pmatrix} 4 \\ 2 \end{pmatrix}\\ &=2\begin{pmatrix} 2 \\ 1 \end{pmatrix} \end{align*}

    より

    (12−14)(21)=2(21)\begin{align*} \begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \begin{pmatrix} 2 \\ 1 \end{pmatrix} =2\begin{pmatrix} 2 \\ 1 \end{pmatrix} \end{align*}

    画像

     この場合、OQ→\overrightarrow{\mathrm{OQ}} は OP→\overrightarrow{\mathrm{OP}} と向きが同じで、大きさだけが 22 倍になります。

    (例4)

    Ap⃗=(12−14)(11)=(1⋅1+2⋅1(−1)⋅1+4⋅1)=(1+2−1+4)=(33)=3(11)\begin{align*} A\vec{p}&=\begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \begin{pmatrix} 1 \\ 1 \end{pmatrix}\\ &=\begin{pmatrix} 1\cdot1+2\cdot1 \\ (-1)\cdot1+4\cdot1 \end{pmatrix}\\ &=\begin{pmatrix} 1+2 \\ -1+4 \end{pmatrix}\\ &=\begin{pmatrix} 3 \\ 3 \end{pmatrix}\\ &=3\begin{pmatrix} 1 \\ 1 \end{pmatrix} \end{align*}

    より

    (12−14)(11)=3(11)\begin{align*} \begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \begin{pmatrix} 1 \\ 1 \end{pmatrix} =3\begin{pmatrix} 1 \\ 1 \end{pmatrix} \end{align*}

    画像

     この場合、OQ→\overrightarrow{\mathrm{OQ}} は OP→\overrightarrow{\mathrm{OP}} と向きが同じで、大きさだけが 33 倍になります。

     これらのように、「大きさ」が実数倍されるだけで、変換しても「向き」が変わらないベクトルがあります。
     このように、ある変換行列に対して、ベクトル を掛けても「向き」が変わらない特別なベクトルを固有ベクトルといいます。また、そのときのベクトルの大きさの変化を表す値(何倍するのかの値)を固有値といいます。
     (例3)の

    (12−14)(21)=2(21)\begin{align*} \begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \begin{pmatrix} 2 \\ 1 \end{pmatrix} =2\begin{pmatrix} 2 \\ 1 \end{pmatrix} \end{align*}

    については、固有ベクトルは (21)\begin{pmatrix} 2 \\ 1 \end{pmatrix}、固有値は 22 となります。
     (例4)の

    (12−14)(11)=3(11)\begin{align*} \begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \begin{pmatrix} 1 \\ 1 \end{pmatrix} =3\begin{pmatrix} 1 \\ 1 \end{pmatrix} \end{align*}

    については、固有ベクトルは (11)\begin{pmatrix} 1 \\ 1 \end{pmatrix}、固有値は 33 となります。

     固有ベクトルは、「変換行列によって向きが変わらない」という、極めて特別な性質をもちます。これは偶然ではなく、行列そのものの性質を浮き彫りにする、ある種の「骨格」のような存在です。

    (注意1)固有ベクトルは零ベクトルを含まない

     なお、 固有ベクトルは零ベクトル 0⃗\vec{0} を含みません。例えば CC を任意の実数として

    (例5)

    (12−14)(00)=C(00)\begin{align*} \begin{pmatrix*}[r] 1 & 2 \\ -1 & 4 \end{pmatrix*} \begin{pmatrix} 0 \\ 0 \end{pmatrix} =C\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

    という式はつねに成り立ちますが、このとき、零ベクトル (00)\begin{pmatrix} 0 \\ 0 \end{pmatrix} は固有ベクトルではありません。

     固有ベクトルとは、「変換行列を掛けたときに、方向は変わらず、大きさだけが伸び縮みするベクトル」のことです。そのため、固有ベクトルは「大きさがあり、特定の方向をもつ」ことが不可欠なので、大きさも方向ももたない零ベクトルは固有ベクトルになりません。 

     あらためて、固有ベクトルと固有値の教科書的な定義を与えましょう。

    <固有値と固有値ベクトルの定義>

     ある正方行列 AA に対して、零ではないベクトル v⃗\vec{v} と、あるスカラー λ\lambda が存在し、以下の関係が成り立つとき、v⃗\vec{v} を固有ベクトル、 λ\lambda を固有値という。

    Av⃗=λv⃗A\vec{v}=\lambda\vec{v}

    ***

     なお、ここでは行列の成分、および固有値は、実数の範囲で考えることとします。量子力学などの特定の分野では、行列の成分、および固有値は、複素数まで拡張されることがあります。

     行列 AA を2次正方行列 (abcd)\begin{pmatrix}a & b \\ c & d\end{pmatrix} で考えると、上の定義は次のようになります。

    (ab cd)(xy)=λ(xy)\begin{align*} \begin{pmatrix} a & b \\  c & d \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\lambda \begin{pmatrix} x \\ y \end{pmatrix} \end{align*}

     上記の関係式が成り立つとき、(xy)(≠0⃗)\begin{pmatrix} x \\ y \end{pmatrix}(\ne{\vec{0}}) が固有ベクトル、λ\lambda が固有値となります。

    固有値と固有ベクトルを求める計算

     ある行列に対して、その固有値と固有ベクトルを求めることを考えましょう。まずは次の例題から。

    例題3

     行列 A=(2112)A=\begin{pmatrix} 2 & 1 \\ 1 & 2 \end{pmatrix} の固有値と固有ベクトルを求めなさい。

    解答
     
    2次正方行列 A=(2112)A=\begin{pmatrix} 2 & 1 \\ 1 & 2 \end{pmatrix} に対して、固有値を λ\lambda、固有ベクトルを (xy)(≠0⃗)\begin{pmatrix} x \\ y \end{pmatrix}(\ne\vec{0}) とすると、以下の関係式が成り立ちます。

    (2112)(xy)=λ(xy)\begin{align*} \begin{pmatrix} 2 & 1 \\ 1 & 2 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\lambda \begin{pmatrix} x \\ y \end{pmatrix} \end{align*}

     ここで、単位行列 E=(1001)E=\begin{pmatrix} 1 & 0 \\ 0 & 1 \end{pmatrix} を掛けても変わらないので

    (2112)(xy)=λ(1001)(xy)\begin{align*} \begin{pmatrix} 2 & 1 \\ 1 & 2 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\lambda \begin{pmatrix} 1 & 0 \\ 0 & 1 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} \end{align*}

    より

    (2112)(xy)=(λ00λ)(xy)\begin{align*} \begin{pmatrix} 2 & 1 \\ 1 & 2 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} \lambda & 0 \\ 0 & \lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} \end{align*}

     左辺から右辺を引いて

    (2112)(xy)−(λ00λ)(xy)=(00)\begin{align*} \begin{pmatrix} 2 & 1 \\ 1 & 2 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} -\begin{pmatrix} \lambda & 0 \\ 0 & \lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     この式の右辺は、零ベクトル (00)\begin{pmatrix} 0 \\ 0 \end{pmatrix} になることに注意しましょう。左辺を計算すると2行1列の行列(列ベクトル)になるので、右辺も同じ型の零ベクトルになります。等式の両辺は同じ型でなければならないので、実数の 00 にはならないことに注意しましょう。
     左辺を (xy)\begin{pmatrix} x \\ y \end{pmatrix} でくくって

    {(2112)−(λ00λ)}(xy)=(00)\begin{align*} \left\{\begin{pmatrix} 2 & 1 \\ 1 & 2 \end{pmatrix} -\begin{pmatrix} \lambda & 0 \\ 0 & \lambda \end{pmatrix}\right\} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     行列のひき算を計算して

    (2−λ1−01−02−λ)(xy)=(00)\begin{align*} \begin{pmatrix} 2-\lambda & 1-0 \\ 1-0 & 2-\lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

    より

    (2−λ112−λ)(xy)=(00) ⋯(∗2)\begin{align*} \begin{pmatrix} 2-\lambda & 1 \\ 1 & 2-\lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*} \cdots(*2)

     後は、この方程式を解きます。
     これには、この記事ですでにやった<AX= O の連立1次方程式の解>が役立ちます。

    <AX= O の連立1次方程式の解>(再掲)

    (abcd)(xy)=(00)\begin{pmatrix*}[r] a & b \\ c & d \end{pmatrix*} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix}

    の解 (xy)\begin{pmatrix} x \\ y \end{pmatrix} について、次のことが成り立つ。

    (case1) (abcd)\begin{pmatrix*}[r] a & b \\ c & d \end{pmatrix*} が逆行列をもつときは

    (xy)=(00)\begin{align*} \begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

    のみ解をもつ(他に解は存在しない)。

    (case2) (abcd)\begin{pmatrix*}[r] a & b \\ c & d \end{pmatrix*} が逆行列をもたないときは、ax+by=0ax+by=0 をみたす無数の解をもつ。

    ***

     すると、行列

    (2−λ112−λ)\begin{align*} \begin{pmatrix} 2-\lambda & 1 \\ 1 & 2-\lambda \end{pmatrix} \end{align*}

    が逆行列をもつときは、(case1) より、(∗2)(*2) 式

    (2−λ112−λ)(xy)=(00)\begin{align*} \begin{pmatrix} 2-\lambda & 1 \\ 1 & 2-\lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

    の解は零ベクトル

    (xy)=(00)\begin{align*} \begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

    となりますが、零ベクトルは固有ベクトルにはならないので不適となります。
     よって、(case2) のとき、つまり、行列

    (2−λ112−λ)\begin{align*} \begin{pmatrix} 2-\lambda & 1 \\ 1 & 2-\lambda \end{pmatrix} \end{align*}

    が逆行列をもたないときを考えます。
     この行列が逆行列をもたないための条件は、最初にやった<逆行列の定義>より、行列式

    ∣2−λ112−λ∣\begin{align*} \begin{vmatrix} 2-\lambda & 1 \\ 1 & 2-\lambda \end{vmatrix} \end{align*}

    が 00 になることなので

    ∣2−λ112−λ∣=(2−λ)2−1=22−2⋅2λ+λ2−1=λ2−4λ+4−1=λ2−4λ+3=(λ−1)(λ−3)=0\begin{align*} \begin{vmatrix} 2-\lambda & 1 \\ 1 & 2-\lambda \end{vmatrix}&=(2 - \lambda)^2-1\\ &=2^2-2\cdot2\lambda+\lambda^2-1\\ &=\lambda^2-4\lambda+4-1\\ &=\lambda^2-4\lambda+3\\ &=(\lambda-1)(\lambda-3)\\ &=0 \end{align*}

    よって

    λ−1=0 または λ−3=0\begin{align*} \lambda-1=0 または \lambda-3=0 \end{align*}

    より

    λ=1 または λ=3\begin{align*} \lambda=1 または \lambda=3 \end{align*}

    (ⅰ) λ=1\lambda=1 のとき

     (∗2)(*2) に代入して

    (2−1112−1)(xy)=(00)\begin{align*} \begin{pmatrix} 2-1 & 1 \\ 1 & 2-1 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

    より

    (1111)(xy)=(00)(x+yx+y)=(00)\begin{align*} \begin{pmatrix} 1 & 1 \\ 1 & 1 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} &=\begin{pmatrix} 0 \\ 0 \end{pmatrix}\\ \begin{pmatrix} x+y \\ x+y \end{pmatrix} &=\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     対応する成分は等しいので

    {x+y=0x+y=0\begin{cases} x+y=0\\ x+y=0 \end{cases}

     すると、同じ式の連立方程式となるので、この連立方程式の解は x+y=0x+y=0 を満たすすべての実数が解となります。すると

    y=−x\begin{align*} y=-x \end{align*}

    より、CC を任意の実数として x=Cx=C とすると

    y=−Cy=-C

     したがって、この連立方程式の解は、CC を任意の実数として

    (xy)=(3C−2C)=C(3−2)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}&=\begin{pmatrix*}[c] 3C \\ -2C \end{pmatrix*}\\ &=C\begin{pmatrix*}[r] 3 \\ -2 \end{pmatrix*} \end{align*}

     ここで、特にことわりの無い場合は、固有値はもっとも簡単な値を選択します。もっとも簡単な値は C=1C=1 のときなので、λ=1\lambda=1 のときの固有値は、C=1C=1 のときを選んで

    (xy)=1⋅(3−2)=(3−2)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*} &=1\cdot\begin{pmatrix*}[r] 3 \\ -2 \end{pmatrix*}\\ &=\begin{pmatrix*}[r] 3 \\ -2 \end{pmatrix*} \end{align*}

    (ⅱ) λ=3\lambda=3 のとき

     (∗2)(*2) に代入して

    (2−3112−3)(xy)=(00)\begin{align*} \begin{pmatrix} 2-3 & 1 \\ 1 & 2-3 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

    より

    (−111−1)(xy)=(00)(−x+yx−y)=(00)\begin{align*} \begin{pmatrix} -1 & 1 \\ 1 & -1 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} &=\begin{pmatrix} 0 \\ 0 \end{pmatrix}\\ \begin{pmatrix} -x+y \\ x-y \end{pmatrix} &=\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     対応する成分は等しいので

    {−x+y=0x−y=0\begin{cases} -x+y=0\\ x-y=0 \end{cases}

     第1式を −1-1 倍すると

    {x−y=0x−y=0\begin{cases} x-y=0\\ x-y=0 \end{cases}

     すると、同じ式の連立方程式となるので、この連立方程式の解は x−y=0x-y=0 を満たすすべての実数となります。すると

    y=x\begin{align*} y=x \end{align*}

    より、CC を任意の実数として x=Cx=C とすると

    y=Cy=C

     したがって、この連立方程式の解は、CC を任意の実数として

    (xy)=(CC)=C(11)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}&=\begin{pmatrix*}[c] C \\ C \end{pmatrix*}\\ &=C\begin{pmatrix*}[r] 1 \\ 1 \end{pmatrix*} \end{align*}

     よって、λ=3\lambda=3 のときの固有ベクトルは、最も簡単な C=1C=1 のときを選んで

    (xy)=1⋅(11)=(11)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*} &=1\cdot\begin{pmatrix*}[r] 1 \\ 1 \end{pmatrix*}\\ &=\begin{pmatrix*}[r] 1 \\ 1 \end{pmatrix*} \end{align*}

     以上より、

     固有値が λ=1\lambda=1 のときの固有ベクトルは

    (xy)=(1−1) ⋯(答)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}&=\begin{pmatrix*}[r] 1 \\ -1 \end{pmatrix*} \cdots(答) \end{align*}

     固有値が λ=3\lambda=3 のときの固有ベクトルは

    (xy)=(11) ⋯(答)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}&=\begin{pmatrix*}[r] 1 \\ 1 \end{pmatrix*} \cdots(答) \end{align*}

    ■\blacksquare

     後のために、上記でやった固有値、固有ベクトルを求め方を、文字を用いて一般化しましょう。

    固有値、固有ベクトルの求め方の一般化

     2次正方行列 A=(abcd)A=\begin{pmatrix}a & b \\ c & d\end{pmatrix} に対して、固有ベクトルを (xy)(≠0⃗)\begin{pmatrix} x \\ y \end{pmatrix}(\ne\vec{0})、固有値を λ\lambda とすると、以下の関係が成り立ちます。

    (ab cd)(xy)=λ(xy)\begin{align*} \begin{pmatrix} a & b \\  c & d \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\lambda \begin{pmatrix} x \\ y \end{pmatrix} \end{align*}

     これに、単位行列 (1001)\begin{pmatrix} 1 & 0 \\ 0 & 1 \end{pmatrix} を掛けて

    (ab cd)(xy)=λ(10 01)(xy)\begin{align*} \begin{pmatrix} a & b \\  c & d \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\lambda\begin{pmatrix} 1 & 0 \\  0 & 1 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} \end{align*}

    より

    (abcd)(xy)=(λ00λ)(xy)\begin{align*} \begin{pmatrix} a & b \\ c & d \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} \lambda & 0 \\ 0 & \lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} \end{align*}

     左辺から右辺を引いて

    (abcd)(xy)−(λ00λ)(xy)=(00)\begin{align*} \begin{pmatrix} a & b \\ c & d \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} -\begin{pmatrix} \lambda & 0 \\ 0 & \lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     (xy)\begin{pmatrix} x \\ y \end{pmatrix} でくくって

    {(abcd)−(λ00λ)}(xy)=(00)\begin{align*} \left\{\begin{pmatrix} a & b \\ c & d \end{pmatrix} -\begin{pmatrix} \lambda & 0 \\ 0 & \lambda \end{pmatrix}\right\} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     行列のひき算を計算して

    (a−λb−0c−0d−λ)(xy)=(00)\begin{align*} \begin{pmatrix} a-\lambda & b-0 \\ c-0 & d-\lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

    より

    (a−λbcd−λ)(xy)=(00) ⋯(∗3)\begin{align*} \begin{pmatrix} a-\lambda & b \\ c & d-\lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \cdots(*3) \end{align*}

     このとき、固有ベクトルに掛けられている行列 (a−λbcd−λ)\begin{pmatrix} a-\lambda & b \\ c & d-\lambda \end{pmatrix} の行列式

    ∣a−λbcd−λ∣=(a−λ)(d−λ)−bc\begin{align*} \begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}=(a-\lambda)(d-\lambda)-bc \end{align*}

    について、次のことが成り立ちます。

    (case1) ∣a−λbcd−λ∣≠0\begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}\ne0 のとき

     このときは、(xy)=(00)\begin{pmatrix} x \\ y \end{pmatrix}=\begin{pmatrix} 0 \\ 0 \end{pmatrix} となるので、AA には固有値、および固有ベクトルは存在しません。

    (case2) ∣a−λbcd−λ∣=0\begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}=0 のとき

     このときは、AA には固有値、および固有ベクトルは存在し、この

    ∣a−λbcd−λ∣=(a−λ)(d−λ)−bc=0\begin{align*} \begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}=(a-\lambda)(d-\lambda)-bc=0 \end{align*}

    を解くことによって、固有値 λ\lambda が求まります。この

    (a−λ)(d−λ)−bc=0\begin{align*} (a-\lambda)(d-\lambda)-bc=0 \end{align*}

    を特性方程式、または固有方程式といいます。
     この特性方程式を解いて固有値が求まれば、それを元々の (∗3)(*3) 式

    (a−λbcd−λ)(xy)=(00) ⋯(∗3)\begin{align*} \begin{pmatrix} a-\lambda & b \\ c & d-\lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \cdots(*3) \end{align*}

    に代入し、この(行列で表された)連立一次方程式を解くことによって、固有ベクトル (xy)\begin{pmatrix} x \\ y \end{pmatrix} が求まります。

     以上のことをまとめると、次の必要十分条件が成り立ちます。

    <固有値をもつための必要十分条件>

     ある行列 A=(abcd)A=\begin{pmatrix} a & b \\ c & d \end{pmatrix} に固有値 λ\lambda、および固有ベクトルが存在するための必要十分条件は

    (a−λbcd−λ)\begin{align*} \begin{pmatrix} a-\lambda & b \\ c & d-\lambda \end{pmatrix} \end{align*}

    の行列式が 00 になること、つまり

    ∣a−λbcd−λ∣=(a−λ)(d−λ)−bc=0\begin{align*} \begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}=(a-\lambda)(d-\lambda)-bc=0 \end{align*}

    である。

    ***

     証明しましょう。
     まず、(case1) の命題

     ∣a−λbcd−λ∣≠0\begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}\ne0  →ならば \xrightarrow[ならば  ]{}  固有値 λ\lambda が存在しない

    について、元の命題が真であれば、その対偶も真となるので、(case1) の対偶

     固有値 λ\lambda が存在する  →ならば \xrightarrow[ならば  ]{}  ∣a−λbcd−λ∣=0\begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}=0

    も真となります(補足)。

     次に、∣a−λbcd−λ∣=0\begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}=0 を仮定すると、(case2) より、固定値 λ\lambda、および固有ベクトルが存在するので

     固有値 λ\lambda が存在する  ←ならば \xleftarrow[ならば  ]{}  ∣a−λbcd−λ∣=0\begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}=0

     よって、”→\rightarrow” と ”←\leftarrow” の両方の向きの ”ならば” が真であるので

     固有値 λ\lambda が存在する  ⇄\rightleftarrows  ∣a−λbcd−λ∣=0\begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}=0

    となり、これで固有値 λ\lambda、および固有ベクトルが存在するための必要十分条件は

    ∣a−λbcd−λ∣=0\begin{align*} \begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}=0 \end{align*}

    であることが証明されます。

     では、この<固有値をもつための必要十分条件>を用いて、固有値と固有ベクトルを求めてみましょう。 

    例題4

     行列 A=(1224)A=\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} の固有値と固有ベクトルを求めなさい。

    指針
     まずは、この行列の特性方程式を解いて固有値を求めます。そして、その固有値を(行列で表された)連立一次方程式に代入し、それを解くことで固有ベクトルが得られます。

    解答
     
    2次正方行列 A=(1224)A=\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} に対して、固有ベクトルを (xy)(≠0⃗)\begin{pmatrix} x \\ y \end{pmatrix}(\ne\vec{0})、固有値を λ\lambda とすると、以下の関係が成り立ちます。

    (1224)(xy)=λ(xy)\begin{align*} \begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\lambda \begin{pmatrix} x \\ y \end{pmatrix} \end{align*}

     これより

    (1224)(xy)=λ(xy)↔ (1224)(xy)=λ(1001)(xy)↔ (1224)(xy)=(λ00λ)(xy)↔ (1224)(xy)−(λ00λ)(xy)=(00)↔ {(1224)−(λ00λ)}(xy)=(00)↔ (1−λ224−λ)(xy)=(00) ⋯(∗4)\begin{align*} &\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\lambda \begin{pmatrix} x \\ y \end{pmatrix}\\ \leftrightarrow\,&\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\lambda \begin{pmatrix} 1 & 0 \\ 0 & 1 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix}\\ \leftrightarrow\,&\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} \lambda & 0 \\ 0 & \lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix}\\ \leftrightarrow\,&\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} -\begin{pmatrix} \lambda & 0 \\ 0 & \lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix}\\ \leftrightarrow\,&\left\{\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} -\begin{pmatrix} \lambda & 0 \\ 0 & \lambda \end{pmatrix}\right\} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix}\\ \leftrightarrow\,&\begin{pmatrix} 1-\lambda & 2 \\ 2 & 4-\lambda \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \cdots(*4) \end{align*}

     ここでは解説用に計算しましたが、最初から特性方程式を考えればよいので、慣れたら (∗4)(*4) から計算を始めてもかまいません。
     すると、特性方程式

    ∣1−λ224−λ∣=0\begin{align*} \begin{vmatrix} 1-\lambda & 2 \\ 2 & 4-\lambda \end{vmatrix}=0 \end{align*}

    より

    (1−λ)(4−λ)−22=0(1−λ)(4−λ)−4=0\begin{align*} &(1-\lambda)(4-\lambda)-2^2=0\\ &(1-\lambda)(4-\lambda)-4=0 \end{align*}

     展開して整理すると

    1⋅4−λ−4λ+λ2−4=04−5λ+λ2−4=0λ2−5λ=0λ(λ−5)=0\begin{align*} 1\cdot4-\lambda-4\lambda+\lambda^2-4&=0\\ 4-5\lambda+\lambda^2-4&=0\\ \lambda^2-5\lambda&=0\\ \lambda(\lambda-5)&=0 \end{align*}

     よって

    λ=0 または λ−5=0\begin{align*} \lambda=0 または \lambda-5=0 \end{align*}

    より

    λ=0 または λ=5\begin{align*} \lambda=0 または \lambda=5 \end{align*}

    (ⅰ) λ=0\lambda=0 のとき

     (∗4)(*4) に代入して

    (1−0234−0)(xy)=(00)\begin{align*} \begin{pmatrix} 1-0 & 2 \\ 3 & 4-0 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

    より

    (1224)(xy)=(00)(x+2y2x+4y)=(00)\begin{align*} \begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} &=\begin{pmatrix} 0 \\ 0 \end{pmatrix}\\ \begin{pmatrix} x+2y \\ 2x+4y \end{pmatrix} &=\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     対応する成分は等しいので

    {x+2y=02x+4y=0\begin{cases} x+2y=0\\ 2x+4y=0 \end{cases}

     第2式の両辺を 22 で割ると

    {x+2y=0x+2y=0\begin{cases} x+2y=0\\ x+2y=0 \end{cases}

     この(同じ式の)連立方程式の解は x+2y=0x+2y=0 を満たすすべての実数となるので、CC を任意の実数として y=−Cy=-C とすると

    x+2(−C)=0x−2C=0\begin{align*} x+2(-C)&=0\\ x-2C&=0 \end{align*}

    より

    x=2Cx=2C

     したがって、この連立方程式の解は、CC を任意の実数として

    (xy)=(2C−C)=C(2−1)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}&=\begin{pmatrix*}[c] 2C \\ -C \end{pmatrix*}\\ &=C\begin{pmatrix*}[r] 2 \\ -1 \end{pmatrix*} \end{align*}

     よって、λ=0\lambda=0 のときの固有ベクトルは、最も簡単な C=1C=1 のときを選んで

    (xy)=(2−1)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}=\begin{pmatrix*}[r] 2 \\ -1 \end{pmatrix*} \end{align*}

    (ⅱ) λ=5\lambda=5 のとき

     (∗4)(*4) に代入して

    (1−5234−5)(xy)=(00)\begin{align*} \begin{pmatrix} 1-5 & 2 \\ 3 & 4-5 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} =\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

    より

    (−422−1)(xy)=(00)(−4x+2y2x−y)=(00)\begin{align*} \begin{pmatrix} -4 & 2 \\ 2 & -1 \end{pmatrix} \begin{pmatrix} x \\ y \end{pmatrix} &=\begin{pmatrix} 0 \\ 0 \end{pmatrix}\\ \begin{pmatrix} -4x+2y \\ 2x-y \end{pmatrix} &=\begin{pmatrix} 0 \\ 0 \end{pmatrix} \end{align*}

     対応する成分は等しいので

    {−4x+2y=02x−y=0\begin{cases} -4x+2y =0\\ 2x-y=0 \end{cases}

     第1式の両辺を −2-2 で割ると

    {2x−y=02x−y=0\begin{cases} 2x-y=0\\ 2x-y=0 \end{cases}

     この連立方程式の解は 2x−y=02x-y=0 を満たすすべての実数となるので、CC を任意の実数として x=Cx=C とすると

    2C−y=02C-y=0

    より

    y=2Cy=2C

     したがって、この連立方程式の解は、CC を任意の実数として

    (xy)=(C2C)=C(12)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}&=\begin{pmatrix*}[c] C \\ 2C \end{pmatrix*}\\ &=C\begin{pmatrix*}[r] 1 \\ 2 \end{pmatrix*} \end{align*}

     よって、λ=5\lambda=5 のときの固有ベクトルは、最も簡単な C=1C=1 のときを選んで

    (xy)=(12)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}=\begin{pmatrix*}[r] 1 \\ 2 \end{pmatrix*} \end{align*}

     以上より、

     固有値が λ=0\lambda=0 のときの固有ベクトルは

    (xy)=(2−1) ⋯(答)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}&=\begin{pmatrix*}[r] 2 \\ -1 \end{pmatrix*} \cdots(答) \end{align*}

     固有値が λ=5\lambda=5 のときの固有ベクトルは

    (xy)=(12) ⋯(答)\begin{align*} \begin{pmatrix*}[r] x \\ y \end{pmatrix*}&=\begin{pmatrix*}[r] 1 \\ 2 \end{pmatrix*} \cdots(答) \end{align*}

    ■\blacksquare

     結果をまとめると、行列 A=(1224)A=\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} について、以下の2つの式が成り立ちます(要確認)。

    (1224)(2−1)=0(2−1)(1224)(12)=5(12)\begin{align*} &\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} 2 \\ -1 \end{pmatrix} =0 \begin{pmatrix} 2 \\ -1 \end{pmatrix}\\[10pt] &\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} 1 \\ 2 \end{pmatrix} =5 \begin{pmatrix} 1 \\ 2 \end{pmatrix} \end{align*}

     前者より、固有値は 00、固有ベクトルは (2−1)\begin{pmatrix*}[r] 2 \\ -1 \end{pmatrix*} となります。
     後者より、固有値は 55、固有ベクトルは (12)\begin{pmatrix*}[r] 1 \\ 2 \end{pmatrix*} となります。

    (注意2)固有値は 0 になる場合がある

     固有ベクトルは零ベクトルを含めませんが、固有値は 00 になる場合があります。そのような場合にも、固有値 00 に対応する固有ベクトルは必ず存在します。
     固有値は、その固有ベクトルの大きさ(長さ)を何倍にするかを表しますが、固有値が 00 のときは、その大きさを「00 倍にする」場合だといえます。すなわち、その固有ベクトルの方向は、変換行列によってベクトルの大きさが 00 になる特別な方向だと考えることができます。言い換えると、「その方向のどのようなベクトルも、変換によって必ず零ベクトルにしてしまう」特別な方向だということです。
     例えば、例題4の

    (1224)(2−1)=0(2−1)\begin{align*} &\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} 2 \\ -1 \end{pmatrix} =0 \begin{pmatrix} 2 \\ -1 \end{pmatrix} \end{align*}

    のケースを考えると、変換行列 (1224)\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} によって、(2−1)\begin{pmatrix} 2 \\ -1 \end{pmatrix} と同じ向きの任意のベクトル(大きさは何でもよい)は、零ベクトルになることが分かります。このことは、逆向きの任意のベクトルについてもいえます。

    例 (2−1)\begin{pmatrix} 2 \\ -1 \end{pmatrix} と同じ向きのベクトル (3−1.5)\begin{pmatrix} 3 \\ -1.5 \end{pmatrix}、または逆向きのベクトル (−42)\begin{pmatrix} -4 \\ 2 \end{pmatrix} について、次の式が成り立ちます(要確認)。

    (1224)(3−1.5)=0(3−1.5)(1224)(−42)=0(−42)\begin{align*} &\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} 3 \\ -1.5 \end{pmatrix} =0 \begin{pmatrix} 3 \\ -1.5 \end{pmatrix}\\[10pt] &\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} -4 \\ 2 \end{pmatrix} =0 \begin{pmatrix} -4 \\ 2 \end{pmatrix} \end{align*}

    画像

     一般に、kk を 00 以外の任意の実数として、(2−1)\begin{pmatrix} 2 \\ -1 \end{pmatrix} を kk 倍したベクトル
     k(2−1)=(2k−k)k\begin{pmatrix} 2 \\ -1 \end{pmatrix}=\begin{pmatrix} 2k \\ -k \end{pmatrix}
    について、次の式はつねに成り立ちます(要確認)。

    (1224)(2k−k)=0(2k−k)\begin{align*} &\begin{pmatrix} 1 & 2 \\ 2 & 4 \end{pmatrix} \begin{pmatrix} 2k \\ -k \end{pmatrix} =0 \begin{pmatrix} 2k \\ -k \end{pmatrix} \end{align*}

     固有値が 00 のときは、そのときの固有ベクトルの大きさを「00 倍にする」、つまり、その方向の大きさを「完全につぶしてしまう」特別な場合だと考えられます。

    ケイリー・ハミルトンの定理

     まずは、先にやった固有値をもつための必要十分条件を確認しましょう。

    <固有値をもつための必要十分条件>

     ある行列 A=(abcd)A=\begin{pmatrix} a & b \\ c & d \end{pmatrix} に固有値 λ\lambda 、および固有ベクトルが存在するための必要十分条件は

    (a−λbcd−λ)\begin{align*} \begin{pmatrix} a-\lambda & b \\ c & d-\lambda \end{pmatrix} \end{align*}

    の行列式が 00 になること、つまり

    ∣a−λbcd−λ∣=(a−λ)(d−λ)−bc=0\begin{align*} \begin{vmatrix} a-\lambda & b \\ c & d-\lambda \end{vmatrix}=(a-\lambda)(d-\lambda)-bc=0 \end{align*}

    である。この方程式を特定方程式、または固有方程式という。

    ***

     この特性方程式を展開して、λ\lambda について整理すると

    (a−λ)(d−λ)−bc=0ad−aλ−dλ+λ2−bc=0λ2−aλ−dλ+ad−bc=0λ2−(a+b)λ+ad−bc=0\begin{align*} (a-\lambda)(d-\lambda)-bc=0\\ ad-a\lambda-d\lambda+\lambda^2-bc=0\\ \lambda^2-a\lambda-d\lambda+ad-bc=0\\ \lambda^2-(a+b)\lambda+ad-bc=0 \end{align*}

     この2次方程式を解くことによって、固有値 λ\lambda が求まります。
     この λ\lambda を、もとの行列 AA に置き換えた次の式

    A2−(a+b)A+(ad−bc)E=O\begin{align*} A^2-(a+b)A+(ad-bc)E=O \end{align*}

    が、かつて高校でも習ったケーリーハミルトンの定理とよばれる関係式です。この定理の証明自体は、中学でも分かる⑬「行列」で行いました。
     なお、ad−bcad-bc に、2次の単位行列 EE を掛けていることに注意しましょう。EE を掛ける理由は、行列として扱うためです。つまり、この式の行列を成分で表すと

    (abcd)2−(a+b)(abcd)+(ad−bc)(1001)=(0000)\begin{align*} \begin{pmatrix} a & b \\ c & d \end{pmatrix}^2-(a+b)\begin{pmatrix} a & b \\ c & d \end{pmatrix}+(ad-bc)\begin{pmatrix} 1 & 0 \\ 0 & 1 \end{pmatrix}=\begin{pmatrix} 0 & 0 \\ 0 & 0 \end{pmatrix} \end{align*}

    となります。仮に EE を掛けないと

    (abcd)2−(a+b)(abcd)+(ad−bc)=(0000)\begin{align*} \begin{pmatrix} a & b \\ c & d \end{pmatrix}^2-(a+b)\begin{pmatrix} a & b \\ c & d \end{pmatrix}+(ad-bc)=\begin{pmatrix} 0 & 0 \\ 0 & 0 \end{pmatrix} \end{align*}

    と、行列に実数 ad−bcad-bc をたすことになり、意味のない式になります。
      また、OO は零行列 (0000)\begin{pmatrix} 0 & 0 \\ 0 & 0 \end{pmatrix} であって、実数値の 00 ではないことにも注意しましょう。左辺全体は2行2列の行列になるので、右辺も同じ型の、2行2列の零行列でなければなりません。

     このケイリー・ハミルトンの定理は、次のように nn 次正方行列に拡張されます。この一般化された主張が、線形代数における重要な「ケイリー・ハミルトンの定理」です。

    <ケイリー・ハミルトンの定理(一般)>

     n×nn\times n 行列 AA の特性多項式 PA(λ)P_A(λ) が、次のように与えられたとします。これは固有多項式ともよばれます。

    PA(λ)=∣A−λE∣=cnλn+cn−1λn−1+⋯+c1λ+c0\begin{align*} P_A(λ)=|A−λE|=c_nλ^n+c_{n−1}λ^{n−1}+\cdots+c_1λ+c_0 \end{align*}

     c1, c2, c3, ⋯ , cnc_1,  c_2,  c_3,  \cdots,  c_n は、行列式の計算によって得られる、実数の値をもつ係数です。EE は n×nn\times n の単位行列です。
     このとき、ケイリー・ハミルトンの定理は、
     「特性多項式 PA(λ)P_A(λ) の固有値 λλ に行列 AA を代入すると、零行列 OO になる」
    ことを主張します。つまり、以下の式が成り立ちます。

    PA(A)=cnAn+cn−1An−1+⋯+c1A+c0E=O ⋯(∗5)\begin{align*} P_A(A)=c_nA^n+c_{n−1}A^{n−1}+⋯+c_1A+c_0E=O \cdots{(*5)} \end{align*}

     なお、定数項 c0c_0​ には、行列にするために n×nn\times n の単位行列 EE を掛けます。また、OO は n×nn\times n の零行列です。

     この (∗5)(*5) について、n=2n=2 として、c2=a+d, c3=ad−bcc_2=a+d,  c_3=ad-bc としたものが、2次正方行列におけるケイリー・ハミルトンの定理です。

    A2−(a+b)A+(ad−bc)E=O\begin{align*} A^2-(a+b)A+(ad-bc)E=O \end{align*}

     これは3次正方行列、4次正方行列、さらには一般の nn 次正方行列まで拡張されます。拡張するにあたって、各 cnc_n の式は複雑なものになりますが、その過程でさまざまな定理や性質が明らかになります。
     その内容はこの記事の範囲を超えるので、より深く学びたい場合は、大学の線形代数の教科書などをご参照ください。

    固有値の歴史

     フランスの数学者、オーギュスタン=ルイ・コーシー(Augustin Louis Cauchy)は、固有値の研究において重要な役割を果たした数学者の一人です。

    画像
    Augustin Louis Cauchy(1789年 - 1857年)

     19世紀初頭、道具としての「行列」はすでに存在していました。しかし、行列の性質やその応用など、行列そのものを研究の対象とする、抽象的な理論としての「行列理論」は、まだ確立されてはいませんでした。
     その中で彼は、「二次形式の標準化」という問題に取り組む中で、行列の「固有値」や「固有ベクトル」の重要性に着目し、それを深く研究しました。

     コーシーがとりわけ関心を寄せていたのは、A2+Bxy+Cy2=DA^2+Bxy+Cy^2=D のような二次形式とよばれる式を、座標変換によって A′x2+C′y2=DA'x^2+C'y^2=D という単純な形、いわゆる標準形に変換することでした。この操作を、二次形式の標準化といいます。
     コーシーは、この標準化による変換後の係数 A′,C′A', C' が、ある特定の方程式、今日の用語でいえば「特性方程式」の解として得られることを発見しました。
     この解こそが、現代でいう「固有値」に他なりません。
     さらにコーシーは、この固有値が、物体がどのくらい速く振動するか、どのくらい回転しやすいかといった、力学における運動の特徴を表していることにも気づいていました。
     固有値や固有ベクトルは、行列の性質をとらえる上で非常に重要な概念です。コーシーは二次形式の標準化を研究する中で、行列の背後にある構造を明らかにし、その性質を引き出すための手法を切り開いていたのです。

     コーシーの研究を土台として、ケイリーやシルベスター、ハミルトンといった後続の数学者たちによって、行列理論の本格的な研究が加速されていきました。そしてそれは今日の「線形代数」という学問へと受け継がれていきます。コーシーがいなければ、現在の線形代数の発展は遅れていたといっても過言ではないでしょう。

    (補足)必要十分条件と対偶

     必要十分条件と対偶について、簡単に解説します。詳しくは高校1年で習います。

    命題の真と偽、反例

     2つの条件 p, qp,  q に対して「pp ならば qq」という命題を考えます。これは「ならば」を意味する記号 →\rightarrow や ⇒\Rightarrow を用いて

    p→q\begin{align*} p \rightarrow q \end{align*}

    または

    p⇒q\begin{align*} p \Rightarrow q \end{align*}

    と表します。このとき、pp をこの命題の仮定、qq を結論といいます。
     例えば「x=1x=1 ならば x2=1x^2=1」という命題は

    x=1→x2=1\begin{align*} x=1 \rightarrow x^2=1 \end{align*}

    と表せます。このとき x=1x=1 は仮定で、x2=1x^2=1 は結論です。

     また、命題が正しいとき、その命題は真であるといい、正しくないとき、その命題は偽であるといいいます。
     例えば、
     x=1x=1 ならば x2=1x^2=1
    という命題は真です。x=1x=1 を x2=1x^2=1 に代入すれば成り立ちます。
     一方、その命題の仮定と結論を入れ換えた
     x2=1x^2=1 ならば x=1x=1
    という命題は、正しくないので偽です。

     ある命題が偽であることを示すには、その命題が成り立たない例を一つあげます、そのような例を反例といいます。反例とは、仮定を満たすが結論を満たさない例のことです。
     すると、先ほどの「x2=1x^2=1 ならば x=1x=1」の反例は x=−1x=-1 となります。x=−1x=-1 は、仮定 x2=1x^2=1 を満たしますが、結論 x=1x=1 を満たしません。

    必要条件と十分条件

     一般に、2つの条件 p, qp,  q に対して、命題 p→qp \rightarrow q が真であるとき、
     pp は qq であるための十分条件
     qq は pp であるための必要条件
    という。

    p十分条件→q必要条件\begin{align*} \underset{\tiny 十分条件}{p}\hspace{-6pt}\rightarrow\hspace{-6pt}\underset{\tiny 必要条件}{q} \end{align*}

    ***

     「必要」や「十分」という日常語の意味から理解しようとすると、多くの場合はかえって混乱するので、上記のように機械的に覚えればよいでしょう。

    <覚え方>
     「~は」の主語だけに着目して、
    ・「~は」が矢印の根元にあれば十分条件
    ・「~は」が矢印の先端にあれば必要条件
    と覚えます。下図のように、矢印の根元は「十」と書けるので十分条件、矢印の先端は「必」とかけるので必要条件、と覚えればよいでしょう。

    画像

     例えば、先ほどの「x=1x=1 ならば x2=1x^2=1」という命題を考えます。

    x=1→x2=1\begin{align*} x=1 \rightarrow x^2=1 \end{align*}

    この命題は真です。このとき、
     x=1x=1 は x2=1x^2=1 であるための十分条件
    であり
     x2=1x^2=1 は x=1x=1 であるための必要条件
    となります。

    x=1十分条件→x2=1必要条件\begin{align*} \underset{\tiny 十分条件}{x=1} \rightarrow \underset{\tiny 必要条件}{x^2=1} \end{align*}

    画像

     十分条件や必要条件は、2つの条件の間の論理的な関係を表す言葉なので、なにかある1つの条件だけを取り出して「~は十分条件である」というような言い方は、論理的には適切ではありません。
     ただし、文脈から「何のための条件か」がはっきりしているときには、「p は十分条件である」「q は必要条件である」のように、「~であるための」を省略していうこともよくあります。

    例 x=1x=1 は十分条件、x2=1x^2=1 は必要条件である。

     次に、この命題の仮定と結論を入れ換えた「x2=1x^2=1 ならば x=1x=1」という命題

    x2=1→x=1\begin{align*} x^2=1 \rightarrow x=1 \end{align*}

    は偽でした(反例は x=−1x=-1)。なお、十分条件や必要条件といえるのは、その命題「p→qp \rightarrow q」が真である場合だけです。命題が偽である場合には、必要条件や十分条件という枠組みは適用できません。

    必要十分条件

     「pp ならば qq」と「qq ならば pp」の両方の命題を、両向きの「ならば」を意味する記号 ⇄\rightleftarrows や ↔\leftrightarrow や ⇔\Leftrightarrow を用いて

    p⇄q\begin{align*} p \rightleftarrows q \end{align*}

    または

    p↔q\begin{align*} p \leftrightarrow q \end{align*}

    または

    p⇔q\begin{align*} p \Leftrightarrow q \end{align*}

    と表す。
    「pp ならば qq」と「qq ならば pp」がともに真であるとき、すなわち p↔qp \leftrightarrow q が成り立つとき、
     pp は qq であるための必要十分条件
    という。この場合、
     qq は pp であるための必要十分条件
    でもある。

    p必要十分条件↔q必要十分条件\begin{align*} \underset{必要十分 \atop 条件}{p}\hspace{-7pt}\leftrightarrow\hspace{-7pt}\underset{必要十分 \atop 条件}{q} \end{align*}

     またこのとき、
     pp と qq は同値である
    という。

    ***

     例えば、「x=0x=0 ならば x2=0x^2=0」という命題を考えます。

    x=0→x2=0\begin{align*} x=0 \rightarrow x^2=0 \end{align*}

     この命題は真です。x=0x=0 を x2=0x^2=0 に代入すると成り立ちます。
     次に、この命題の仮定を結論を入れ換えた「x2=0x^2=0 ならば x=0x=0」という命題を考えます。

    x2=0→x=0\begin{align*} x^2=0 \rightarrow x=0 \end{align*}

     すると、この命題も真です。x2=0x^2=0 を満たす xx は、x=0x=0 のみだからです。よって、
     x=0x=0 は x2=0x^2=0 であるための必要十分条件
    であり、
     x2=0x^2=0 は x=0x=0 であるための必要十分条件
    です。

    x=0必要十分条件↔x2=0必要十分条件\begin{align*} \underset{必要十分 \atop 条件}{x=0} \leftrightarrow \underset{必要十分 \atop 条件}{x^2=0} \end{align*}

     つまり、
     x2=0x^2=0 と x=0x=0 は同値
    となります。

    逆・裏・対偶

     p→qp \rightarrow q  という命題について、仮定 pp と結論 qq を入れ換えた命題

    q→p\begin{align*} q \rightarrow p \end{align*}

    を逆という。
     また、仮定 pp と結論 qq の両方を否定にした「pp でないならば qq でない」という命題

    p‾→q‾\begin{align*} \overline{p} \rightarrow \overline{q} \end{align*}

    を裏という。条件 pp に対して、「pp でない」という条件を pp の否定といい、条件の記号の上に横棒をつけた p‾\overline{p} という記号で表す。

     さらに、この裏を逆にした

    p‾→q‾\begin{align*} \overline{p} \rightarrow \overline{q} \end{align*}

    を対偶という。

    ***

     以上のことを、まとめておきます。

    <逆・裏・対偶>
     命題 p→qp \rightarrow q について、
     逆は「q→pq \rightarrow p」
     裏は「p‾→q‾\overline{p} \rightarrow \overline{q}」
     対偶は「p‾→q‾\overline{p} \rightarrow \overline{q}」

    ***

     逆と裏は互いに対偶の関係にあり、逆の対偶は裏、裏の対偶は逆です。また、対偶の対偶はもとの命題になります。
     以上を図式化すると次のようになります。

    画像

     例えば、先に述べた「x=1x=1 ならば x2=1x^2=1」という命題について
      逆は「x2=1x^2=1 ならば x=1x=1」
      裏は「x≠1x\ne1 ならば x2≠1x^2\ne1」
     対偶は「x2=1x^2=1 ならば x=1x=1」
    となります。

     ここで、次のような重要な定理があります。

    「命題とその対偶の真偽は一致する。」

     「x=1x=1 ならば x2=1x^2=1」という命題について、この命題は真です。この命題の逆、裏、対偶の真偽は次のようになります。

     命題「x=1x=1 ならば x2=1x^2=1」は真
      逆「x2=1x^2=1 ならば x=1x=1」は偽
      裏「x≠1x\ne1 ならば x2≠1x^2\ne1」は偽
     対偶「x2≠1x^2\ne1 ならば x≠1x\ne1」は真

     すると、元の命題と対偶はどちらも真であり、同じく対偶の関係にある逆と裏はどちらも偽であり、「もとの命題とその対偶の真偽は一致する」ことが分かります。

    対偶による証明

     ある命題を証明するとき、その命題を直接証明するよりも、その対偶を証明するほうが簡単な場合があります。そのようなときは、対偶を証明します。

    例題
     ある整数 nn について、次の命題を証明しなさい。
     「n2n^2 が偶数であるとき、nn は偶数である。」
    証明
     この命題の対偶をとると
     「nn は偶数でないとき、n2n^2 は偶数ではない。」
     偶数ではない数は奇数なので、さらに次のように表せる。
     「nn は奇数のとき、n2n^2 は奇数である。」

     まず、nn は奇数なので、kk を整数 (⋯ ,−2,−1, 0, 1, 2,⋯\cdots, -2, -1,  0,  1,  2, \cdots) として

    n=2k+1 ⋯(∗)n=2k+1 \cdots(*)

    とおける。ここで展開公式
     (a+b)2=a2+2ab+b2(a+b)^2=a^2+2ab+b^2
    を用いると

    n2=(2k+1)2=(2k)2+2⋅2k⋅1+12=4k2+4k+1=2(2k2+2k)+1=2l+1(ただし l=2k2+2k とおいた)\begin{align*} n^2&=(2k+1)^2\\ &=(2k)^2+2\cdot2k\cdot1+1^2\\ &=4k^2+4k+1\\ &=2(2k^2+2k)+1\\ &=2l+1 (ただし  l=2k^2+2k  とおいた) \end{align*}

     すると、kk は整数なので、l(=2k2+2k)l(=2k^2+2k) も整数となり 2l+12l+1 は奇数。よって、n2n^2 は奇数となる。

    ■\blacksquare

    (∗)(*) 例えば、奇数 −5,−3,−1, 1, 3, 5, ⋯-5, -3, -1,  1,  3,  5,  \cdots  は
     −5=2×(−3)+1-5=2\times(-3)+1
     −3=2×(−2)+1-3=2\times(-2)+1
     −1=2×(−1)+1-1=2\times(-1)+1
         1=2×0+11=2\times0+1
         3=2×1+13=2\times1+1
         5=2×2+15=2\times2+1
    ⋮\hspace{30pt}\vdots
    より、2k+12k+1(kk は整数)の形で書けます。

     なお、確認として、22 で割り切れる整数を偶数といいます。また、22 で割り切れない整数を奇数といいます。よって、偶数ではない数は奇数です。
     一般に、偶数と奇数は負の場合も含まれます。例えば −4-4 は偶数、−3-3 は奇数です。また 00 は 22 で割り切れるので偶数です。

    バックナンバー

    理数系小説『シュレーディンガーの Φ』


    この記事が参加している募集

    あなたへのおすすめ