確率論の「核心」へようこそ!
Exam Pの合格を目指す道のりの中で、皆さんはすでに確率の求め方を学んできました。しかし、アクチュアリーとして大切なのは、何かが「起こるかもしれない」かどうかを知ることだけではありません。「平均的に」どうなるのか、そしてリスクがどれくらい「ばらついている」のかを把握することが求められます。この章では、期待値、積率(モーメント)、分位点について学びます。これらは、複雑な分布全体をいくつかの意味のある数値に集約するための強力なツールです。
最初はこれらの用語が少し数学的に聞こえて不安になるかもしれませんが、大丈夫です。この章は、人物を説明する方法を学ぶようなものだと考えてください。平均(Mean)はその人の平均的な身長、分散(Variance)は他の人と比べてどれくらい身長に差があるか、そして分位点(Percentiles)はその人が集団の中でどの位置にいるかを示します。それでは、さっそく見ていきましょう!
1. 積率(モーメント):分布の「スナップショット」
物理学において、「モーメント」は物体の位置や回転に関連する概念です。確率論における積率(モーメント)は、データの集合の形状を定量的に測定する指標です。これには大きく分けて、原積率(Raw Moments)と中心積率(Central Moments)の2種類があります。
k次原積率
k次原積率とは、単純に確率変数 \( X \) を \( k \) 乗したものの期待値のことです。通常、平均は \( \mu \) と表記されます。
公式: \( E[X^k] \)
• \( k = 1 \) のとき、1次原積率:\( E[X^1] \)、つまり平均 (\( \mu \)) です。
• \( k = 2 \) のとき、2次原積率:\( E[X^2] \) となります。
k次中心積率
中心積率は、平均 (\( \mu \)) を基準にして計算されます。これは、データが中心からどのように「振れているか」を示します。
公式: \( E[(X - \mu)^k] \)
• 1次中心積率は常に0になります。なぜなら、平均からの偏差の平均はゼロになるからです! \( E[X - \mu] = E[X] - \mu = 0 \)。
• 2次中心積率は非常に有名で、分散と呼ばれます。
クイック復習ボックス:
原積率: ゼロを中心とする (\( E[X^k] \))
中心積率: 平均を中心とする (\( E[(X - \mu)^k] \))
2. 分散と標準偏差
分散は、確率変数の「ばらつき」や「ボラティリティ(変動性)」を測定します。保険業界において、高い分散は高いリスクを意味します。なぜなら、実際の保険金支払額が予想よりも大幅に高くなったり(あるいは低くなったり)する可能性があるからです。
「必修」公式:
\( Var(X) = E[X^2] - (E[X])^2 \)
覚え方のコツ: 分散を求めるには、「2乗の平均」から「平均の2乗」を引く、と覚えましょう。
標準偏差 (\( \sigma \)):
分散の単位は「単位の2乗」(例えばドルの2乗)になってしまい、直感的にイメージしづらいものです。そこで、平方根をとることで元の単位に戻します。
\( \sigma = \sqrt{Var(X)} \)
よくある間違い:
多くの学生が \( E[X^2] \) と \( (E[X])^2 \) を混同してしまいます。これらは全く別のものです!必ず先に \( x^2 \cdot f(x) \) を積分して \( E[X^2] \) を計算し、そこから平均の2乗を引くようにしてください。
重要ポイント: 分散は2次中心積率です。これは、「平均的な」結果が実際のデータからどれだけ離れているかを示しています。
3. 最頻値(モード):人気者
最頻値(モード)は、最も起こりやすい \( x \) の値のことです。確率密度関数 (pdf) のグラフで見ると、モードは山の「頂上」にあたります。
求め方:
1. 離散型変数の場合:確率 \( P(X=x) \) が最も大きい \( x \) を探します。
2. 連続型変数の場合:密度関数 \( f(x) \) を最大にする \( x \) の値を見つけます。通常は導関数 \( f'(x) \) を計算して0とおき、\( x \) について解きます。
豆知識: 同じ高さの山が2つある場合など、分布には最頻値が2つ以上存在することもあります(二峰性)。
4. 中央値と分位点
極端な外れ値がある場合(例えば、地元のバーに大富豪がいきなり入ってきた場合など)、平均値は実態を見誤らせることがあります。そんな時は分位点を使います。
中央値(メディアン:50パーセンタイル)
中央値は真ん中の値です。データの半分がそれより小さく、半分がそれより大きくなります。\( m \) または \( \pi_{0.5} \) と表記されます。
計算方法:
次の式を満たす \( m \) を解きます。
\( F(m) = P(X \le m) = 0.5 \)
一般的な分位点
p番目の分位点(\( \pi_p \) と表記)とは、それ以下の値になる確率が \( p \) となる値のことです。
連続型変数のステップ・バイ・ステップ手順:
1. 累積分布関数 (CDF) \( F(x) \) を求める。
2. \( F(\pi_p) = p \) と置く。
3. \( \pi_p \) について解く。
例: 75パーセンタイル(第3四分位点)を求める場合は、\( F(x) = 0.75 \) を解きます。
例え: 身長順に並んだ長い列を想像してください。あなたが90パーセンタイルにいるということは、その列の90%の人よりも背が高いことを意味します。
クイック復習ボックス:
平均: バランスの支点(算術平均)。
中央値: 50/50に分ける境界点。
最頻値: 最も頻繁に現れる地点(山の頂上)。
5. まとめて整理:平均・中央値・最頻値の比較
これら3つの関係性を見ると、分布の歪度(スキューネス)(どちらに偏っているか)がわかります:
• 対称分布: 平均 = 中央値 = 最頻値(完璧なベルカーブのような形)。
• 右に歪んだ分布(正の歪度): 平均 > 中央値 > 最頻値。右側に「長い裾」があります。(保険金支払額によく見られます!)
• 左に歪んだ分布(負の歪度): 平均 < 中央値 < 最頻値。左側に「長い裾」があります。
Exam Pのための重要ポイント: SOAは、指数分布や一様分布などの特定の分布に対して、これらの値を計算させる問題を好みます。まずは変数が離散型なのか連続型なのかを確認し、それからツール(離散なら総和、連続なら積分)を選びましょう。
最後に
この章は、データを要約することがすべてです。もし積率の公式が難しく見えても、それらは単に \( X \) の値を「重み付け」する異なる方法に過ぎないということを思い出してください。様々な関数に対して2次原積率 \( E[X^2] \) を計算する練習をしましょう。一度マスターすれば、分散や標準偏差も自然と身につくはずです。大丈夫、皆さんならきっとできます!