導入:確率変数の世界へようこそ!

皆さん、こんにちは!ビジネス経済学の旅において、最も重要な章の一つへようこそ。「統計」という言葉を聞いて少し緊張してしまった方もご安心ください。ここでは、難しい理論を日常的な身近な概念に噛み砕いて解説していきます。この章では、「不確実性」を「数値」に変換する方法を学びます。ビジネスの世界では未来を完全に予測することはできませんが、確率変数(Random Variables)を活用することで、リスクを数値化し、より賢明な意思決定を下せるようになります。さあ、始めましょう!


1. 確率変数とは正確には何?

簡単に言うと、確率変数とは、ランダムな事象の結果に数値(値)を割り当てる手法のことです。「雨が降るかもしれないし、晴れるかもしれない」と言う代わりに、それぞれの可能性に数値を割り当てることで、数学的な計算ができるようになるのです!

試験に向けて、次の2つの主なタイプを覚えておきましょう。

A. 離散型確率変数(Discrete Random Variables)

これは、発生しうる結果を数える(カウントする)ことができる変数です。値と値の間に隙間があります。 例:店に入ってくる客数(1人、2人、10人とは言えますが、2.5人とは言えませんよね)。

B. 連続型確率変数(Continuous Random Variables)

これは、一定の範囲内でどんな値でも取り得る変数です。通常、数えるのではなく測定(計測)されます。 例:顧客が列に並ぶ待ち時間(5分、5.2分、あるいは5.234分といった数値になり得ます)。

暗記のコツ:Discrete(離散型)はDots(点々のように分かれている)、Continuous(連続型)はConnected(つながった線)とイメージしましょう。

クイック復習: - 離散型:数えられるもの(例:不良品の数)。 - 連続型:計測できるもの(例:梱包の重量)。


2. 離散型変数の確率分布

確率分布(Probability Distribution)とは、ある確率変数が取り得るすべての値と、それぞれの値が発生する確率をまとめた表やリストのことです。

離散確率分布において、必ず守るべき「黄金ルール」が2つあります: 1. 個々の確率 \( P(x) \) は、必ず0から1の間であること。 2. すべての確率を合計すると、必ず1になること。(「何か」が起こるはずですから!)

例:1日に販売されるノートパソコンの台数をチェックする場合: - 0台:10% - 1台:60% - 2台:30% 合計 = 10% + 60% + 30% = 100%(または1.0)。これは妥当な分布です!

よくある間違い:確率の合計が0.9や1.1になってしまったら、どこか計算ミスをしています!合計が必ず1.0になるかどうか、常にダブルチェックしましょう。


3. 期待値と分散:データの「心臓部」

分布を理解したら、次に知りたいのは「平均的な結果はどれくらいか」、そして「結果はどれくらいばらついているか」の2点です。

期待値 \( E(X) \)

期待値(Expected Value)(別名:平均値)は、その実験を何度も繰り返した場合の長期的な平均結果です。 公式は以下の通りです: \( E(X) = \mu = \sum [x \cdot P(x)] \)

計算ステップ: 1. それぞれの値 \( x \) に、その確率 \( P(x) \) を掛けます。 2. すべての結果を足し合わせます。それがあなたの求める「平均」です!

分散 \( Var(X) \) と標準偏差 \( \sigma \)

分散(Variance)は、結果が平均からどれくらい離れているかを示します。分散が大きいほど、結果が予測しにくくなるため、リスクが高いと言えます。 分散の公式は: \( Var(X) = \sigma^2 = \sum [(x - \mu)^2 \cdot P(x)] \)

標準偏差(Standard Deviation)は、分散の平方根をとったものです: \( \sigma = \sqrt{Var(X)} \)。もとのデータと同じ単位になるため、こちらがよく使われます。

重要ポイント: - 期待値:中心はどこか。 - 分散/標準偏差:「ばらつき」やリスクの広さはどれくらいか。


4. 二項分布

これは離散分布の一種で、HKICPAのカリキュラムでも頻出の特別な分布です。「Yes/No」あるいは「成功/失敗」という状況で使われます。

いつ使うか? 「BINS」の頭文字を覚えましょう: - Binary(二値性):結果は2つのみ(例:合格/不合格)。 - Independent(独立性):1回の試行が次の試行に影響しない。 - Number(回数):試行回数( \( n \) )が固定されている。 - Same(同一確率):成功する確率( \( p \) )が毎回同じ。

公式: \( P(X = k) = \binom{n}{k} p^k (1-p)^{n-k} \)

公式を見て怖がらないでくださいね! ほとんどの電卓には \( \binom{n}{k} \) の部分を計算するための \( nCr \) 機能が備わっています。 - \( n \):全試行回数 - \( k \):求めたい成功回数 - \( p \):成功確率

豆知識:監査の現場では、サンプル全体の中で「成功(正当な請求書)」がある基準を満たしているかをテストするために、二項分布の考え方をよく使います!


5. 正規分布(「ベルカーブ」)

連続型変数の世界で最も有名なのが正規分布です。左右対称で、滑らかな釣鐘型の曲線を描きます。

主な特徴:

1. 平均値、中央値、最頻値がすべて中心に位置する。 2. 曲線下の全面積は1.0(100%)である。 3. 平均 \( \mu \) と標準偏差 \( \sigma \) によって形が決まる。

Zスコア(標準化)

正規分布はそれぞれ形が異なるため(背が高いものや太っているものなど)、Zスコアを使って「標準化」し、標準正規分布表を使って確率を求められるようにします。 Zスコアの公式: \( Z = \frac{X - \mu}{\sigma} \)

Zスコアは、その値が平均から標準偏差何個分離れているかを示します。 - プラスのZスコアは平均より上。 - マイナスのZスコアは平均より下を意味します。

経験則(68-95-99.7ルール)

正規分布においては: - データの68%が平均から±1標準偏差の範囲に収まる。 - データの95%が±2標準偏差の範囲に収まる。 - データの99.7%が±3標準偏差の範囲に収まる。

重要ポイント:ビジネスのプロセスが「正規分布に従う」なら、結果の95%が平均から2標準偏差以内に収まると確信できます。これは品質管理において非常に役立つ考え方です!


まとめと応援メッセージ

クイックまとめ: - 確率変数は結果を数値に変える。 - 離散型は「カウント」、連続型は「測定」に使う。 - 期待値は平均、分散はリスクやばらつきを示す。 - 二項分布はYes/Noのシナリオに使う。 - 正規分布はベルカーブとZスコアで確率を求める。

最初は難しく感じるかもしれませんが、大丈夫です!統計は新しい言語のようなものです。「語彙」(用語)と「文法」(公式)を練習すればするほど、自然と理解できるようになりますよ。あなたなら絶対に大丈夫です!