エクセルで標準偏差を計算する際、最大の分岐点となるのが母集団と標本標準偏差の使い分けです。関数名の末尾に付いているアルファベットは、それぞれ英語の対象範囲を意味しています。「P」は母集団全体を意味する「Population」、「S」は抽出された標本を意味する「Sample」の頭文字です。
手元にあるデータが「測定対象のすべて(全数データ)」である場合はSTDEV.Pを使用します。例えば、自社の全社員200名の健康診断結果や、特定の学級全員のテスト結果など、これ以上の母集団が存在しない完結したデータ群が該当します。数式上はデータの総数である「N」で偏差平方和を割るため、母集団そのものの真のバラつきを表します。
一方、手元のデータが「巨大な全体から抜き出した一部(サンプルデータ)」である場合はSTDEV.Sを選択します。全国の顧客から無作為に抽出した100名のアンケート結果や、工場で毎日製造される数万個の製品から抜き取った50個の検品データなどがこれに当たります。サンプルデータから未知の母集団全体のバラつきを推測する際、標本はどうしても平均値付近に集まりやすいため、分母を「N - 1」にして補正をかける「不偏分散」の考え方に基づいています。
実務において「どちらを使うべきか」という疑問に対する明確な答えは、「一部のデータから全体像を推測しているなら、迷わずSTDEV.Sを選ぶ」ということです。市場調査やWebサイトのアクセスログ解析など、私たちがビジネスで目にするデータのほとんどは母集団の一部に過ぎないため、STDEV.Sを選択するのが統計学的に正しいアプローチとなります。