Excel標準偏差の罠!Stdev. PとSの違い・正しい求め方

Excel標準偏差の罠!Stdev. PとSの違い・正しい求め方

Excel標準偏差の罠!Stdev. PとSの違い・正しい求め方に関する最新の話題を丁寧に解説いたします。

実務で標準偏差を算出する際、最も頻発するトラブルが「STDEV.P」と「STDEV.S」の取り違えです。末尾のアルファベット一文字の違いですが、数学的な定義と背景にある統計学的思想は根本から異なります。

両者の本質的な違いは、対象データが「母集団そのもの(Population)」なのか、それとも「母集団から抜き出した標本(Sample)」なのかという点にあります。

全社員の健康診断データや、製造ラインの全品検査データのように、存在するすべての対象を測定している場合は母集団の標準偏差(STDEV.P)を用います。この場合、分散は偏差平方和をデータ数 $N$ で割ることで求められます。

一方、1万人の顧客から抽出した300人のアンケート結果や、抜き取り検査データのように、一部のサンプルから全体を推測する場合は標本標準偏差(STDEV.S)を選択しなければなりません。標本から計算する場合、母集団全体のばらつきを過小評価してしまう傾向があるため、数学的な補正としてデータ数から1を引いた自由度 $N-1$ で割る「不偏分散」が用いられます。

データ件数が数万件規模であれば計算結果の差はごくわずかですが、サンプル数が10件〜30件程度の小規模データでは、分母が $N$ か $N-1$ かによって算出値に無視できない乖離が生じます。社内報告やクライアント向けレポートでここを誤ると、データの信頼性を根底から損なう要因となります。

橋本 菜々子
著者

橋本 菜々子

グルメと旅を愛するフリーライター。全国各地の隠れた魅力を独自の視点から紹介します。