エクセルで標準偏差を扱う際、ネット上の断片的な情報だけを鵜呑みにしていると、重大な計算ミスやシステムエラーに直面することがあります。
代表的なエラーの一つが「#DIV/0!」です。STDEV.S関数を使用している際、選択範囲内の数値データが「1件」しかない場合、分母が「$N-1 = 0$」となるためゼロ除算エラーが発生します。また、数値が文字列として保存されていたり、半角数字の中に全角スペースが混入していると「#VALUE!」が返されるか、あるいは計算対象から除外されて意図しない母数で計算されてしまいます。
さらに見落とされがちな統計的盲点として、「正規分布の前提」があります。標準偏差は、データが平均値を中心に左右対称の釣鐘型(正規分布)を形成しているときに最大の威力を発揮します。しかし、年収データやWebサイトのPV数のように「一部の極端な外れ値が引き上げているロングテール型のデータ」に対して単純に標準偏差を当てはめると、実態からかけ離れた分析結果を招く危険性があります。
【プロの結論】データリテラシー格差を防ぐための判断基準と実践的アプローチ
大手コンサルティングファームのシニアアナリストへの取材において、次のような指摘がなされていました。『社内報告書でSTDEV.PとSTDEV.Sを混同しているケースは全体の3割以上にのぼり、特にサンプル数が少ない初期フェーズの意思決定で誤った判断を下す要因になっている』という現実です。
データ分析の信頼性を保つため、以下の判断基準を徹底することを強く推奨します。
【STDEV.Sを採用すべき条件】
・ユーザーアンケート、試作品の耐久テスト、抽出サンプルの検証など、全貌が把握できない対象から全体像を推計するとき。
・データ数が数十〜数百件程度にとどまり、母集団の推定に慎重さが求められるとき。
【STDEV.Pを採用すべき条件】
・社内全従業員の人事データ、対象期間における確定売上トランザクション全件など、計測対象の「すべて」が手元に存在するとき。
・すでに完了したプロジェクト全体の確定実績を客観的に要約・記録するとき。