スマートフォンの録音アプリから流れてくる声に対して、「自分の声が気持ち悪いのはなぜなのか」と疑問を抱く人は後を絶ちません。この嫌悪感の第一の引き金は、人間の頭部構造に起因する音響伝達経路の乖離にあります。人間が発声するとき、耳の奥にある蝸牛(かぎゅう)へ届く音には、空気中を伝わる外的な音波と、頭蓋骨や筋肉組織を直接揺らす内的な振動の2種類が存在します。
普段自分が耳にしている声は、声帯の振動が頭蓋骨や首の軟部組織を伝わって内耳に直接届く「骨伝導音」と、口から出て空気を介して鼓膜を震わせる「気導音」がブレンドされた特殊なミックス音です。この骨伝導音には、100Hzから300Hz付近の低周波帯を5〜10dBほどブーストする物理的なフィルター特性が備わっています。つまり、人間は物心ついたときから「頭蓋骨という天然のイコライザーによって、低音が太く豊かに補正された声」を自分の標準形として刷り込まれているのです。
一方、スピーカーやマイクが拾い上げるのは空気中を伝播した「気導音」のみです。骨伝導によって付加されていた低音の重厚感が根こそぎ削ぎ落とされるため、録音された音声を再生した瞬間、脳は「自分の声の周波数の特徴」が激変したことを感知します。予想していたよりも薄っぺらく、不自然に甲高く、鼻にかかったように聞こえる音響的ギャップこそが、録音した声に違和感を覚える理由の物理的な正体です。