このブログ記事では、電話の音声が実際の音声と異なって聞こえる理由と、その背後にある技術的な原理について説明します。
映画の中で犯罪者を描いた作品で特に印象的なのは、犯人の声です。画面が暗転し、登場人物が息を呑んで電話に出る瞬間、不気味な犯人の声が、一気に緊張感を最高潮に高めます。同様に、多くの映画で登場する電話の声は、観客に恐怖を植え付ける上で重要な役割を果たしています。特に、子供を誘拐した犯人の声が電話回線から流れてくるシーンは、その声だけで迫力を高めています。映画の中で聞こえるこの声は、演出上のテクニックだと考える人も多いでしょう。しかし、電話の声が原作の音声と異なって聞こえるのは、実は技術的な要因によるものです。
現実世界でも、電話での会話中に聞こえる声は、対面で話している時の声とは異なります。これは、電話機が音声を電気信号に変換して伝送する過程で生じる変調によるものです。この機械的な処理によって、元の音声は音質、音色、周波数帯域など、様々な変化を呈します。そのため、捜査機関が電話の音声のみに基づいて容疑者を特定することには限界があります。映画では、恐怖感を演出するために、電話の音声を意図的に歪ませることがよくあります。
それでは、電話の仕組みと音声変調の仕組みを見てみましょう。電話の基本原理は、音声を電気信号に変換し、相手に伝えることです。このプロセスには主に2つの段階があります。1つ目はマイクが音声を電気信号に変換する段階です。2つ目はその信号を送信する段階です。送信された信号は、受話器からスピーカーを通して音として再生されます。電話信号として送信される音声周波数は、約300Hzから3,400Hzに制限されています。人間の音声周波数帯域は約20Hzから20,000Hzであるため、電話機ではこのスペクトルの一部しか伝達されません。その結果、人の声の低周波成分と高周波成分の多くが失われてしまいます。
この周波数帯域の制限が、犯罪者の声が異なって聞こえる主な理由です。映画や実際の電話の音声録音は、この限られた周波数帯域に制約されているため、平坦で音色が損なわれ、高音が強調されます。実際、電話の声は元の声よりも鋭く、聞き慣れない感じがします。犯罪映画では、この特性を利用して、犯罪者の声をさらに奇妙に歪ませることがよくあります。
さらに、犯罪映画で音声変調技術が用いられる際には、恐怖感を増幅させるために、特定の効果音が追加されることがよくあります。これらの効果音は、特に誘拐や脅迫電話のシーンにおいて、ドラマチックな要素として機能します。典型的には、高音と低音の両方を同時に強調したり、不規則な電子音効果を加えたりすることで、電話を受ける側の心理的な緊張感をよりリアルに視聴者に伝えます。音声に震えやエコー効果を加えることも、恐怖感を演出するためによく用いられる手法です。
このような声の変調は、映画的な手法としてだけでなく、実際の犯罪捜査においても重要な役割を果たしています。電話による脅迫や身元不明者の出現といった事件において、捜査機関は声の変調や音声分析によって容疑者の特定を試みます。特定の周波数を分析して声の特徴を特定したり、音色を分析することで特定の人物と声を一致させるといった手法がこれに該当します。近年、人工知能(AI)を用いた音声分析技術の進歩により、これまで判別不可能だった極めて微妙な声の特徴までも分析できるようになりました。
このように、電話における声の抑揚や効果音は、単なる仕掛けを超えた、現実世界における重要な意味合いを持っています。特に映画では、犯罪者の声だけで観客の緊張を高めるために、この効果を劇的に利用しています。声だけで心理的なプレッシャーを誘発できるという事実は、電話を用いた犯罪捜査において、声の違いがいかに重要であるかを強調しています。