
點解你咁憎自己錄低嘅聲音?科學話你知
點解你咁憎自己錄低嘅聲音?骨傳導令你平時聽到嘅低音喺錄音入面消失,聲音自然又薄又高。早喺1966年一項研究,將呢種不適感命名為「聲音對質」。
點解你咁憎自己錄低嘅聲音,其實關乎兩件完全唔同嘅事,而兩件事都唔代表你把聲真係難聽。第一件係物理:骨傳導會令你喺自己個腦入面聽到嘅聲音多咗啲低音,而錄音就會將呢啲低音濾走。第二件係心理:研究人員喺1966年為呢種反應改咗個名,叫做「聲音對質」。
你多數喺好日常嘅情況試過呢種感覺:留言信箱嘅問候語播返出嚟;朋友喺群組傳咗條派對片,你喺入面講緊嘢;又或者你啱啱 send 出去嘅語音訊息喺另一邊播返出嚟,喇叭傳出嘅聲好似有人帶住鼻音扮你。呢種反應普遍到,智能手機未出現之前幾十年,科學家已經為佢改咗個名。
以下就係實際發生緊嘅事,一半可以怪你個頭骨,一半可以怪你個腦。
快速答案
| 問題 | 簡短答案 |
|---|---|
| 點解我把錄音聲聽落咁唔同? | 你平時同時透過空氣同骨頭聽到自己把聲,但錄音只會收到經空氣傳導嗰部分。 |
| 錄音係咪錯㗎? | 唔係。呢個先係其他人一直以嚟聽開嘅版本。 |
| 係咪個個都憎自己嘅錄音聲? | 冇大家諗得咁誇張。2013年有研究發現,人哋唔知道係自己把聲嘅時候,反而覺得自己把聲幾吸引。 |
| 咩係「聲音對質」? | 1966年提出嘅術語,形容聽到自己把聲錄音時嗰種不適。 |
原因一:骨傳導靜靜哋改緊你聽到嘅嘢
當其他人講嘢,聲音只會循一條路徑去到你耳仔:佢哋把聲經空氣傳過嚟,震動你嘅耳膜,再由個腦解讀成聲音。呢條路徑叫做「空氣傳導」,而你聽其他人講嘢時,收到嘅就只有呢個訊號。
但到你自己講嘢,你仲會免費多收一個訊號。你嘅聲帶同氣道會震動,震動經頭骨同軟組織直接傳去內耳,連同其他人聽到嘅空氣傳導聲一齊到達。倫敦大學學院(University College London)喉科教授 Martin Birchall 向《時代》雜誌(Time)形容呢種疊加效果:「我哋講嘢時,好似其他人經喇叭聽聲,而我哋自己就喺頭腦入面嘅一座複雜洞穴聽聲。」[1]
骨頭喺呢度咁重要,係有原因嘅:佢傳送低頻聲音比高頻聲音有效得多。根據維基百科「骨傳導」條目嘅聲學摘要,頭骨傳導低頻嘅能力比空氣好,所以你會覺得自己把聲比其他人聽到嘅更低沉、更飽滿;一錄低,就往往比預期高音[2]。
關鍵就係呢度。麥克風只會收到空氣傳導嘅訊號,即係你同事同朋友日日聽開嗰個版本。一播返出嚟,頭骨一直靜靜加落去嘅低音就冇咗;剩低嘅聲自然比你一世聽開嗰把更薄、更高。錄音冇扭曲任何嘢,佢只係如實播返其他人一早認識嘅訊號,冇咗你獨有嗰條額外聲道。
兩個訊號並排比較
| 你個頭入面聽到嘅聲 | 錄音入面嘅聲 | |
|---|---|---|
| 傳到耳仔嘅路徑 | 空氣傳導加骨傳導 | 淨係空氣傳導 |
| 低音 | 由頭骨加強 | 冇 |
| 你聽落點樣 | 更低沉、更飽滿、更溫暖 | 更薄、更高音,有時帶鼻音 |
| 邊個聽過呢個版本 | 冇其他人 | 其他人一直都聽緊 |
原因二:「聲音對質」背後嘅心理學
骨傳導造成嘅落差,解釋咗點解錄音聽落唔同;但仲未完全解釋到,點解聽返自己把聲會令你忍唔住皺眉。呢部分有個名,亦有研究支持。
1966年,心理學家 Philip S. Holzman 同 Clyde Rousey 喺《人格與社會心理學期刊》(Journal of Personality and Social Psychology)發表〈The Voice as a Percept〉,研究人聽到自己聲音重播時有咩反應[3]。佢哋描述嘅反應,而家一般叫做「聲音對質」:即係聽到自己錄音聲而覺得唔舒服。通常嘅解釋係,你以為其他人聽到嘅你把聲係某個樣,但重播時實際聽到嘅又係另一回事,當中嘅落差令人失望[3]。
Holzman 同 Rousey 認為,呢種不適唔止關乎聲音本身。部分原因係佢哋所講嘅「非語言線索」(extra-linguistic cues):錄音會揭示你平時唔會察覺嘅特質,例如緊張、猶豫、傷感或不耐煩[3]。錄音揭露咗你嘅一面,而你講緊嘢嗰刻,自己從來聽唔到呢一面。你以為會聽到自己講咗乜,點知連自己講嘢時有幾緊張、幾冇精打采都聽到。
呢種驚訝背後,仲有個辨認問題。你甚少將自己把聲當成獨立於講嘢之外嘅聲音去聽,所以心目中嘅印象會慢慢偏離現實。1967年,同一批研究人員做嘅後續研究發現,只有 38% 參加者可以喺五秒內認出自己把聲嘅錄音[4]。如果你個腦第一次聽都幾乎認唔出係自己把聲,之後突然醒起嗰下會皺眉,就完全講得通。
Birchall 簡單講出背後嘅陷阱:多年只聽骨傳導版本,令你對自己把聲嘅認知校準咗喺一個其他人永遠收唔到嘅訊號上,所以錄音一出現,就同時覺得陌生又失望[1]。同一篇報道亦提到,對於有身體或性別不安(dysphoria)嘅人,呢種落差可以係真實而持續嘅困擾;一把同自我認同唔吻合嘅錄音聲,遠唔止一時尷尬咁簡單[1]。
如果聽返自己啲語音訊息已經令你想直接跳過,你絕對唔係得一個。我哋之前都探討過點解聽返語音訊息呢種辛苦,會令有啲人一見到播放掣就驚:呢種反應相關但唔同,同樣源於呢份不適。
反轉位:你可能冇自己諗得咁憎自己把聲
不過,成件事仲有個轉折:有部分不適,可能同聲音本身完全無關。
2013年,Susan M. Hughes 同 Marissa A. Harrison 喺《感知》(Perception)期刊發表一項研究。佢哋播一組錄音畀參加者聽,請佢哋評吸引力,但冇講當中悄悄放咗每個人自己嘅錄音聲。參加者對自己把聲嘅評分,比其他聆聽者畀嘅高,亦都比佢哋自己對其他人把聲嘅評分高[5]。
當人唔知道自己聽緊自己把聲,其實幾鍾意聽到嘅聲。呢個結果帶出一點:部分不適根本唔關聲學事,而係你一認出把聲係自己嗰刻,突然湧上嚟嘅自我意識。攞走呢種辨認,同一段錄音就唔再似一種威脅。
呢件事對你嘅語音訊息有咩實際意義
呢一切喺日常生活入面,最常撞到嘅就係語音訊息。根據 WhatsApp 自己公布嘅數字(我哋喺語音訊息統計數據總覽有整理),人哋每日發送嘅語音訊息以十億條計。錄一條語音訊息,即係刻意製造一個只經空氣傳導嘅你;播返出嚟聽,就係每次撳播放掣都要正面面對呢個版本。
物理保證咗,錄音聽落一定比你預期高同薄;心理亦都保證咗,對相當一部分人嚟講,聽返自己把聲會觸發同 Holzman 同 Rousey 六十年前描述嘅反應近似嘅退縮感。
有兩件事值得記住。第一,錄音先係準確嘅版本,亦係你朋友一直聽開嘅聲;佢哋從來唔覺得奇怪,因為根本冇機會聽過你暗自懷念嘅骨傳導版本。第二,好大部分不適其實來自自我意識,而唔係聲音本身,2013年嘅吸引力研究直接支持呢一點[5]。
如果每次聽返自己把聲都令你皺眉,有個唔費力嘅做法:睇文字,唔使再聽一次。完全跳過音訊,仲可以順便幫到收訊人,因為冇文字紀錄嘅語音,真係會令對方喺又長又嘈嘅內容度,跟唔到你想講咩。呢個正正係 Transcribbit 想填補嘅缺口:將語音訊息轉做清晰文字,等你唔使坐低再聽一次,都可以核實自己講咗啲咩。立即免費開始使用,下次 send 語音訊息時,文字同語音一齊 send。
常見問題
點解我把錄音聲聽落會高音啲、同我預期唔同?
因為錄音只收到你把聲經空氣傳導嗰部分。你講嘢時,仲會透過骨傳導聽到自己把聲;骨傳導會傳送低頻,令你聽自己把聲時,比任何其他人聽到嘅更飽滿、更低沉。麥克風正正會濾走呢啲低音,所以播返出嚟就比你習慣嘅更薄、更高[2]。
錄音同我自己嘅感覺,邊個先準確?
錄音先係準確嘅。佢完全對應其他人聽你講嘢時收到嘅聲,因為佢哋只收到空氣傳導嘅訊號。你個腦入面嗰把聲較飽滿,係一個其他人從來接觸唔到嘅版本:骨傳導帶來嘅低音,永遠都唔會離開你嘅頭骨[1][2]。
「聲音對質」實際係咩嚟㗎?
呢個係 Philip Holzman 同 Clyde Rousey 喺1966年一份研究入面提出嘅術語,形容聽到自己錄音聲時嗰種不適。部分來自期望同現實之間嘅落差,部分來自佢哋所講嘅「非語言線索」:即係錄音會揭示、但你講嘢時通常留意唔到嘅特質,例如緊張或猶豫[3]。
係咪個個都憎自己把錄音聲?
冇大家想像中咁嚴重。Hughes 同 Harrison 喺2013年嘅研究發現,如果唔話畀人知一組錄音入面有自己把聲,佢哋反而會畀自己把聲更高分,甚至高過其他聆聽者畀嘅分。好多不適睇嚟都來自「認出把聲係自己」,而唔係聲音本身[5]。
係咪真係認唔出自己把錄音聲?
唔係好可靠,亦都唔快。Rousey 同 Holzman 喺1967年嘅研究發現,只有 38% 參加者可以喺五秒內認出自己把聲嘅錄音[4]。大部分人講嘢嘅時間遠多過聽返自己把聲,所以你腦入面對自己把聲嘅印象,其實建基喺唔完整嘅樣本上。
呢件事會唔會影響人哋send語音訊息嗰種感受?
會。你錄語音訊息而唔係打電話嗰刻,同一套物理同心理已經適用;播返出嚟聽,就係隨時要面對只經空氣傳導嗰個版本。呢個正係點解有啲人寧願睇文字紀錄,都唔想再聽一次語音,而呢個缺口正正係 Transcribbit 想填補嘅。
總結
點解你咁憎自己錄低嘅聲音,分開兩個原因嚟睇就唔再係謎。骨傳導確實會改變你講嘢時聽到嘅聲,所以錄音永遠比你個腦入面嗰把更薄、更高;呢個純粹係身體結構。另一邊,「聲音對質」係一種有充分研究記錄嘅不適:你突然意識到錄音入面嗰把聲原來就係自己。呢個名喺1966年首次提出,之後嘅研究亦一直支持呢個說法。
最值得記住嘅係2013年嘅發現:一旦人唔知道把聲係自己嘅,對自己把聲嘅評分反而更正面[5]。錄音從來唔係問題,問題係「認出係自己」嗰一刻。知道呢點未必會即刻令你唔再皺眉,但至少你唔使再以為錄音呃緊你。呢個係其他人一直聽開嘅唯一版本,而佢哋從來冇覺得有問題。
參考資料
- Why Do I Hate the Sound of My Own Voice? (Time, 2017) - time.com
- Bone conduction (Wikipedia) - en.wikipedia.org
- Voice confrontation (Wikipedia, citing Holzman & Rousey, 1966, Journal of Personality and Social Psychology) - en.wikipedia.org
- Recognition of one's own voice, Rousey & Holzman, 1967, Journal of Personality and Social Psychology, 6(4), 464-466 - pubmed.ncbi.nlm.nih.gov
- I Like My Voice Better: Self-Enhancement Bias in Perceptions of Voice Attractiveness, Hughes & Harrison, 2013, Perception - journals.sagepub.com
相關文章

Transcribbit vs Rev:語音訊息定專業人手?
Rev 是專業轉錄機構:每分鐘$1.99,換到準確度99%以上、可呈堂的人手文字稿,於2026年8月8日核實。這不是一則 WhatsApp 語音訊息需要的東西。以下是老實的拆解,每個 Rev 數字都標明日期,並直接引用 Rev 自己的頁面。

用語音訊息學語言:實用指南
課本錄音係喺錄音室慢慢錄、字正腔圓嘅。用語音訊息學語言就啱啱相反:真人講嘢、真實口音、真實速度。呢篇話你知點用嚟訓練耳仔,同轉錄幾時可以將一段你聽得一知半解嘅語音訊息,變成一次學習。