如果那個聲音可以被複製,你還願意相信它嗎?
聲音冒險 Week 14|AI時代的聲音:誰在說話?
這是這學期的最後一篇部落格文章。我想從一個真實的場景開始。
2023年,美國一對老夫婦接到一通電話。電話那頭是他們孫子的聲音,驚慌失措,說他出了車禍,在警察局,需要馬上轉一筆保釋金,但不能讓父母知道。他們的心一緊,立刻去銀行轉了錢。
那個聲音,是AI複製的。孫子在家好好的,什麼事都沒有。
第1週的命題,到了它最危險的邊緣
第1週,我問了一個問題:為什麼你願意相信一個看不見的人?
廣播的信任邏輯是這樣的:你看不見那個人的臉,但你選擇相信他的聲音。因為聲音是「即時的」、「個人的」——你的媽媽的聲音,你閉著眼睛也認得出來。那個聲音,是一個獨一無二的識別符。
現在那個識別符,可以被複製了。
AI語音合成技術,提供三到五分鐘的聲音樣本,就可以生成一個「聽起來完全像那個人」的語音。語調、停頓習慣、輕微的口音、呼吸節奏——都能模擬。那對老夫婦,他們不是因為太老、太天真才被騙。他們被騙,是因為「孫子的聲音」這個識別符,本來應該是騙不了的。
廣播信任的武器,變成了攻擊的工具
廣播花了一百年建立一件事:聲音是可以被信任的。你相信那個聲音後面有一個真實的人、有真實的意圖。這是廣播的基礎,也是廣播的魔力。
AI聲音詐騙利用的,正是這個一百年來建立的信任直覺。「媽,是我」——用孩子的聲音說出來,是世界上最難拒絕的句子。詐騙集團知道這件事,所以他們用AI複製了那個聲音。
這不只是技術問題,這是一個媒介哲學問題:當聲音可以被偽造,我們在廣播中建立的「聲音即真實」的直覺,變成了我們最大的弱點。
AI廣播主播:你願意讓AI陪你嗎?
另一個方向的問題,是AI廣播主播。
目前已有媒體使用AI主播播報新聞。聽起來很自然,語調流暢,不再有機械感。聽眾多半不知道,或不在意。
我覺得這件事值得分成兩種節目類型來討論。
廣播新聞:可信度來自「訊息是否正確」。你信任的是那則新聞的內容,不是那個聲音背後有沒有一個人在關心你。如果AI主播念出的新聞是正確的,你可能還好。
陪伴型廣播:深夜電台,療癒型Podcast,那種讓你在黑暗中感覺「有人陪著」的聲音——如果你知道後面是AI,那個陪伴感還在嗎?
我做了二十五年電視,我覺得廣播的「陪伴感」,根本上來自「你相信後面有一個人在說話、那個人有自己的生命和感受」。AI可以完美模擬那個聲音,但你知道後面沒有人——那個「相信有人陪著我」的感覺,是否還成立?
聲音的靈魂是什麼?
這是這學期我最想讓你思考的問題:什麼是聲音的「靈魂」?真人聲音有、AI聲音沒有的,是什麼?
有人說是「不確定性」——真人說話時有一點點猶豫、有時說錯話、有情緒起伏,那些微小的不完美,是生命存在的痕跡。AI被訓練成完美,但完美本身就是一種違和感。
有人說是「歷史」——你媽媽的聲音之所以讓你安心,不只是因為那個音頻,而是因為那個音頻和你過去幾十年的記憶連結在一起。AI複製了聲音,但沒有複製那段歷史。
有人說是「責任」——真人說話,那個人對他說的話負責。AI說的話,誰負責?
我沒有一個標準答案。但我認為,當我們問「聲音的靈魂是什麼」,我們其實是在問:廣播媒介和聽眾之間的信任,究竟建立在什麼上面?
圓滿的一個圓
第1週,我說:廣播研究的是「相信一個看不見的聲音」這件事。
第14週,我們發現:那個「看不見的聲音」,可能根本沒有「那個人」。
這個學期走了一個完整的圓。從廣播的起點(信任一個看不見的聲音),走過聲音的敘事力量、廣播的社會角色、聲音的技術演變,走到Podcast對廣播定義的挑戰,最後到達AI對廣播信任基礎的根本動搖。
我希望你帶走的不是一個答案,而是一個習慣:每次你打開耳機、聽一個聲音時,你會多想一秒:「這個聲音,我為什麼願意相信它?那個前提,還成立嗎?」
廣播沒有消失,它只是換了名字,也換了問題。而你,現在有能力問這些問題了。