2026年9月24日
撰寫扣人心弦的audio drama:12條「為耳朵而寫」的創作法則
開場鉤子、對白、旁白、音效、靜默、音樂與懸念結尾:讓聽眾一路聽到最後的audio fiction具體寫作法則,無論是否使用AI。

Frank HoubreImaginode 創辦人
為耳朵而寫,不是為眼睛而寫
聽眾無法回頭重讀,也看不到畫面:他們需要理解的一切,都必須透過聲音、音效或靜默傳達,一旦聽不懂,馬上就會失去興趣。
小說可以用整整一頁描寫一張臉;電影劇本可以讓畫面說話。而audio fiction兩者都沒有,它只有聲音、音效、音樂和時間。以下規則來自廣播、來自主導各大音頻小說App的連載式audio drama,也來自我們在Drama Studio中讓AI撰寫並製作劇集所累積的經驗。
無論您是親自動筆,還是借助AI創作,這些法則都適用。若是後者,它們甚至更加重要:語言模型若放任不管,寫出來的內容會偏向「給人閱讀」,而讓文字「為耳朵而寫」的責任,就落在您身上。
1. 一切都必須「聽得見」
任何一則資訊,只要沒有被說出來或聽到,對聽眾來說就等於不存在。
角色拔出武器、另一位臉色發白、桌上放著一封信:對耳朵來說,這些事情通通不會發生,除非有人說出來,或有聲音將其呈現出來。「放下。把那把刀放下。」這句台詞,遠勝過任何麥克風永遠錄不到的舞台指示。
請閉上眼睛重讀您的劇本,或者更好的做法是,聽聽它被演繹出來的樣子:每當您需要靠想像一個動作才能理解場景時,就代表少了一句台詞或一個聲音。
2. 在最初的20秒內抓住聽眾
開頭幾秒鐘決定一切:要呈現的是異常的情境、一個疑問或一個危機,而不是場景描述。
在《Le Train de Minuit》的試播集中,查票員在第一分鐘結束前,就發現了一張標註1987年的車票。若開場是對車站的描述,恐怕半數聽眾早已流失。請從動作進行到一半開始,再讓背景資訊以片段方式慢慢揭露。
這也是Studio的AI劇本評論人首先檢視的評分項目:開場鉤子。若分數低於10分中的7分,請先重寫開場,再處理其他部分。
3. 讓角色互相稱呼姓名
耳朵能辨認的是聲音,而不是名字:角色之間必須互相直呼其名,尤其是在故事一開始。
「Claire,妳看時間了嗎?」這句台詞在一句話裡就介紹了兩個角色:說話的人和被說話的人。在最初的幾場戲中,直呼姓名的頻率應高於文字作品的慣例,等到聽眾熟悉聲音之後,再逐漸減少。
同時也要避免使用讀音相近的名字。像Léa和Léo、Marc和Max,用聽的比用看的更容易混淆。
4. 一個角色,一種說話方式
每個角色都應該不只靠音色,還要靠用字遣詞讓人一聽就認出來:節奏、語域、口頭禪都不可少。
一位總用簡短犀利問句說話的督察、一位每句話都要以一句諺語作結的祖母、一位習慣打斷所有人說話的青少年:這些「聲音特徵」讓聽眾能毫不費力地跟上三人同場的戲。請將這些特徵寫進每個角色的角色卡中,Studio的Bible代理程式在建立每個角色時正是這樣做的。
至於聲音本身,同場出現的角色請選擇差異明顯的音色:不同性別、不同年齡,低沉與高亢交錯。兩個過於相近的聲音,會讓對話聽起來像是一段令人困惑的獨白。
5. 簡短且相互回應的台詞
每句台詞只表達一個想法,句子彼此打斷,並伴隨即時反應:這正是營造出「真實場景感」的關鍵。
在文字作品中,一整段對白讀起來沒問題;但用聽的,超過兩句話,聽眾就會搞不清楚是誰在說話。請把台詞切碎,讓另一位角色即時反應,張力升高時甚至可以讓句子不說完。
至於整體長度,請記住一個參考值:語速平穩的敘事聲音,每秒約說14個字元。因此一集3分鐘的節目,台詞總長約落在2,500個字元左右,大約是六十句左右的短台詞。這正是Studio交給AI劇作家的量化指標,因為劇本篇幅不足,是最常見的錯誤。
6. 旁白要用得節制
旁白的功能是推進時間、轉換場景;若他開始評論角色的情緒,這部作品就會變成一本有聲書。
「午夜十二點十五分。Gare de Lyon車站。開往Nice的末班車正停在第三月台等候。」短短三句話,聽眾就知道自己身在何時何地。這就是旁白該做的全部工作。一旦旁白開始解釋角色的感受,他就等於從演員手中偷走了這場戲。
在一集3分鐘的節目中,五、六次旁白台詞就已足夠。超過這個數量,請自問:換成一句對白或一段氛圍音效,是否能達到同樣的效果?
7. 讓氛圍音效說出地點
一段精心挑選的氛圍音效,可以取代一整段場景描述:短短幾秒鐘夜晚月台的聲音,勝過一整段文字描述。
您系列作品中的每一個場景,都值得擁有一段持續播放的氛圍音效:月台上的雨聲、咖啡館裡的低語聲、森林中的風聲、火車運行的低鳴聲。這段音效會在整場戲中於背景持續播放,而它的變化,就足以提示聽眾場景已經轉換。
撰寫氛圍描述時,請寫成具體聲音來源的清單,而不是抽象的氣氛描述:例如「月台上的細雨聲、遠處的廣播聲、一列緩緩行駛的火車」,而不是籠統地寫「令人不安的氛圍」。這種寫法,也正是音效生成工具能夠理解的形式。
8. 音效必須推動劇情
音效不是裝飾品:它必須讓聽眾獲得某種資訊,否則只會讓人感到疲乏。
嫌疑犯逃跑瞬間傳來的關門聲、坦白過程中震動的手機、遞出的一張票券:這些聲音都在推動場景前進。而走廊裡連續三次的腳步聲,只會拖慢節奏。
在我們的測試中,一位不受限制的AI劇作家,在短短兩分鐘內放入了十一個音效。我們現在將上限訂在大約每四十秒一個音效,劇集的整體聆聽體驗也因此明顯改善。
9. 靜默是一種創作工具
在真相揭曉前的一秒鐘靜默,勝過所有戲劇性配樂的效果。
在廣播中,靜默本身就是一個事件:它會讓聽眾靠近細聽。請在重要答案揭曉前、真相揭露之後,或角色猶豫不決時,安插一小段停頓。一到兩秒的長度就已足夠,每一集安排兩到三次即可。
反過來說也一樣:兩句緊接錄製的台詞之間,若出現非刻意的靜默,反而會破壞整場戲。這正是為什麼,同一場戲的所有台詞最好一起演出錄製,而不是逐句分開錄製。
10. 音樂用來框架,而非填滿
開場要有令人一聽就認出的主題曲,結尾要有短促有力的一擊,而在對白進行時,音樂則要退居幕後。
音樂主題曲是整個系列的招牌:聽眾應該能在每一集的開頭幾個音符中就認出它。請只譜寫一次,以純演奏版本製作,並在各處重複使用。
在對白進行的場景中,音樂音量應明顯降低於人聲之下,或乾脆停止。結尾處只需幾秒鐘富有戲劇張力的一擊,就足以強調這一集的結局。音樂用得越多,不但無法增加張力,反而會削弱它。
11. 每一集都要以懸念收尾
最後一句台詞,必須讓下一集變得非聽不可:一個真相揭露、一個危機,或一個懸而未決的抉擇。
「我明天一定要找到那張票」是一個平淡無力的結尾;「這張票……上面寫的是我的名字」才是真正的結尾。整個連載式audio drama的形式,完全建立在這個機制之上:聽眾之所以會回來,是因為他們無法忍受懸念懸而不決。
請先寫好結局,再回頭補完這一集其他的內容。劇本評論人給的「結尾」分數,是每一集都必須緊盯的指標。
12. 維持前後一致性
角色不可能知道自己還沒有得知的事情:在一整季的規模下,這是聽眾最無法原諒的錯誤。
請逐集建立記錄:發生了什麼事、每個角色學到了什麼、哪些劇情線已經展開或已經收尾。這正是Drama Studio在每一集劇本寫完後所記錄的記憶,並在撰寫下一集之前,重新交給作者參考。
這12條法則測試起來很快:寫出一集試播,讓它被演繹出來,然後一口氣聽完。我們的AI創作audio series完整指南詳細說明了從故事聖經到混音成品的完整製作流程,並附上一集節目的實際成本。