top of page

【藝文人士的AI課】037---《CYBER HER》:從雙 CD、虛擬角色到真實舞台的製作實錄

Jimmy lane
16小时前
讀畢需時 20 分鐘

2026 年 9 月 16 日,《CYBER HER》終於在桃園廣藝廳正式演出。


那一天我坐在台下,看著 Lucifer Girl 與 Eva Girl 化為巨型舞台影像;真人表演者則在影像之前唱歌、走位與舞蹈。虛擬角色與真實身體同時佔據舞台,那一刻的感覺其實很奇妙。


幾個月以前,這兩個女孩還只是硬碟裡的一堆圖片、歌曲、音軌與零碎影像。再更早以前,她們甚至還沒有名字。


《CYBER HER》最後呈現在觀眾眼前的,是一段不到十分鐘的舞台作品;但把時間往前拉,它背後其實是一條很長的路:從 2024 年開始練習生成影像、反覆建立人物,到 2026 年完成雙 CD 概念專輯,再從專輯發展成動態影像,最後又為了真人演出,把音樂、畫面與舞台節奏重新拆開、重新組合。


所以這一次真正讓我感興趣的,已經不只是「AI 可以做到什麼」。


當 AI 做出來的東西真的離開電腦,進入一個有真人、有舞台、有時間限制,而且不能按下 Undo 的現場時,作品會發生什麼變化?


一、Lucifer Girl 其實比《CYBER HER》更早出現


回頭整理《生成式 AI 群英傳》過去的封面,我才發現 Lucifer Girl 並不是為了這一次舞台作品才突然被設計出來。

2024 年開始大量練習 AI 繪圖時,我的瀏覽器裡也逐漸累積了一整排生成工具書籤。從 Stable Diffusion 生態系、ComfyUI、TensorArt、Civitai、CogniWerk,到後來接觸的 FLUX 系列模型,我幾乎是一邊試工具,一邊尋找自己真正喜歡的視覺語言。


現在重新整理當年的書籤與作品,我反而比較能看清楚 Lucifer Girl 最早的形成路線。


其中,CogniWerk 與 FLUX 系列模型,是我製作早期白髮 CyberGirl 原型時的重要工具之一。在 Cyberpunk 人物生圖上,我也經常搭配自己慣用的 LoRA 模組「cyborg bone framework - 1.0」,協助建立人物的機械骨架、機械結構與整體質感。


《生成式 AI 群英傳》大約第 5 期到第 9 期之間,白髮、女性機械身體、冷色科技光、耳機與耳掛等元素,已經開始反覆出現在畫面裡。


那時候她還沒有 Lucifer Girl 這個名字,《CYBER HER》也還不存在,但後來角色最重要的視覺基因,其實已經開始成形。


中間我又陸續嘗試歷史、藝術、音樂、人物等完全不同的題材。白髮 CyberGirl 並不是每一期都出現,但經過幾十期封面的反覆生成、修改與選擇之後,這位白髮女孩又逐漸回到畫面,而且開始出現一個與她相對的黑髮角色。


至於後來的 Eva Girl,她的誕生,就和我自己的生活點滴有更多關係了。


現在回頭看,那其實就是 Lucifer Girl 與 Eva Girl 的前史。她們先在一次又一次生成實驗裡,慢慢長出了自己的臉、髮色、機械結構與氣質;到了後來,我才替她們加上名字、個性、音樂與世界觀。


生成式 AI 可以給你無數張圖片,但「角色」不是一次生成出來的,角色是被時間養出來的。


二、《CYBER HER》一開始其實不是舞台劇


2026 年年初真正開始製作《CYBER HER》時,我原本想做的,其實是一套 2CD 概念專輯。


這和我長年做 DJ 的聆聽經驗有很大的關係。


從 1990 年代到 2000 年代初,我一直在唱片市場裡打滾。白天賣唱片、寫樂評,晚上到夜店放歌,也因此比一般聽眾更早、更密集地接觸英、美與歐洲不同地區的舞曲第一手資訊。


我一直很喜歡英國與歐洲的 DJ Mix CD 文化,包括 Cream、Global Underground,以及 Paul van Dyk 那個年代大量出現的 Mix、Remix、Maxi Single 與 DJ Set。


那個年代很早就讓我知道一件事:專輯不一定只是第一首、第二首、第三首歌曲的集合。一張唱片本身,也可以是一段完整旅程。

同一首歌,也未必只有一個版本。在黑膠單曲、CD Single 與 Maxi Single 盛行的年代,一首作品可能同時存在 Radio Edit、Club Mix、Extended Mix,甚至速度、節拍與編曲完全不同的版本。


我一直記得自己曾經從 Paul van Dyk 的唱片裡得到一個很深的印象:同一批聲音素材,可以反覆拆解、重新組合,再變成另一種聆聽方式。


究竟是不是〈For an Angel〉的哪一個發行版本,我現在已經記不起來了,所以也不想只靠幾十年前的記憶把它寫死。

但這種把聲音拆開、重組,再重新串接的想法,後來確實成為我設計《CYBER HER》CD2 時的重要參考。


另一種影響,則來自我早年聽 Hip-Hop 專輯的經驗。


De La Soul 的《3 Feet High and Rising》利用短劇與插話,把整張專輯串在一個帶有遊戲節目感的世界裡;2 Live Crew 的《Banned in the U.S.A.》則在曲目之間穿插多段「News Flash」。


這些作品讓我很早就意識到,歌曲之間不一定只能靠節拍相接。對話、環境聲、效果聲,甚至一小段完全不同性質的聲響,都可以成為把整張專輯連起來的方法。


到了《CYBER HER》,我沒有照搬「新聞快報」的形式。因為這是一個從宇宙、機械到城市的世界,突然出現一段電台 News Flash 反而會破壞它的氣氛。所以我選擇的是:用聲音接聲音。


上一首留下的殘響、Synth、低頻、機械聲或環境聲,可以成為下一首的入口。


而且 CD2 我刻意沒有把歌曲順序打亂。


因為 Lucifer Girl 與 Eva Girl 的歌詞本身就有時間順序。她在什麼時候醒來、什麼時候移動、什麼時候進入城市、什麼時候下班、什麼時候走進夜店、最後又在什麼時候遇見另一個人,都已經是故事的一部分。


如果為了 DJ Mix 的效果把曲序重新洗牌,音樂也許會更好接,但故事會亂掉。


所以 CD1 是每一首歌各自完整存在的 Original Album;CD2 則按照原來的故事順序,把它們重新連成 Continuous DJ Mix。


CD1,把世界拆開。


CD2,把世界重新接回來。


三、從 Pink Floyd、〈Avalon〉到 Maxi Single:那些比 AI 更早的聲音記憶


《CYBER HER》的音樂並不是到了 2026 年開始使用生成式 AI 之後,才突然形成。


很多聲音上的想法,其實早就在我幾十年的聆聽經驗裡慢慢累積。


像 Pink Floyd《The Dark Side of the Moon》這類整體性很強的概念專輯,給我的影響並不是某一首歌的旋律或編曲,而是讓我很早就知道:一張專輯不一定只是十幾首彼此獨立的歌,也可以透過環境聲、轉場、段落與情緒變化,形成從頭到尾連續的一段旅程。


但如果要追尋 Eva Girl 全部曲目的節拍、鼓組與 Bass 語感,我會想到另外幾個一直留在耳朵裡的聲音來源。

第一個是 Roxy Music 1982 年的〈Avalon〉。


原版本來就有一種柔軟、流動、帶著空氣感的氣質;後來我聽到 M People 在 1997 年《Fresco》裡重新演繹〈Avalon〉,很明確地感受到:同一首歌的旋律與氣質可以保留,但鼓組與 Bass 的語言可以被重新改寫。


我喜歡的並不是那種非常猛烈、一路往前衝的 Drum & Bass,而是比較輕、比較鬆,甚至帶著一點優雅感的節拍。


鼓不需要很重,Bass 也不必一直站在最前面。它可以藏在中低頻裡,輕輕推著歌曲往前走。


這種感覺後來成為 Eva Girl 不少歌曲在鼓與 Bass 編排上的重要參考。


另一個很深的聲音記憶來自 Pet Shop Boys。


我一直記得,他們曾有一首歌的單曲版本,在我的聽感裡帶著某種 Acid Jazz、輕碎拍,甚至近似 Drum & Bass 的語彙。它給我的感覺,和 M People 版〈Avalon〉在節奏上的處理有某種相似性。


但到底是哪一首歌、哪一個單曲版本,我現在真的已經記不起來了。


所以這裡我寧可留下這份聲音記憶,也不想硬補上一個可能錯誤的歌名。


我只記得第一次聽見時很驚訝:原來 Neil Tennant 的聲音,放進這種碎拍與 Bass 的編制裡,也可以這麼自然。


它和 M People 的〈Avalon〉帶給我的感受其實很相似— 同一副聲音、同一首歌曲,只要換掉節拍、鼓組、Bass 與整體編曲,就可以重新長出另一副身體。


所以後來製作 Eva Girl 的音樂時,我不是先去問 AI:「現在流行什麼節拍?」


在真正開始生成音樂以前,那個節奏的靈魂其實早就存在我的耳朵裡。


我知道鼓應該多重,Bass 應該放在哪個位置;什麼地方應該讓節奏進來,什麼地方又應該退下去。甚至同一首歌,也未必要永遠只有一種版本。


對我來說,音樂本來就是可以拆開,再重新接回去的。


一段鼓可以換掉,Bass 可以重新安排,人聲可以移動位置;原本分屬不同版本的素材,也可以透過剪接、重混與聲音拼貼,重新組成另一個完整的敘事。


這些方法並不是生成式 AI 發明的。


三十年前賣 CD Single、Maxi Single 時,那些日復一日的聆賞工作,聽著一首歌如何被做成 Remix、Alternative Mix、Extended Mix,其實早就在訓練我的耳朵,也在告訴我:同一首作品,本來就可以有很多種不同的生命。


工具是新的,耳朵裡累積的東西,卻已經有幾十年了。


四、AI 是另一件樂器:從 Loop、舊詞到今天的生成式音樂


使用生成式音樂工具之後,我愈來愈清楚一件事:對我而言,AI 並不是替我決定音樂應該怎麼寫。它比較像是手上又多了一件樂器,也多了一個可以快速試驗想法的製作環境。


從 ACID Pro 的 Loop 到今天的生成式音樂


其實,我用電腦協助自己做音樂,也不是從生成式 AI 才開始。


再往前推大約十七年,除了自己彈鋼琴、把想到的旋律錄下來之外,我第一次真正用電腦完成電子音樂,也是在 PC 音樂軟體已經大量普及的年代。


當時 FruityLoops、Cubase 等軟體都很常見,而我自己實際接觸、使用比較多的,則是 Music Maker 與 ACID Pro 4.0。


尤其 ACID Pro 4.0,讓我第一次很直接地接觸到以 Loop 為核心的製作方法:一小段鼓、一段 Bass、一段 Synth 或其他聲音素材,放進時間軸裡反覆排列、剪接與組合,再透過段落、層次與進出位置,慢慢把幾小節的聲音組成一首完整的電子音樂。

我早期真正用這種方式完成的一首電子音樂作品叫〈The One〉。


目前留下來的版本長約 7 分 56 秒,是我當時用 Loop 與舞曲編排邏輯一路堆疊出來的作品。相關記錄與歌檔我一直留到今天。這麼多年來,我也一直想把它重新剪成兩、三分鐘的 Radio Cut,只是始終沒有真正抽出時間。


當然,Music Maker 與 ACID 並不是今天意義上的生成式 AI。它們不會自己替你寫出一首歌。


但對我自己的創作歷程來說,那卻是一個很重要的起點:我第一次體會到,做音樂不一定只能從頭到尾把每一個音符彈出來,也可以把聲音拆成積木,再重新排列、組合與延伸。


二十多年來,工具一直變。從鋼琴與旋律記錄、Loop-based 軟體、DJ Remix 與 DAW,一路走到今天的生成式音樂,我自己的核心邏輯其實沒有完全改變:


工具可以把可能性展開,但最後要走哪一條路,仍然要由人決定。


今天使用 Suno AI 或其他音樂生成工具,任何人都可以從幾句文字或一段歌詞,很快得到一首形式完整的歌曲。


但「可以生成一首歌」,和「知道自己到底要什麼」,還是兩件不同的事情。


我自己會一些鋼琴,也有過去寫詞與商業作品的經驗。當然,我不是科班出身、可以坐在鋼琴前或拿起吉他,就從頭到尾完成整首作品的專業作曲家;但多年做 DJ、曾經進入音樂製作團隊受邀寫詞,十多年前又有與音樂時代劇場合作的機緣,再加上這些年接觸編曲、混音與大量聆聽,至少讓我知道自己要什麼,也知道什麼東西不對。


這種差別在生成式音樂裡其實非常明顯。


舊詞新生:〈無翼者 The Wingless〉


如果一份歌詞本身已經具有成熟的句法、韻律、情緒推進與歌曲結構,創作者往往可以從文字本身,判斷它適合什麼樣的速度、節拍、鼓組、Bass 與編曲方向。


我自己最直接的一個例子,就是接下來準備發行的單曲〈無翼者 The Wingless〉。


這首中文歌詞其實是二十多年前,我在音樂製作公司接觸一首韓國 Demo 時寫下來的。當時最後沒有被採用,但我一直把它留下來,因為我始終認為那是一份已經相當完整的歌詞。


很多年以後,我重新把這份舊詞交給 Suno AI。


但我不是把歌詞丟進去,讓它自己決定應該長成什麼樣子。


我看著那份詞,就知道它帶著一點搖滾氣質,也大概知道自己要什麼樣的速度、情緒與整體張力,所以音樂方向也是依照歌詞本身的音樂性去設計。


第一次生成出來時,完成度就已經很接近我認為可以繼續往商業製作方向發展的版本。


而〈無翼者 The Wingless〉並不是唯一的例子。


這一兩年,我沒有刻意大量寫新的歌詞,反而重新翻出二十多年前留下來的作詞稿、詞集與詩作,一首一首重新試做。


其中已經有幾首,是我自己願意繼續往製作、發行方向推進,也認為具有商業潛力的作品。


這些文字不是為 AI 寫的。


它們早在生成式 AI 出現以前就已經存在。


以前缺的,可能是合適的作曲者、編曲者、製作條件,或者根本沒有時間把它們一首一首完成。


現在多了一套新的工具,讓這些原本停在紙上的作品,有機會重新被聽見。


從哼唱開始:當旋律重新回到人的手上


而我更看好的是另一條路:


不要每一次都叫 AI 從零替你想。


有時候,人走路、開車、洗澡時,腦中突然冒出幾個音符,順口哼了一小段旋律,甚至只是沒有任何歌詞意義的「啦啦啦」。

以前如果不熟悉樂器、錄音或編曲,這些旋律很可能哼完就消失了。


現在可以先把它錄下來,再把自己的旋律或聲音素材交給支援音訊輸入的生成工具延伸。


如果本來就會一點鋼琴、吉他,甚至手上有 MIDI 鍵盤或電鋼琴,這種方法的發展空間更大。


對剛開始創作的人,它可以縮短從一個旋律念頭到 Demo 的距離;對有經驗的創作者,可以快速試驗不同的節奏、和聲與配器;對職業作曲家、編曲者或樂手,它也可以只是很快提供幾個不同方向,讓人先比較,再決定真正值得深入製作的是哪一條路。

所以我不認為生成式音樂只對「不懂音樂的人」有用。


從初學者、半業餘創作者,到專業音樂工作者,都可能找到自己的使用方式。


差別只在於,你帶進工具裡的是什麼。


過去一兩年,我和一些業界音樂工作者討論 AI 時,也聽過完全不同的態度。有人很早就開始使用,有人保留,有人仍然排斥。

這都很正常。


每一次新的音樂工具出現,都會重新碰到「什麼才算創作」這種爭論,我沒有必要替別人決定答案。


AI 可以降低製作門檻,卻不會自動消除創作者之間的差異。


當大家都能取得類似工具時,真正拉開距離的,反而會變成你帶進工具裡的經驗、審美、音樂記憶,以及你有沒有能力判斷什麼值得留下。


想法由我提出,方向由我決定,AI 幫我把可能性展開;最後留下什麼,仍然由我的耳朵決定。


AI 不是站在前面牽著創作者走。


它只是讓我手上,又多了一件可以把想像真正做出來的樂器。


五、Lucifer Girl 與 Eva Girl,以及多重莫比烏斯環


當 Lucifer Girl 與 Eva Girl 的世界逐漸完整,我開始用「莫比烏斯環」來理解整套《CYBER HER》的結構。


這並不是單純為了找一個漂亮的 ∞ 符號,而是因為從角色、色彩、時間、音樂,到人與機械的關係,作品裡一直存在著彼此翻轉、交換,又重新接回原點的循環。


Lucifer Girl 是冷藍色、機械、宇宙與未來;Eva Girl 則是粉紅、城市、人類情緒與身體。


一個像機械慢慢理解人性,一個像人類逐漸學會與機械共振。


兩個角色是一層循環;藍色與粉紅是一層循環;Lucifer Girl 與 Eva Girl 各自約十二小時的時間線,合起來又是一個完整的一天;CD1 與 CD2 又是另一層。


而最後一首〈Dawn of Cypher〉也不是一個真正的句點。


它在概念上重新把聽者送回第一首〈Solar Flare〉。


故事結束的地方,同時也是下一次開始的地方。


人逐漸機械化,機械逐漸人性化。


我不想把人與 AI 寫成只能互相對抗的兩個世界。


它們也可能交換、影響、滲透,最後找到另一種共存的方法。


到了舞台版本,我把這個抽象概念轉化成觀眾可以直接看見的「信物交換」。


Eva 將白色短外套交給 Lucifer;Lucifer 則把藍色發光項圈交給 Eva。


交換之後,Eva 身上多了來自 Lucifer 的藍光;Lucifer 則穿上象徵人類溫度的白色外套。


所以她們交換的並不只是兩件道具。


一個交出人的溫度,一個交出機械的訊號。


到了這裡,原本存在於音樂、角色、色彩與時間裡的莫比烏斯環,才真正變成舞台上可以被看見的故事。


六、從角色一致性,到真正開始思考影像


到了 7、8 月,我開始大量把專輯裡的世界轉成圖片與影片。


這時才真正遇到 AI 影像製作最麻煩的問題:單張圖片很好看,不代表連續十張還是同一個人。


人物換一個角度,臉可能就變了;換一個場景,機甲結構又不同;下一個鏡頭,頭髮長度、耳掛、項圈甚至整體比例都有可能跑掉。


《CYBER HER》又比一般角色製作更麻煩,因為 Lucifer Girl 與 Eva Girl 的故事裡還有「交換」。


白色外套現在應該穿在誰身上?藍色發光項圈現在戴在哪一個角色身上?髮色有沒有被畫錯?藍光與粉紅光有沒有互換?

這些對人來說非常簡單的連續性,對生成模型來說卻不一定簡單。


我甚至曾經為 Eva Girl 訓練過一套 LoRA,工作已經接近完成,只是最後沒有正式公開。


但做到後來,我反而愈來愈清楚:角色一致性不是某一套模型、某一個 LoRA 就能完全解決的問題。


真正重要的是,創作者自己必須比 AI 更清楚角色是誰。


她的臉、髮色、身體結構、服裝、光色、道具,以及故事進行到某一刻時,她身上應該留下什麼。


這也是我後來愈來愈重視 Character Bible 的原因。


有了角色之後,下一個問題才是:怎麼讓圖片真正變成故事。


我最早做 AI 影片時的想法其實很直覺:有一張漂亮圖片,把它變成影片就好了。


後來才知道,五秒鐘很漂亮,不代表五十秒鐘能成立。


人物可能突然轉向,背景改變,光線跳掉,甚至下一個鏡頭連角色本身都已經不是同一個人。


所以後來我開始先規劃關鍵畫面。


A 接到 B,下一段再從 B 接到 C;或者先用九宮格把遠景、中景、特寫、角色移動與互動畫出來,再讓生成模型去完成每一段。

有些看起來像「一鏡到底」的地方,其實也是很多不同鏡頭經過設計之後,才讓觀眾感覺畫面一直流動下去。人物經過鏡頭、光線改變、景物遮擋,或讓前一個畫面的某種形體自然延伸到下一個場景,都可以成為轉場的一部分。


但做完《CYBER HER》之後,我反而愈來愈覺得,真正要學的並不只是「轉場效果」本身。


今天坊間已經可以看到大量很漂亮的 AI 轉場,也有愈來愈多工具可以替你完成畫面的變形、延伸與銜接。可是專業 MV、廣告甚至電影影像之所以成立,靠的從來不是一個特效。


它牽涉的是整套影像語言。


一個導演為什麼在這裡用遠景?為什麼下一個鏡頭突然靠近人物?鏡頭應該移動還是停住?什麼時候切?光線是冷的還是暖的?人物和背景之間怎麼分層?畫面的色溫、景深、焦段、運鏡、構圖與節奏,最後又要怎麼一起服務故事?


甚至同樣是 4K 畫面,解析度只是最基本的條件。真正拉開差距的,還是鏡頭裡有沒有判斷。


這些其實都是我下一個階段最想補的東西。


如果我把自己前面提到的「聲音 × 影像六邊形」再往前推,那麼影像這一角需要的,就不只是會操作生成工具,而是要逐漸具備導演、攝影與剪接所累積的視覺素養:看得懂一支 MV 為什麼這樣分鏡,看得懂一支廣告為什麼用這種色溫,也知道一個看似華麗的轉場,究竟有沒有必要存在。


這次把《CYBER HER》的 AI 影像拿給一些具有藝術或影像專業背景的人看時,我也慢慢意識到,華麗的畫面本身並不足以代表影像已經成熟。


但我也不會因此把所有問題都歸結成「自己做得不夠好」。


《CYBER HER》製作的那個階段,生成式影片本身仍然很容易留下銜接、變形與節奏上的痕跡。很多同時期的 AI 影片,其實也都面對類似問題。要把一段畫面反覆做到幾乎看不出接點,往往需要更多生成次數、更長的生成時間,以及更高的製作成本。

而《CYBER HER》畢竟是在有限預算與有限時間裡完成的第一部作品。


前導影片裡,有一小段至今仍然是我自己很滿意的:Lucifer Girl 在地球上的身體逐漸成形,接著抬頭、轉身向下飛去。那一段的動作、鏡頭與畫面銜接幾乎融在一起,很難明顯看出轉換的接點。


也正因為我曾經做到過這樣的段落,我反而知道問題並不是「AI 做不到」,也不是我完全沒有能力做到,而是整部作品不可能在當時的時間與預算裡,讓每一個鏡頭都反覆試到同樣的完成度。


其他段落仍然可以看見一些停頓、接縫或轉換的痕跡。有些來自當時模型本身的限制,有些來自生成成本與製作時間,而有些確實也是我的分鏡、鏡頭語言與轉場判斷還可以繼續精進的地方。


所以做完《CYBER HER》之後,我得到的結論並不是「自己做得不好」,而是我開始更清楚地知道:什麼地方已經做得到,什麼地方只要再多一些時間與資源就能改善,又有哪些能力必須靠自己繼續學。


第一個階段,我學的是怎麼把圖像變成影片。


下一個階段,我想學的,是如何讓更多鏡頭都達到那種「觀眾忘記它正在轉場」的程度,讓分鏡、光線、色彩、構圖、運鏡與節奏真正成為故事的一部分,而不是讓觀眾先注意到技術本身。


AI 可以幫我生成鏡頭,但導演感不會因為按下 Generate 就自動出現。


生成漂亮的畫面已經愈來愈容易。真正困難的,是讓觀眾忘記工具的存在,只看見故事。


AI 可以生成一個漂亮鏡頭,但為什麼下一個鏡頭應該接在這裡,仍然是人的選擇。


七、另一條影像線,也讓我重新理解「靜」


《CYBER HER》製作後期,我同時還參與了陳文茜《如此歲月,如此幸福》的影像工作,其中包括〈假如我能再活一次〉。

兩邊其實是完全相反的題目。


《CYBER HER》是在創造不存在的人物;另一邊面對的卻是真實人物、真實照片與真實人生。


我處理了大量舊照片,再嘗試把其中一些照片轉成動態影像。


其中有一個我很喜歡的方法,是讓照片本身像是一頁「生命之書」,再把動態影像放回照片裡,形成畫中畫的效果。


照片本身仍然留在書頁裡,照片裡的人與景象卻開始流動。


不是把每一張照片都硬做成會動的影片,而是讓原本靜止的照片,像一段重新被打開的記憶。


這段工作後來反而影響我重新看待《CYBER HER》。


我開始理解:畫面不一定什麼都要動。


有時候一張照片不動,反而更有力量;有時候鏡頭停久一點,觀眾才有時間真正看見人物。


到了真正進入舞台製作時,這件事情變得更重要。


八、專輯完成了,真正的舞台工作才開始


真正進入舞台製作之後,我才知道:歌曲完成,和歌曲可以拿去演,是兩回事。


專輯版本可以把聲音做得很滿、很完整,但真人要進來唱,聲音就必須留下空間。


有些 AI 生成的原始音軌已經是一個完整成品,但到了舞台,主唱需要拿掉,合唱又希望留下;有些歌曲的 Key 不完全適合真人;有些在耳機裡聽起來很飽滿的聲音,進到大型 PA 系統之後,反而會和真人聲音擠在一起。


所以我必須重新回到聲音工程。


分離人聲、整理 Stems,再進 DAW 重混,重新處理音域、動態與各個聲部的位置,做出真正能讓真人唱進去的 Stage Mix。

Master 是給聽眾聽的,Stage Mix 是要和真人一起活的。


而當真人真正進入舞台之後,影像也開始被迫改變。


早期影像版本只有七分多鐘,後來逐漸增加到接近十分鐘。這並不是單純在片尾多加兩分鐘內容。


真正改變的是,真人有自己的時間。


電腦裡的人物可以兩秒鐘完成一個動作。


真人不能。


舞者需要走位,需要交換道具,需要讓觀眾看懂動作,也需要呼吸。


所以舞台動作一改,音樂就跟著改;音樂一改,影像節點又必須重新剪;影像改完,再回到排練場;不對,再回來修改。

最後變成一個不斷往返的循環:


音樂 → 影像 → 真人 → 再回到音樂與影像。


我後來把這種工作方式暫時叫作「音畫互鎖」。


它不是一套軟體,也不是一組 Prompt。


它比較像是一種製作觀念:作品不是從頭做到尾就完成,而是任何一個環節改變,其他環節都必須跟著重新調整。


九、真正走上舞台之後,我才知道什麼叫「留白」


《CYBER HER》前面很長一段時間,大部分工作都是我自己坐在電腦前完成。


但到了舞台階段,它就不再是一個人的作品。


從和楊忠衡(楊哥)一次又一次討論,到排練、舞者、服裝與現場技術進場,每一個專業都會從自己的角度重新檢查作品。

有些 AI 圖片裡很好看的設計,真人穿上去根本無法活動;有些我很喜歡的背景影像,一放到舞台上,卻會把真人吃掉;有些音樂在耳機裡非常緊湊,舞者進場之後,卻完全沒有呼吸空間。


演出前約一週,舞群又出現臨時的人事變動,團隊必須迅速調整排練與走位。


這些事情,都不是生成模型會遇到的問題。


也正是在這個階段,我才真正理解:AI 可以讓一個人做到以前很難做到的事情,但它並沒有因此讓其他專業變得不重要。

反而因為真的走進劇場,我才更知道每一種專業為什麼存在。


第一次正式受訪與製作宣傳短片,也反過來逼我重新整理自己的創作邏輯。


當楊哥問我:為什麼是夢境? 夢是怎麼來的??為什麼是兩個女孩?為什麼是莫比烏斯環?為什麼做成雙 CD?為什麼最後又走到舞台?


我不能回答:「因為 AI 做得到。」


我必須把幾個月裡做過的每一個選擇,重新找出理由。


而這其實也是楊哥一直提醒我的事情:整個劇目不能只做到「看起來成立」,我自己必須先把它想得更仔細、更完整。


這些「為什麼」,不只是創作者自己知道就好。我還必須站在觀眾的位置去想:觀眾為什麼要相信這兩個角色?為什麼她們要交換信物?為什麼故事要走到這裡?前面的設定和後面的舞台行動之間,有沒有真正連得起來?


有些原本在音樂與影像裡可以被帶過去的結構問題,一旦走上舞台,就沒有辦法再假裝看不見。


這些問題,也逼著我重新檢查原本劇情裡一些沒有完全想透的地方。


某種程度上,這些討論給我的啟發,甚至比最後舞台上真正演出的那十分鐘還要更多。


因為舞台演出是結果,而這一連串被追問、被檢查、重新思考「為什麼」的過程,才讓我真正知道自己做的是什麼。

演出結束後,我也試著整理自己到底跨過了哪些領域。


大致可以分成詞曲與世界觀、編曲與聲音設計、分軌與舞台混音、角色美術、動態影像與分鏡,以及真人舞台協調。


我暫時把這個能力結構稱為「聲音 × 影像六邊形」。


這並不是說一個人要取代六種專業

。

真正困難的是,當其中一個環節改變時,你能不能理解其他環節會發生什麼事。


舞者需要多幾秒鐘,你要知道音樂哪裡可以退;影像哪裡可以停;舞台什麼時候可以暗下來;觀眾的眼睛應該看哪裡。

到了這時候,我才真正明白六個角為什麼必須互相連在一起。


但如果現在問我,整場演出做完之後最大的反省是什麼,我的答案反而很簡單:


做得太滿了。


AI 很容易給創作者一種誘惑。


因為每一秒都可以生成漂亮畫面,所以每一秒都想塞畫面;因為聲音可以一直增加,所以每一秒都想讓音樂存在。


但劇場不是手機短影音。


真人站上舞台之後,有些時候背景應該安靜;有些時候音樂應該退;有些時候,舞台甚至只需要一個人、一束光,和一次呼吸。

我們不只要學會生成,也要學會什麼時候不要生成。


結語:那些封面,最後把她們帶到了舞台


從 2024 年一張又一張《生成式 AI 群英傳》的封面,到 2026 年的雙 CD,再到 9 月 16 日真正站上舞台,《CYBER HER》對我而言,最大的意義可能不是完成了一齣 AI 音樂劇。


而是它讓我走過一條以前從未完整走過的路。


從寫歌、做專輯、重新混音,到角色設計、影像、分鏡,再到真人排練與舞台。


原本彼此分開的東西,最後全部重新接在一起。


AI 並沒有替我把作品完成。


它只是讓我有機會更快走到以前一個人很難抵達的地方,也因此讓我真正看見每一個專業的難度。


回頭看那些最早的封面,有時候真的會覺得很奇妙。


那時候畫裡的白髮女孩甚至還不知道自己叫 Lucifer。


黑髮的 Eva 也還沒有出現。


她們最早其實只是一些停留在我腦海裡的片段。


來自這十年工作與生活中遇見的人、發生過的事、做過的夢、聽見過的聲音,以及曾經真實感受到的愛。


那些東西有些很清楚,有些已經變得模糊;有些留下了臉孔,有些只剩下一種情緒。


而我喜歡它們,所以一次又一次,把它們留在圖像裡。


後來有一天,她們有了名字。


有了歌曲。


有了故事。


最後甚至有人穿著她們的衣服,站在真正的舞台上。


那些封面,真的讓她們走到了今天。


而這一路留下來的製作紀錄與心路歷程,也讓我開始想像:


《CYBER HER》這個世界,還能走到哪裡。


還會有《CYBER HER 2.0》嗎?


那是個好問題。

 
 
 

留言


  • Facebook
  • YouTube
  • Line

​​AQ廣藝誌|表演藝術新聞網 Copyright© 2025 廣藝基金會

QAF LOGO
bottom of page