加入好友

Tina學姐的第一部AI漫劇實戰筆記

看別人製作 AI 短劇的時候,我一直有一種感覺:好像沒有想像中困難。

AI 先幫忙把劇本寫好,下載成 Word,再按照劇本裡的分鏡,一個畫面、一個畫面丟進即夢生成,最後放到剪映裡剪一剪,一支 AI 短劇似乎就完成了。

我甚至看過有人把整個流程整理成四個步驟,看完真的會產生一種錯覺:「這好像我也可以做。」

於是,我真的做了。

我的第一部 AI 短劇叫做《凌晨一點的咖啡》,總共製作了 10 集。

做完之後,我才真正理解一件事:AI 短劇的流程確實不難,難的是怎麼讓生成出來的一堆圖片和影片,最後真的看起來像一部戲。

而這中間的距離,比我一開始想像的大很多。

從一杯凌晨一點出現的咖啡開始

《凌晨一點的咖啡》最初的設定其實很簡單。

女主角林予安獨自住在公寓裡。某一天凌晨一點,她打開門,發現門外放著一杯咖啡。

不知道是誰送的,也沒有任何留言。

接下來幾天,咖啡持續出現。

她開始調查監視畫面、留下錄影、找到紙條,甚至發現某段時間的錄影莫名消失。一路追查之後,她發現所有線索竟然指向住在同一層、早已搬走的一名前房客。

而那個人的名字,竟然是她的前夫—周承宇。

到了 EP10,她終於直接打電話問他。

12 樓是不是他自己選的?

那些凌晨一點出現在門口的咖啡,是不是他放的?

答案都是:「是。」

最後,她對他說:「承宇,別再來了。」

第二天凌晨一點,她再次打開門。門外第一次什麼都沒有。

故事最後,她回到屋裡,自己沖了一杯咖啡。

旁白只有一句:「這一次,我替自己沖了一杯。」

《凌晨一點的咖啡》,第一季完。

故事看起來只有短短 10 集,但真正做完,我才發現,自己學到的東西遠比原本預期多。

第一個教訓:AI 會寫故事,不代表它寫的是「能生成的劇本」

這是我這次最早碰到的問題。

一般文字劇本可以很自然地寫:「她走到門口,猶豫了一下,伸手敲門,等待片刻,低頭發現門縫裡透出一道光。」

讀起來完全沒有問題。

但把這句話交給影片生成 AI,就完全是另外一回事。

因為這一小段裡,其實已經包含很多不同動作:走路、停下、猶豫、伸手、敲門、等待、低頭、看光、表情改變。

對真人演員而言,這可能只是幾秒鐘。對 AI 而言,卻很可能一次做不好。

結果就是人物突然轉身、手勢奇怪、門的位置改變,甚至動作做到一半,人已經不是原本那個人了。

做到後來我才開始理解:AI 短劇的劇本不能只是「好看」,還要「好生成」。

與其要求 AI 一個鏡頭完成八個動作,不如拆成兩支影片。

例如原本的一個鏡頭,可以拆成:

    • 第一支:走到門前,敲門,等待。
    • 第二支:等待片刻,低頭看向門縫。

一旦這樣拆,成功率就會高很多。

這也是我以後再製作第二部 AI 短劇時,第一個一定會改變的地方。

我不會再先寫一般劇本,再想辦法把它塞進 AI。

而是從寫劇本的第一天,就直接用「AI 能不能演得出來?」來設計每一個鏡頭。

第二個教訓:一張圖很好看,不代表放進影片裡會好看

製作前幾集時,我用了不少 AI 生圖。單獨看,每張圖片其實都不差。

女主角漂亮、公寓漂亮、光影也很有電影感。

但把十幾張漂亮圖片丟進剪映後,問題馬上出現。

如果每一張圖片都只能靠放大、縮小、往左移、往右移、慢慢推近,整支影片最後很容易變成一種:「會動的 PPT」或「動態相簿」。

一開始我也會想辦法利用剪映的關鍵幀,讓畫面不要完全靜止。

但做到幾集後,我自己先受不了了。

因為不管圖片多漂亮,只要人物本身沒有真的在動,觀眾其實很容易感覺到:「這不是戲,這只是圖片在移動。」

所以《凌晨一點的咖啡》做到中後段時,我們開始改變製作方式。

人物情緒、人物動作,盡量直接生成真正的 AI 影片;聊天紀錄、紙條、轉帳資料、監視畫面等「證據」,才保留靜態圖片。

這個改變非常重要。

EP01~EP05 和 EP06~EP10,其實已經是兩種不同的製作方式

如果現在把第一集和第十集放在一起看,我自己都能很清楚看見差異。

前半段比較接近:AI 圖片+剪映+少量影片。

後半段慢慢變成:AI 人物影片+靜態證據+舊素材+聲音+剪輯。

尤其開始大量使用即夢的「全能參考」之後,我才第一次真正感覺:「林予安開始像是在演戲了。」

她會滑手機、停下、慢慢抬頭、看向玄關。

她會拿著電話,聽見答案之後,表情慢慢產生變化。

到了最後一集,她甚至真的完成了開門、發現門外什麼都沒有、回到屋裡、自己沖咖啡、拿著咖啡坐下這一整段動作。

這些鏡頭如果還是使用靜態圖片推拉,情緒會完全不一樣。

所以我現在給自己一個非常簡單的判斷方式:

畫面類型 我現在會怎麼做
人物情緒、動作、走路、轉頭、電話 優先生成 AI 影片
聊天紀錄、紙條、銀行紀錄 靜態圖即可
空走廊、門、房間等線索 可以影片,也可以固定空景
已經拍過或生成過的場景 優先重複利用
只是為了讓圖片「動起來」 不再硬加推拉關鍵幀

做到這裡,我才真的懂得:不是所有東西都需要變成影片,也不是所有圖片都需要動。

真正重要的是,哪一個鏡頭負責「演戲」,哪一個鏡頭負責「給資訊」。

第三個教訓:人物一致性,比一張漂亮的臉重要得多

AI 很會生漂亮人物。

問題是,第一張漂亮、第二張也漂亮、第三張還是漂亮……但三張可能根本不是同一個人。

做單張廣告可能沒有太大問題。

做連續劇就很致命。

所以林予安後來慢慢建立了一組固定參考,包括正面、側面、表情、服裝,以及客廳、玄關、走廊等固定場景。

再利用AI程式的參考圖片去約束後面的影片。

這個方法改善很多,但也出現另外一個很有趣的問題:參考圖不是放越多越好。

有一次我希望林予安「滑手機」,卻拿了一張她「手機放在耳邊打電話」的圖片當參考。

結果 AI 非常聽話。

它真的把手機一直放在耳邊。

那次我才懂,AI 並不知道我只是想借那張照片的人臉。

它可能同時把姿勢、手的位置、人物方向、手機的位置,全部一起學走。

所以後來我學到一件很實用的事:想生成什麼動作,就盡量提供接近那個動作的參考。

不要拿一張非常強烈的姿勢圖,再期待 AI 完全忽略姿勢,只認人物的臉。

第四個教訓:AI 最容易翻車的,往往不是大場面,而是手、手機和文字

這次製作過程中,讓我最常重做的東西,反而不是什麼爆炸、追車或大特效。

而是很普通的:手、手機、文字。

人物拿手機時,手指可能出現問題。

明明想讓人物滑手機,結果變成打電話。

想從桌上拿起一個東西,物件可能莫名其妙旋轉。

聊天紀錄可能左右放反。

繁體中文字可能突然多一個字、少一個字,甚至直接變成看不懂的符號。

所以做到後來,我開始接受一件事:AI 不是什麼都一定要做。

像聊天紀錄、轉帳紀錄、紙條這種「文字必須 100% 正確」的畫面,我反而寧可把它當成平面設計處理。

因為觀眾真的會讀。

只要一個名字錯、一個樓層錯、一個金額錯,整個故事邏輯都有可能被破壞。

第五個教訓:影片真正開始變成「戲」,其實是在剪映

我原本以為,最重要的是把 AI 影片生得漂亮。

做到最後才發現:生成只是拿到素材,真正的戲,是剪出來的。

同一個畫面放 5 秒和放 2 秒,感覺完全不同。

一句話先說再切畫面,和先切畫面再說話,效果也完全不同。

EP10 就非常明顯。

林予安最後對周承宇說:「承宇,別再來了。」

這句話如果配一個大特效、一個快速推近,再讓悲情 BGM 突然衝到最高點,很容易變得太過戲劇化。

我們最後反而什麼都沒有做。

人物安靜,音樂降低,她很平靜地把話說完。

接著下一幕,凌晨一點,她打開門。

門外什麼都沒有。

那個「什麼都沒有」,本身就成為一個很重要的畫面。

所以我現在越來越相信:剪輯不是把素材接起來而已,而是在決定觀眾什麼時候知道答案、什麼時候停一下,以及什麼時候開始產生感覺。

第六個教訓:教學影片裡最少看到的,是「失敗生成的成本」

看 AI 短劇教學時,通常看到的是:輸入提示詞 → 按生成 → 成功 → 下一步。

但真的自己做之後就會發現,中間其實還有很多看不到的過程。

    • 生成一次人物不像,重來。
    • 手壞掉,重來。
    • 動作方向錯,重來。
    • 場景跑掉,再重來。

花掉的除了時間,還有生成點數。

我一開始使用 Seedance2.0 製作影片時,就很快感受到點數消耗帶來的壓力。

這也是為什麼後來我開始學會判斷:這個鏡頭到底值不值得重新生成?還是用剪輯就能解決?

例如「敲門」這種動作,有時甚至不一定非得生成一個完整的手部敲門特寫。

人物站在門前,再加上:「叩、叩。」兩聲敲門音效。

觀眾的大腦自然會幫忙完成那個動作。

這也是我這次實際做完一整部短劇後,才慢慢理解的「製作思維」。

看直播說四步驟,為什麼自己做起來完全不是四步?

現在回頭看,我依然覺得這個流程沒有錯:AI 寫腳本 → 整理分鏡 → AI 生成 → 剪輯

錯的是我一開始以為:知道這四步,就等於會做 AI 短劇。

其實四步只是一個外框。真正要學的是裡面那些細節。

怎麼寫 AI 演得出來的分鏡?一鏡可以放幾個動作?哪一張參考圖會影響姿勢?哪些畫面應該生成影片?哪些畫面根本不用動?怎麼維持人物一致?證據要停幾秒才能讓觀眾看懂?一個 5 秒鏡頭究竟應該在哪個 0.5 秒切掉?

這些東西,不實際做一次,其實很難真正理解。

如果現在重新做《凌晨一點的咖啡》,我會怎麼做?

如果今天把所有素材刪掉,叫我從 EP01 重新開始,我一定不會再按照第一次的方法做。

第一步,我會先把 EP01 到 EP10 的完整故事和結局全部確定。

也就是在開始第一集以前,我就必須知道:最後是誰送咖啡?為什麼送?為什麼住在 12 樓?林予安最後又會做出什麼決定?

接著,才把整個故事拆成 10 集,而且每一集只負責揭露一個最重要的新資訊。

再建立角色與場景資料庫,把人物、服裝、客廳、玄關、走廊、房門、咖啡等重要元素全部固定。

最後再把整季分鏡一次規劃完成,而且每一鏡直接標示:AI 影片、靜態證據、舊素材、空景。

完成這些準備之後,才真正開始批次生成素材。

這樣就不會像第一次製作時一樣,今天做到 EP05,才發現 EP07 需要某個角度;到了 EP08,又發現前面的手機姿勢根本不能使用。

真正能省時間的,其實不是「AI 生成速度有多快」。

而是:在開始生成以前,就少做錯的東西。

如果做第二部 AI 短劇,我會採用什麼流程?

經過《凌晨一點的咖啡》這 10 集之後,我現在會把自己的 AI 短劇工作流程重新整理成以下幾個階段:

階段 工作內容
01|故事設定 先確定故事核心、結局、角色關係與最終答案
02|整季規劃 一次決定所有集數,每集只安排一個主要揭露
03|角色 Bible 固定人物臉型、髮型、服裝、年齡、性格與常用角度
04|場景 Bible 先建立會重複出現的客廳、玄關、走廊、房間等環境
05|完整分鏡 每個鏡頭標示時間、動作、旁白、參考素材與生成方式
06|批次生成 相同性質的角色、場景與動作一起生成,提高一致性
07|剪輯 人物影片、證據圖、空景、旁白、音效與 BGM 統一整合
08|逐集檢查 確認劇情邏輯、字幕、人物一致性、音量與節奏

我想,這會是我第二部 AI 短劇正式開始時,最重要的一次升級。

我的第一部 AI 短劇不完美,但我還是決定把它做完

《凌晨一點的咖啡》不是一部我會說「非常專業」的 AI 短劇。

有些地方現在回頭看,我知道可以做得更好。

人物一致性可以再提高。

有些前期鏡頭太像圖片推拉。

部分動作還是不夠自然。

剪輯節奏也有很多地方,是做到後面才慢慢抓到感覺。

但是我沒有打算把前面全部砍掉重做。

因為它記錄了一件對我更重要的事情:我第一次真的從零開始,把一個 AI 故事做成 10 集,而且做完了。

EP01 和 EP10 之間的差距,就是我這十集真正學到的東西。

所以我想把這些過程留下來。

不是因為我已經很會做 AI 短劇。

恰恰相反。

是因為我還在學。

這也是「Tina學姐的AI漫劇筆記」開始的原因

未來我還會繼續學即夢、Seedance2.0,以及各種新的 AI 生圖、生影片與剪輯工具。

第二部 AI 短劇,我也一定會繼續做。但我不急著馬上開始。

我想先把第一部踩過的坑整理好,把哪些方法有效、哪些方法浪費時間、哪些鏡頭最容易失敗,一點一點記錄下來。

如果你也剛開始接觸 AI 短劇,看著網路上的作品很漂亮,卻不知道自己到底能不能做到,那我現在至少知道:工具真的沒有想像中難。

但「會用工具」與「完成一部作品」,中間還有很長一段路。

而這段路,沒有哪一支教學影片能完全替你走完。

真的做一次,你就懂了。

《凌晨一點的咖啡》是我的第一部 AI 短劇。

它不完美。

但它讓我第一次真正知道,下一部該怎麼做得更好。

Tina學姐的AI漫劇筆記|第01篇

作品 《凌晨一點的咖啡》
形式 AI 原創短劇
集數 第一季共 10 集
製作方式 AI 劇本+AI 生圖+AI 影片+剪映後製
使用工具 ChatGPT、即夢、Seedance、剪映等

下一次再開始第二部 AI 短劇時,我會從「先把整季劇本和分鏡一次規劃好」開始。

到時候,我也會繼續把真正實戰後發現的問題,一篇一篇寫進這個系列。

因為我想記錄的,不是 AI 有多厲害。

而是一個普通人,究竟怎麼把 AI 慢慢變成自己真正會用的創作工具。