我以為給了起點和終點,中間它就會自己走完。實際上不會。 第一套做法燒掉 573 點,可用 0 秒,大半是栽在這個假設上:
| 我要的 | 生出來的 |
|---|---|
| 想跳上平台 | 牠是飄上去的 |
| 想要第一人稱視角 | 整隻貓入鏡(因為我餵了完整的貓照片) |
| 想要頭部晃動 | 生出來像運鏡,不像生物在走 |
首尾幀不是合約,是建議。模型會抵達你給的終點, 但中間怎麼走是它自己決定的。你越想在一段裡塞多件事,它走偏的空間越大。
場景是我家的貓道,真實存在,用實景照片重建:25 公分高,從低處爬上牆、 鑽過圓洞、一路走到天花板下,最後停在高處,望向落地窗跟樓下街口。 穩定器、空拍機、滑軌,一個都塞不進去。
你如果真的要實拍這 25 秒,你得做完這六件事:
而牠,根本不知道你在拍片。
實拍拍得到、而且合理,就去實拍。 但當鏡頭架不進去、主體根本控制不了,或者為了幾秒畫面付出不成比例的成本—— AI 才真正開始有意義。把等運氣的鏡頭,變成可以導演的鏡頭。
哪些事交給生成、哪些事留給後製,是這支片成敗的分界線。細節在下面兩節。
生成走 Seedance 2.0(點數計費平台)。這是實際使用的固定參數。
| 參數 | 設成 | 為什麼 |
|---|---|---|
| model | seedance_2_0 | 與〈一鏡到底〉同一套模型,經驗可以互通 |
| aspect_ratio | 9:16 | 目標是 IG Reels 直式,直接生直式,不事後裁 |
| resolution | 1080p | 預設 720p 不夠看 |
| mode | std | 1080p 只有 std 支援 |
| generate_audio | false | 音效全部後製自己疊(見下),還省點數 |
「參數鎖定」不等於「方法驗證通過」。參數只保證輸出規格一致, 畫面對不對、接點能不能串,是另外兩件事。
第一版整批不可用。除了開頭那三個失控實例,更根本的錯在驗證順序: 我驗了「單段畫面好不好看」,但這支片真正會崩的是「接點能不能串」。 單段各自都能看,串起來運動不連續,等於全部重來。
驗證要驗最可能崩的那一環,不是最好做的那一環。 動手前先回答:這次驗什麼?它崩了,整件事會不會崩? 答不出來就先不要按生成。
重做只改了三件事,全部是把任務從模型手上拿走:
| 改動 | 做法 |
|---|---|
| 重拆鏡頭 | 照第一版實際崩掉的位置重新分段,一段只做一件事 |
| 單段任務降到最低 | 跳躍、轉頭這類模型容易亂發揮的動作,不跟位移擠在同一段 |
| 晃動交給後製 | prompt 裡不再要求頭部晃動,生成拿到穩定畫面,後製加垂直 22px 的步伐晃動 |
模型做不穩的效果,改成後製加,比重生便宜太多。 晃動就是例子:叫模型晃,生出來像運鏡;後製加 22px 垂直位移,可控、可調、0 點數。
即使首尾幀鎖住,接點處運動還是會跳,要在剪接台上修。 說實話:這支片的母帶在 5 秒處有一個硬切。所以我不說它「零剪點」, 也建議你不要為了「真的一鏡」硬燒點數:觀眾看的是流暢,不是你的剪點數。
generate_audio 關掉之後,聲音全部後製疊: 呼吸、落地、爪尖刮過木頭、毛髮摩擦、房間殘響,一層一層疊上去。 腳步聲是程序合成的:46 個落腳點,逐一對位母帶的運動峰值。 聲音對上動作,POV 才成立。
| 項目 | 點數 | 換到什麼 |
|---|---|---|
| 第一套做法 | 573 | 可用 0 秒(整批不可用) |
| 第二套做法 | 402 | 25 秒可用成片 |
| 合計 | 975 | 7 天(08.07–08.14),重做一次 |
AI 省掉的不是創作。省掉的是器材、運氣,和大量的試錯。 工具讓畫面成為可能,怎麼把畫面拍對,仍然是導演的工作。