# AI 短劇產線・一句話到成片

> 生圖、轉影片、配音、對嘴、上字幕、成片——五段式本地產線,人只負責劇本和判斷。

- 作者: 張耐德 Ned
- 作者資料: https://nedc.tw/about/
- 分類: 工作檯
- 原文: https://nedc.tw/work/ai-drama-pipeline/
- 專案狀態: 營運中
- 標籤: 生成式影像, 語音克隆, ffmpeg

本文是作者的專案紀錄，狀態為「營運中」；功能與合作範圍以專案當前公開說明為準，不代表第三方認證或成效保證。

![水墨:電影膠卷展開,畫格從山水漸變成電路與星塵](https://nedc.tw/img/projects/ai-drama-pipeline.webp)

從一句話到一支有旁白、有字幕的短片,中間是五段接起來的產線:

1. **生圖**——文字生成分鏡圖
2. **轉影片**——圖生影片(I2V),單段上限約 15 秒
3. **配音**——中文神經語音,或用 GPT-SoVITS 克隆我自己的聲音;字幕檔同步產出
4. **對嘴**——MuseTalk 讓真人臉型影片跟著旁白動嘴
5. **組裝**——ffmpeg 上字幕、接轉場、縫成片

每一段都是獨立工具,壞了哪段換哪段。三十秒以上的影片靠多段拼接——沒有一步登天的生成,只有縫得好不好看的工。

做完的體會:工具鏈會一直換,但「分鏡怎麼切、哪一秒該停」這種判斷,目前還是人的。

每一段的天花板在哪、三個省下重做時間的判斷,寫在這篇實作筆記:[一句話到成片:AI 短劇產線實錄](https://nedc.tw/notes/drama-pipeline/)。
