一張角色圖不夠用!江南茶館老闆娘如何穿越現代拍 VLOG?從四視圖到 AutoIP 影片生成完整實作(claude版)

林若蘅 2026-08-21 12 分鐘閱讀
一張角色圖不夠用!江南茶館老闆娘如何穿越現代拍 VLOG?從四視圖到 AutoIP 影片生成完整實作(claude版)

江南茶館老闆娘在現代打工的一天 VLOG|從角色設定到 AI 影片生成完整教學(claude版)

想製作一支「古代人物穿越到現代」的 AI VLOG,卻發現每一個鏡頭的人物長得不一樣、服裝突然改變,甚至上一幕還在茶館,下一幕場景就完全跑掉?

其實,問題通常不是 AI 不會生成,而是前期提供的角色與場景參考不夠完整

這次就以「江南茶館老闆娘在現代打工的一天 VLOG」為範例,帶大家從角色素材準備、劇本生成,到最後使用 AutoIP 線上環境生成影片,完整跑一次 AI VLOG 製作流程。

一、開始之前,需要準備哪些素材?

在正式生成影片之前,建議先準備三種重要素材:

人物四視圖

人物特寫圖

場景圖

這三種圖片各自負責不同的作用,可以幫助 AI 在生成多個鏡頭時,維持人物與場景的一致性。

1. 人物四視圖|鎖定角色服裝與整體造型

人物四視圖主要是用來固定角色的整體外觀、服裝、髮型與身體比例

例如這次的角色是「江南茶館老闆娘」,如果只有一張正面圖片,AI 在生成其他鏡頭時,可能會自行修改角色的服裝或髮型。

有了四視圖之後,可以讓 AI 更清楚了解人物正面、側面、背面以及服裝前後的完整細節。

因此,在生成影片的過程中,可以降低人物造型突然改變的情況。

簡單來說:

四視圖主要負責「鎖定人物整體造型」。

人物四視圖

人物四視圖

2. 特寫圖|鎖定人物臉部細節

第二個非常重要的素材就是人物特寫圖

四視圖雖然可以固定人物的整體造型,但人物臉部的細節仍然需要另外提供參考。

尤其是 VLOG 中經常會出現人物說話、看鏡頭、微笑、驚訝等近距離畫面,這些都非常依賴臉部特徵。

因此,可以準備一張清晰的人物臉部特寫,讓 AI 更容易掌握角色的五官比例、臉型、眼睛、眉毛、鼻子、嘴型與整體面部特徵。

這樣可以降低不同鏡頭之間出現「人物換了一張臉」的問題。

簡單來說:

特寫圖主要負責「鎖定人物臉部細節」。

人物特寫圖

人物特寫圖

3. 場景圖|鎖定每一幕的環境

第三個素材是場景圖

這一點對連續劇情尤其重要。

如果只使用文字描述場景,例如:

「老闆娘正在現代咖啡廳工作。」

AI 可以生成一間咖啡廳。

但下一個鏡頭如果改成:

「老闆娘走到咖啡廳櫃檯。」

AI 可能重新生成另一間完全不同的咖啡廳。

這就會造成場景不一致。

因此,如果希望影片具有連續性,最好提前準備對應的場景參考圖。

簡單來說:

場景圖主要負責「鎖定劇情發生的環境」。

場景圖

場景圖

二、先準備好劇本

素材準備完成之後,接下來就是製作劇本。

這裡不需要一開始就直接進入影片生成,可以先利用 ChatGPT、Claude 或其他自己習慣使用的 AI 工具,協助完成完整劇本。

例如這次的主題:

《江南茶館老闆娘在現代打工的一天 VLOG》

可以先將人物圖片提供給 AI,再告訴 AI 人物背景、VLOG 主題、故事內容、影片風格、人物台詞以及希望加入的搞笑橋段。

讓 AI 先完成完整劇本。

劇本生成提示詞

可以直接將人物圖片提供給 GPT,讓 GPT 根據角色形象創作你想要的 VLOG 劇本。

劇本生成示意圖

劇本生成完成後,不需要一次就直接使用。

可以先完整檢查內容。

如果發現劇情不合理、台詞不自然、笑點不足、人物性格不符合設定或鏡頭描述不夠清楚,都可以直接讓 AI 修改。

小提醒

生成劇本不一定非要使用 ChatGPT。

GPT、Claude、Gemini 或其他 AI 工具都可以。

選擇自己最習慣、最容易控制劇情的工具即可。

三、將完整劇本交給 Claude

當劇本確認沒有問題之後,就可以將完整劇本複製到 Claude,進一步整理成適合影片生成的內容。

Claude 操作示意圖

接著,可以加入以下核心要求:

[Pasted text #5 +399 lines],人物參考[Image #2],面部參考用[Image #3],720P,16:9,用線上環境生成,一次併發三個任務,人物聲音細節部分都要一樣,場景圖帶[Image #4]。

接下來就來解析這段指令到底代表什麼。

四、解析影片生成指令

1. Pasted text #5 +399 lines

這裡代表我們剛剛複製過來的完整劇本。

因為劇本內容可能非常長,所以 Claude 會用這種方式表示已經貼入一大段文字。

簡單來說:

Pasted text = 我們準備好的完整劇本。

2. 人物參考 [Image #2]

這裡需要自己手動拉取人物四視圖

它的作用是讓 AI 知道影片中的主要人物到底長什麼樣子。

主要鎖定:

人物外觀

服裝

髮型

身體比例

角色整體設計

3. 面部參考 [Image #3]

這裡需要自己手動拉取人物特寫圖

主要用來鎖定人物的臉部特徵。

也就是:

四視圖負責整體人物。

特寫圖負責人物臉部。

兩者搭配,可以更加完整地建立角色參考。

4. 720P、16:9

這是在限制影片的輸出規格。

720P代表影片輸出解析度。

16:9代表影片畫面比例。

目前可以依照 AutoIP 平台實際提供的選項選擇適合的影片解析度與比例。

如果影片是準備發布到 YouTube、一般橫向 VLOG 或教學內容,16:9 就非常適合。

5. 用線上環境生成

這裡是指定:

使用 AutoIP 的線上環境進行生成。

也就是讓 AI 生成工作直接交給 AutoIP 的線上環境處理,不需要自行建立本地 AI 影片生成環境。

6. 一次併發三個任務

這個設定需要依照自己目前使用的 AutoIP 方案而定。

不同方案可以同時執行的任務數量可能不同。

例如教學中使用的是可以同時執行三個任務的方案,就可以指定:

一次併發三個任務。

這樣可以讓多個影片生成工作同時進行,提高整體製作效率。

7. 人物聲音與細節保持一致

這句話非常重要。

除了人物外觀之外,也要再次要求 AI 維持角色的:

人物特徵

聲音

服裝

髮型

配件

角色設定

如果劇本中某些細節沒有明確描述,可以要求 AI 依照已提供的角色參考進行補足,而不是每一幕重新隨機設計。

目的就是:

讓同一個角色在不同鏡頭中盡可能維持一致。

8. 場景圖帶 [Image #4]

最後就是加入場景參考圖。

這裡需要自己手動拉取前面準備好的場景圖片

它的作用是讓 AI 知道:

這一段劇情應該發生在哪裡。

這樣可以降低不同鏡頭之間場景突然改變的問題。

五、確認無誤後,開始生成

所有設定確認完成後,就可以送出生成任務。

這時可以到 AutoIP 的作品管理查看任務狀態。

AutoIP 作品管理

送出任務之後,不一定會立即開始正式生成影片。

系統通常需要先分析劇本、人物圖片與場景圖片,並確認劇情中是否存在需要補足的物品或畫面元素。

因此,前置分析需要一定時間,實際等待時間則會依照當下系統狀況與影片內容而有所不同。

六、AI 會自動補足劇情需要的元素

這也是整個流程中非常有趣的一個地方。

例如劇本寫到:

「老闆娘端著一杯珍珠奶茶走到店門口。」

但是你提供的場景圖片裡可能沒有珍珠奶茶。

AI 在分析劇本與場景後,就可能需要自行補足劇情所需要的物件。

例如:

珍珠奶茶

店門外環境

桌面物品

背景裝飾

等等。

因此,在真正生成影片之前,先檢查系統準備的內容非常重要。

如果發現補足的元素符合劇情,就可以繼續生成。

如果發現不符合自己的設定,就可以先修改。

七、影片生成完成後,一定要檢查成品

影片完成之後,不要直接發布。

建議先完整觀看一次。

主要檢查:

人物是否保持一致

臉部是否有變化

服裝是否正確

髮型是否正確

人物聲音是否一致

場景是否連貫

劇情是否符合原本設定

台詞是否正確

動作是否自然

畫面中是否出現不需要的物品

如果全部都符合預期,就可以進入下一步剪輯或發布。

如果不滿意,也可以根據問題重新修改相關內容,再進行生成。

八、最後查看生成成本

完成影片之後,也可以查看這次生成所使用的:

點數

以及

生成時間

這對需要大量製作 AI 影片的人來說非常重要。

長期製作之後,就可以慢慢掌握不同影片類型的生成成本與時間,進一步安排自己的創作流程。

九、完整流程整理

如果把整個「江南茶館老闆娘在現代打工的一天 VLOG」製作流程濃縮起來,其實就是:

第一步|準備人物四視圖

鎖定人物整體造型、服裝與髮型。

第二步|準備人物特寫圖

鎖定臉部與五官細節。

第三步|準備場景圖

鎖定影片中的主要環境。

第四步|使用 AI 生成劇本

先完成完整故事、分鏡與台詞。

第五步|將劇本交給 Claude

整理成適合影片生成的完整提示詞。

第六步|加入人物四視圖

作為主要人物參考。

第七步|加入人物特寫圖

作為面部參考。

第八步|加入場景圖

鎖定劇情場景。

第九步|設定影片規格

例如 720P、16:9。

第十步|指定 AutoIP 線上環境

讓系統進行 AI 影片生成。

第十一步|依照方案設定併發任務數

例如一次併發三個任務。

第十二步|等待 AI 分析與生成

確認人物、場景與劇情內容。

第十三步|檢查最終影片

確認人物、聲音、場景與劇情是否符合預期。

第十四步|修改或繼續使用

不滿意就調整,滿意就進行後續剪輯與發布。

結語|AI VLOG 的重點,不只是生成影片

很多人第一次使用 AI 生成影片時,會以為只要輸入一段文字就可以。

但真正想要製作連續、穩定、角色一致的長篇 VLOG,前期素材準備其實非常重要。

四視圖負責人物。

特寫圖負責臉部。

場景圖負責環境。

劇本負責故事。

AI 負責將這些素材整合成影片。

當這些參考資料準備得越完整,後續生成時就越容易控制結果。

這次以「江南茶館老闆娘在現代打工的一天 VLOG」為例,就是希望讓大家理解一個完整的 AI 影片製作流程。

從一張角色圖開始,到人物四視圖、特寫圖、場景圖,再到劇本、Claude 整理提示詞,最後交給 AutoIP 生成影片。

真正好用的 AI 工作流,不只是讓 AI 幫你生成,而是先把你想要的東西說清楚、準備完整。

友情提示

生成劇本不一定要使用 GPT 或 Claude。

ChatGPT、Claude、Gemini 或其他 AI 工具都可以。

重點不是一定要使用哪一個 AI,而是找到自己最熟悉、最容易修改與控制劇情的工具。

開始製作你的 AI VLOG

想將自己的角色製作成完整的 AI VLOG,可以使用 AutoIP 的線上 AI 創作環境。

前往 AutoIP 官方網站

使用推廣碼 MEDIAO4JREQ 註冊:

使用推廣碼註冊 AutoIP

從角色設定開始,把你的下一個 AI VLOG 做出來。

分享:
林若蘅 · 中級教學員

教學內容會以「理解原理+實際操作」為核心,透過案例、示範與練習,逐步提升學員的操作熟練度與解決問題的能力,讓學員不只是「會操作」,更能理解「為什麼這樣做」。

準備好用 AI 加速你的內容創作了嗎?

立即免費註冊 AutoIP,體驗 AI 貼文、圖片與影片生成。

相關文章