AI 角色一致性實用教學:男生、女生設定與社群、電商、短影音中文提示詞
- 從主參考圖到角色延伸應用,分清固定特徵與本次任務 -
想讓同一位 AI 人物出現在課程封面、社群貼文、商品展示與短影音裡,可以先準備一張確認過的主參考圖,再清楚交代每次要更換的場景、動作或服裝。
日常最值得學會的,是把「人物本身」和「這次要拍什麼」分開寫。
「主參考圖」就是你挑選並確認外觀的那張圖片。後續製作都以它為依據,逐張檢查人物是否仍然像同一個人。
本文的範本可在支援參考圖編輯的影像功能中練習,例如 ChatGPT、Gemini 與 Grok Imagine。提示詞可以共用基本結構,各平台的結果仍要個別確認。可用功能、參考圖欄位與輸出規格會隨版本、方案及介面調整,操作時以你使用的平台為準。
一、日常角色圖片,需要保留哪些設定?
| 值得保留 | 可以先省略 |
|---|---|
| 一張清楚的主參考圖 | 一次排滿七區的大型設定板 |
| 臉部、髮型與身形的辨識特徵 | 把每個人都套成肌肉男、大眼美女 |
| 這次實際會用到的姿勢與表情 | 一口氣做十種表情、六種姿勢 |
| 明確指定這次保留或更換的服裝 | 把同一角色永遠綁定同一套衣服 |
| 已確認的商品與品牌資訊 | 讓 AI 猜身高、材質成分或品牌色碼 |
側面、背面和服裝細節都有用途,可以等到真的需要那個角度時再補。
例如,只做講師半身宣傳圖,就先把臉和上半身造型做好;要拍全身街舞,再處理完整服裝、鞋子與動作空間。
先完成會用到的圖片,再逐步補充角色設定。
二、把提示詞分成「固定項目」與「本次任務」
一份好修改的提示詞,可以用這個結構:
人物參考+固定特徵+本次變動+畫面規格
固定特徵包括臉形、髮際線、眉眼、鼻型、原本的身形,以及你希望沿用的辨識配件。
本次變動包括表情、姿勢、場景、光線,以及這次想替換的服裝。
服裝要不要固定,取決於用途:
- 課程系列圖:可以維持同一套造型,讓整個系列容易辨認。
- 服飾電商:可以固定人物,換穿不同商品。
- 短影音:同一段連續情節維持造型,換場或換主題時再安排新服裝。
OpenAI 的圖片提示指引也提供這種操作方向:交代要改什麼、哪些內容要保留,並說明每張參考圖的用途。
三、男生、女生都先設定「看得見的細節」
「帥氣男生」「漂亮女生」可以表達大方向,但還不足以定義一個容易辨認的角色。
從零設計人物時,先選幾個看得見的特徵就好。
| 設定項目 | 可以怎麼寫 |
|---|---|
| 成年年齡感 | 約 30 歲的成年角色、約 45 歲的成熟角色 |
| 臉形與眉眼 | 方圓臉、橢圓臉、自然濃眉、平直眉型 |
| 髮型 | 短側分髮、及肩直髮、短捲髮、低馬尾 |
| 身形 | 一般身形、精實體態、較寬肩線、自然身體比例 |
| 服裝 | 俐落西裝外套、寬鬆襯衫、工裝褲、素色運動上衣 |
| 辨識配件 | 細框眼鏡、小圓耳環、固定款式的項鍊 |
男女都能走親切、專業、運動或街頭方向。男性可以長髮、戴耳環;女性也可以短髮、穿寬鬆西裝。依角色用途選擇,不必把男性固定成肌肉身材,或把女性固定成細腰長腿。
把抽象氣質改成具體畫面
| 想呈現的感覺 | 改成可看見的畫面 |
|---|---|
| 親切 | 嘴角輕微上揚,眼神放鬆,手掌自然打開 |
| 自信 | 身體站直,肩膀自然打開,平視鏡頭 |
| 酷帥 | 表情平靜,肩膀放鬆,一手插口袋 |
| 專業 | 服裝整齊,站姿穩定,手勢符合正在說明的內容 |
例如,與其只寫:
一位很專業、很有自信的女生。
可以改成:
一位穿著俐落西裝外套的成年女性,站姿穩定,肩膀自然打開,平視鏡頭,一手朝旁邊的空白區做出介紹手勢。
如果你已經有真人照片,就以照片為準。 不要再把這些外貌選項全部加上去,變成重新設計另一張臉。
四、先建立一張主參考圖
範例一:從零建立男性課程角色
這個範例適合課程宣傳、知識型社群與產品解說。人物是虛構設定,可以自行更換年齡感、髮型與服裝。
1 | 請建立一位原創虛構的成年男性,作為知識型課程的固定角色。 |
可以怎麼調整?
想改成街頭創作者,可以先換成寬鬆外套、工裝褲與運動鞋,搭配放鬆的站姿。
選定人物後,再用主參考圖延伸造型,不必每次重新生成一張臉。
範例二:從零建立女性品牌角色
這個範例適合品牌介紹、知識型社群與生活風格內容,也能換成講師或街舞角色。
1 | 請建立一位原創虛構的成年女性,作為品牌內容的固定角色。 |
可以怎麼調整?
想改成街舞角色,可以先保留這張臉,再換成素色運動上衣、寬鬆工裝褲與運動鞋。
若要同時改髮型,分成下一輪處理,方便檢查角色辨識度。
範例三:使用自己的照片
使用自己或已取得使用同意的人物照片。這條男女通用,不需要猜測照片中的年齡、身高或個性。
1 | 請使用上傳照片中的同一位人物, |
若原照沒有拍到足夠的身體範圍,就先使用原照涵蓋的景別。需要完整服裝、鞋款或背面時,再補照片,或明確把那些部分當作新增設計。
選出滿意的主參考圖後,把它保存下來。後續每次生成,都明確附上或指定這張圖。
角色名稱可以方便整理,但名字本身不會讓模型自動知道角色長相。
五、三種日常應用提示詞
下面三種應用都能使用剛才建立的男性、女性角色,或自己的照片。
操作方式很簡單:先附上主參考圖,再貼對應提示詞。
應用一:課程與社群宣傳圖
這類圖片通常需要清楚的人物、與文案配合的手勢,以及可以放標題的空間。
先把人物與構圖做好,標題最後再排版。
1 | 請使用我上傳的主參考圖,製作同一角色的課程宣傳圖片。 |
要做直式貼文,可以把比例改成 4:5,並將留白改成上方。
不要只改比例,卻仍要求橫幅式的大面積左右排列。
應用二:同一位電商模特兒換穿商品
這次需要兩張圖:
- 圖 1:人物參考。
- 圖 2:商品上衣參考。
因為目標是換衣服,就不要同時要求「原本服裝完全不變」。
1 | 請結合本輪上傳的兩張參考圖,製作服飾展示圖片。 |
商品圖必須核對實際商品,尤其是印花、文字、口袋與扣件。
只有正面商品照時,先做正面展示;要展示背面,補上背面商品照。
如果品牌標誌或文字必須精確保留,使用原始素材合成,並檢查成品。不要把生成的穿著效果當成尺寸或版型的實際量測。
應用三:短影音或街舞主角
先做好影片要開始的那一張畫面,再處理動作。
人物參考圖負責外觀;影片起始畫面還要決定場景、景別、站位與動作空間。
真人照片若只有頭像,先補全身造型資料。
第一步:生成起始畫面
1 | 請使用我上傳並確認過的角色與完整造型, |
第二步:交給影片工具處理動作
將這張圖放進影片工具的起始畫面欄位,再給動作要求。
以下以工具支援的 10 秒影片為例:
1 | 以提供的圖片作為起始畫面,生成 10 秒直式影片。 |
第一次先用簡單動作檢查臉、衣服與身體是否穩定。
若想進一步安排舞步與動態特效,可以接著閱讀豆包 AI 跳舞影片完整教學。
這段適合測試畫面連續性,並不代表已精準對上某首歌的節拍;需要卡點時,再依實際音樂安排動作或剪輯。
如果工具有角色參考欄,就放主參考圖;如果是首幀欄,就放單一場景的起始畫面。 兩個欄位的用途要分清楚。
六、有需要才補角度與表情
做回頭、側身或背面動作時,再補相關參考。
製作多角度參考時,可以逐角度生成,並在後續沿用已確認的參考圖片;每次都要核對角色是否仍像同一個人。
可以一次只要求一個角度:
1 | 請使用本輪上傳的原始人物照片與已確認造型, |
若未提供或確認側背面資訊,生成的補全部分應當作設計草稿,先確認再沿用。
需要不同表情時,也可以只換一句:
- 微笑:「嘴角輕微上揚,不露齒,眼神自然放鬆。」
- 驚訝:「眉毛上揚,眼睛略張大,嘴巴微張。」
- 思考:「視線偏向側上方,嘴唇輕抿。」
保留人物骨相與辨識特徵,允許表情自然改變眉眼、嘴型與臉頰。
七、畫錯時,只修正出錯的部分
先指出哪裡不對,再說明要保留哪些已完成的內容。
例如臉部走樣,可以同時附上原始主參考圖與目前成品:
1 | 圖 1 是原始主參考圖,圖 2 是需要修正的成品。 |
其他常見問題,也可以用短指令處理:
| 問題 | 修正方向 |
|---|---|
| 手勢不自然 | 只把抬起的手改成自然張開的手掌,朝向留白區 |
| 全身被裁切 | 拉遠取景,讓頭頂、雙手與鞋子完整入鏡 |
| 衣服換錯 | 依商品參考修正上衣,保留人物與目前場景 |
| 背景太複雜 | 簡化背景物件,保留人物與原本構圖 |
文字要求仍需要檢查結果。OpenAI 官方文件也指出,角色與品牌元素的一致性、文字與版面控制仍可能出現偏差。若某個區域必須逐像素維持原樣,官方提示指引建議把核准的修改合成回原圖。
八、用一個角色,完成三張日常作品
挑選自己的照片,或先用男性、女性範例建立一位虛構角色,接著完成:
- 一張有標題留白的課程或社群宣傳圖。
- 一張同角色換場景,或換穿指定商品的圖片。
- 一張 9:16 短影音起始畫面。
每張只問四件事:
- 還像同一個人嗎?
- 造型符合本次要求嗎?
- 動作與構圖有用嗎?
- 重要細節看得清楚嗎?
先把你最常用的這三張圖做好,就能開始把角色用進內容工作。
等到新的場景需要側面、背面或特殊表情,再逐步補充參考。
常見問答 (FAQ)
Q1:如何讓 AI 每次生成的角色都像同一個人?
先選出並保存一張清楚的主參考圖,後續每次生成都附上或明確指定它,再分開描述固定特徵與本次任務。固定項目可包括臉形、眉眼、髮際線、髮型、身形與辨識配件;每張成品都要核對,文字提示與參考圖仍無法保證完全一致。
Q2:同一個 AI 角色換衣服時,哪些設定要保留?
保留人物的臉部、髮型、膚色與可見身形,明確指定只替換本次商品或服裝。服飾電商可分別上傳人物參考與商品參考,交代兩張圖的用途,並核對領口、袖長、口袋、印花與扣件。不要同時要求換裝與原本服裝完全不變,也不能把生成效果當成實際尺寸量測。
Q3:主參考圖可以直接當作短影音的起始畫面嗎?
主參考圖主要用來確認人物外觀;短影音起始畫面還要安排場景、景別、站位與動作空間。若工具提供角色參考欄,就放主參考圖;首幀欄則放已確認的單一場景起始畫面。只有頭像時,先補齊全身造型資料;可生成的秒數與欄位以工具實際支援為準。