# 我做了一個專門反推人像的 Skill，但它不負責 1:1 復刻

> 📖 本站完整內容索引（documentation index）：[llms.txt](/llms.txt)

> 原作者：南鸢 nuyoah (@nanyuan0412) · 策展與摘要：EasyVibeCoding · 平台：X (Twitter) · 熱度：🔥🔥 · 日期：2026-07-27

> 原始來源：https://x.com/nanyuan0412/status/2081348351405232536

## 中文摘要

# 我做了一個專門反推人像的 Skill，但它不負責 1:1 復刻

先把這個 Skill 的定位說清楚：

它重點做的是人像圖片反推。

而且我在反推邏輯裡，加入了自己對人像構圖、臉部可見性、視線、姿態、光線和質感的審美判斷。

所以它不是在完全反推原作者到底寫過哪一段 Prompt，也不負責把參考圖 1:1 完全複製出來。

它真正要做的，是把一張人像裡值得保留的視覺關係，重新翻譯成一份中文可讀、可以修改、能夠繼續生圖的提示詞。

先看第一組效果：

![兩張古風奇幻造型的女性肖像照，帶有夢幻的羽毛與精緻頭飾特效](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/31023068dc680c4e.jpg)

<details class="chart-data"><summary>展開畫面重點</summary><div class="me-note">兩張直幅照片並排呈現古風仙幻風格的女性寫真，畫面皆帶有柔焦光暈、飄散的羽毛與精緻的頭飾，整體色調偏向清冷唯美的藍白色系。</div></details>

本組完整反推詞：

```markdown
生成一張3:4豎幅的寫實真人角色化仙幻古風近景攝影，採用冷白高曝光美顏與強逆光柔焦光暈：面部局部冷白高亮、皮膚微對比降低但五官仍然清楚，畫面邊緣、羽毛、銀飾和水晶高光接近溢出，暗部帶冷藍灰色霧化，不要畫成動漫插畫。人物臉部中心略偏畫面右側，頭部接近上邊緣，高聳髮髻和複雜頭冠在頂部局部裁切，畫面下方展示到胸肩附近；鏡頭接近眼睛高度，臉部近乎正對鏡頭。大面積半透明白色羽毛和淺冰藍飄帶從畫面左側、左上方及下方前景進入，橫跨畫面中部，在額頭和眼睛上方形成柔焦遮擋；畫面左側前景面積更大、更模糊，只在中央偏右留下清晰臉部視窗。年輕女性擁有小巧鵝蛋臉、淺中性象牙膚色、淺色細眉、深色大眼睛、黑色纖長上眼線、粉棕眼影、窄而柔和的鼻梁和水潤珊瑚紅嘴唇；雙眼虹膜接近眼裂中央，近似直視鏡頭，不強化向畫面左側或畫面右側的側視線。上眼瞼輕微下壓，眉毛放鬆，嘴唇微微張開但不露齒，神情安靜、疏離而神秘。長直黑髮披落在肩頸兩側，數縷髮絲被風吹起並橫過額頭、鼻梁、臉頰和嘴唇；頭頂盤成高聳髮髻，佩戴大體量銀色鏤空冠飾，包含花形、蝶形、捲曲金屬枝條、透明冰晶裝飾和白色羽毛，大量細銀鏈、珠串、小型花飾及水滴墜件從頭冠兩側垂下，額頭中央懸掛一枚帶藍色寶石和透明水滴飾件的細鏈。畫面右側一隻手從右邊緣進入，位於肩部附近，掌心向上，手指並攏並略微彎曲，向畫面中部延伸，不托住明確物件。人物穿寬鬆層疊的冷白色和淺冰藍色古風長袍，肩部、袖口和胸前由半透明雪紡、歐根紗、羽毛邊緣和柔軟飄帶組成，並裝飾銀色浮雕花紋、珠鏈、金屬墜飾與透明水晶。強光從畫面右上方和後方照入，在畫面右側髮絲、頭冠、羽毛和銀鏈上形成白金色輪廓光，面部由冷白柔光均勻提亮，眼窩、鼻側和頭髮內部保留藍灰柔軟陰影；背景只保留高度虛化的藍灰、乳白和少量暖灰色塊，不出現清晰建築或家具。雙眼、鼻梁、嘴唇和面部髮絲相對最清晰，頭冠及銀鏈保持中等細節，橫跨鏡頭的前景羽毛、畫面左側遮擋和背景高度虛化，產生柔焦光暈、擴散高光和輕微拖影。避免把人物移到畫面左側，避免前景羽毛消失，避免頭冠和垂鏈被簡化，避免改成清晰硬銳的棚拍肖像，避免強烈左右側視線、誇張微笑、閉嘴、露齒、多餘手指、額外手掌、動漫臉和卡通羽毛。畫面右下角增加藝術性手寫文字「nuyoah」作為署名。
```

這組最值得看的，不是人物長得像不像。

真正決定原圖氣質的，是橫在鏡頭前的大面積羽毛、被遮擋後留下的臉部清晰視窗、頂部被裁切的複雜頭冠，以及接近溢出的冷白逆光。

如果只反推出「仙氣古風美女、藍白配色、華麗頭飾」，模型大概率會給你一張乾淨、端正、很像影樓樣片的古風寫真。

它可能依然漂亮，但原圖裡最重要的空間層次已經沒了。

所以我在 Skill 裡給這些關係排了優先級。

臉要從哪裡露出來，前景遮擋從哪裡進入，頭冠為什麼不能被縮成一團銀色裝飾，哪些地方要清楚，哪些地方必須虛掉，這些都比「精緻、華麗、高級」更能控制畫面。

返圖當然沒有逐件複製原圖裡的頭飾。

但它保住了冷白仙幻世界、銀色垂鏈、前景羽毛、臉部視窗和強逆光。這就是我想要的反推結果：不是複製每一顆珠子，而是保住這張圖成立的視覺結構。

## 它不是在猜原 Prompt，而是在重新組織畫面

很多人說的圖片反推，其實只是看圖列關鍵詞。

古風、柔焦、逆光、淺景深、夢幻、高級感。

這些詞沒有錯，但它們很難告訴模型：人應該站在哪裡，眼睛在看什麼，哪隻手碰到了哪個物件，什麼東西擋在鏡頭前面，以及背景為什麼不能變成另一種構圖。

我做這個 Skill 時，重點處理的是下面這些東西：

- 圖片真實畫幅和構圖，不只憑感覺猜一個比例；

- 人物在畫面中的位置、佔比、裁切與臉部可見範圍；

- 虹膜方向、眼白分佈、眼瞼壓力和嘴唇狀態；

- 手臂從哪裡進入，手指碰到什麼，人物和道具怎樣連接；

- 固有顏色、現場光線、曝光處理和後期質感之間的區別；

- 哪些關係必須優先執行，哪些裝飾允許模型自由發揮。

最後才把這些結構重新組織成一條連續的中文 Prompt。

這裡面確實帶著我的個人審美。

比如複雜人像裡，我會把臉部可見性、構圖裁切、關鍵動作和接觸關係放在裝飾數量前面。

因為一張圖少了幾個飾品，可能依然成立。

但人物位置錯了、視線反了、手和道具的關係斷了，整個畫面就會變成另一張圖。

這也是為什麼我不願意把它宣傳成「原 Prompt 恢復器」。

一張已經生成出來的圖片，不可能告訴我們原作者當時究竟寫過什麼、刪過什麼、用過什麼參考圖，又經歷過多少輪選擇。

我們能做的，是從眼前真實看得見的證據出發，重新搭建一條儘量高還原、同時適合繼續生成的指令。

## 我一開始，恨不得把人物的每一個元素都鎖死

剛開始做人像反推時，我瘋狂追求的就是完全復刻。

人物的臉要朝哪個方向，眼睛看哪裡，兩隻手分別放在什麼位置，每根手指怎麼彎，物品離臉頰有多遠，我恨不得全部控制住。

我當時的想法也很簡單：

只要描述得足夠細，模型就應該把參考圖完整還原出來。

結果卻是，Prompt 越寫越滿，人物反而越容易變得僵硬。

有時候臉和視線對了，手指卻開始打架。有時候兩隻手的位置都寫到了，手臂和身體的連接又變得很奇怪。

後來我才想通，人像生成不是描圖。

當我要求模型同時固定臉、眼睛、肩膀、手臂、手掌、手指和道具的位置時，這些控制項並不會自動組成一個自然的人。

它們反而可能互相搶權重，最後每一個局部都像執行了要求，連在一起卻不像真實的肢體。

所以現在做人像反推，我會主動放開一部分控制。

我不再要求每一根手指、每一個角度都必須和原圖一模一樣，而是先把人物與道具之間真正重要的關係說清楚，再給模型留下自己組織姿態的空間。

這組草莓人像就是一個很直接的例子。

這一次，我乾脆讓模型自己理解人物與草莓之間的互動，不再追著原圖把每一個肢體細節逐項釘死。

![一位留著深色微捲髮、身穿白色蕾絲邊細肩帶上衣的年輕女性，雙手各拿一顆草莓置於臉頰兩側的特寫照片。](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/cf640ffda68ec5bf.jpg)

<details class="chart-data"><summary>展開畫面重點</summary><div class="me-note">這是一張雙聯排版的照片，左右兩側均為同一位黑髮挽起、別著紅色髮夾的年輕女性，身穿白色蕾絲上衣，雙手拿著新鮮草莓對著鏡頭擺出俏皮可愛的姿態。畫面風格柔和明亮。</div></details>

▲ 左：參考圖｜右：使用反推詞生成的圖片

本組完整反推詞：

```markdown
生成一張1:1方形的寫實真人角色化近景攝影，採用奶油暖白高鍵柔焦美顏，整體曝光明亮、陰影輕淺，皮膚微對比明顯降低但眼睛、嘴唇、草莓和指尖保持清楚，呈甜美日系室內寫真與輕微洋娃娃感，不要畫成動漫插畫。鏡頭接近人物眼睛高度，年輕女性正面居中坐在畫面中部，頭部和上半身佔畫面約八成，頭髮貼近上邊緣，雙肩在下方裁切，一條彎曲的膝蓋從畫面下方進入並遮擋下半身。人物擁有小巧鵝蛋臉、淺暖象牙膚色、深色大眼睛、自然細眉、淡粉眼影、纖細眼線、臉頰與鼻尖的淡粉紅暈，以及閉合放鬆的水潤淺粉色嘴唇。關鍵視線關係：雙眼瞳孔共同偏向觀者畫面左側，視線明確落在畫面左側、由指尖托起且與臉頰稍有間隔的那顆草莓上；這顆草莓位於人物自身右側、觀者畫面左側。不要直視鏡頭，不要看向畫面右側輕貼臉頰的另一顆草莓。雙手從畫面下部進入並在下巴前自然交疊，兩根食指分別向左右上方伸出，各自托起一顆鮮紅草莓；畫面左側食指斜向左上，草莓與臉頰留有少量距離，畫面右側食指接近豎直，另一顆草莓輕靠右側臉頰但不壓陷皮膚，其餘手指自然彎曲聚攏，手腕部分被抬起的膝蓋遮擋。深黑棕色頭髮自然中分，額前留有幾縷細長碎髮，頭髮在腦後和畫面右側盤成蓬鬆凌亂的低髮髻，耳側留有散落髮絲；畫面左側太陽穴附近夾一枚酒紅色細長蝴蝶結髮夾。人物穿白色細肩帶蕾絲上衣，肩帶和領口帶細小荷葉邊及輕微半透明網紗質感。柔和自然光從畫面左前方經過淺色窗簾擴散，均勻照亮面部，在畫面右側頭髮和頸部留下很淺的暖色陰影；背景以奶油白窗簾為主，畫面右後方保留模糊鮮紅色靠墊或毯子，右下角進入一小塊明黃色柔軟色塊。皮膚呈瓷偶般平滑的數位美顏質感，鼻梁、臉頰和肩部高光柔潤擴散，嘴唇與草莓保留水潤反光和草莓籽粒細節；眼睛、嘴唇、兩顆草莓和指尖最清晰，頭髮邊緣逐漸柔化，背景高度虛化。避免視線方向反轉、雙眼看向不同目標、直視鏡頭、兩顆草莓位置互換、草莓壓入臉頰、手指畸形、多餘手指、丟失抬起的膝蓋、髮髻移到畫面左側、動漫插畫感、冷白過曝、硬銳化和強烈棚拍陰影。畫面右下角增加藝術性手寫文字「nuyoah」作為署名。
```

你會發現，返圖沒有把人物拉回那個標準的正臉直視鏡頭。

她的視線自然落在手中的草莓上，雙手和草莓之間也形成了更明確的互動。

具體的手指角度、臉部表情和身體細節沒有照著參考圖一項項複製，但整個人反而更鬆弛，肢體連接也更自然。

這就是我後來找到的平衡：

我仍然會觀察畫面裡真實存在的關係，但不再要求生成結果把每一個元素釘死在原位。

完整反推詞之所以還會記錄視線、草莓、雙手和膝蓋，不是為了讓模型像描圖一樣逐點復刻。

它是在告訴模型，這張圖裡真正不能丟的是「人物正在和草莓發生互動」，而不是「一個女孩拿著兩個紅色道具，固定直視鏡頭」。

至於眼神能不能更自然，手指怎樣彎才符合身體結構，表情是更呆一點還是更鬆弛一點，我願意把這部分空間還給模型。

以前我會把這種差異當成「不夠還原」。

現在我更在意的是：它有沒有保住原圖成立的關係，同時生成一個自然的人。

這也是這個 Skill 加入個人審美後，和純粹追求 1:1 復刻最不一樣的地方。

## 一張生活照，不能只反推「青綠色復古感」

第三組是我很喜歡的一類人像。

它沒有複雜頭冠，也沒有明確的棚拍佈光，就是一個女孩趴在凌亂的床上，窗邊透進青綠色的光，旁邊散著紙卡和水果。

![一名短髮女子俯臥在鋪有淺色床單的床上，身旁散落著檸檬切片與畫作](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/96cb737896e18df6.jpg)

<details class="chart-data"><summary>展開畫面重點</summary><div class="me-note">這是一張以懷舊色調呈現的寫真照拼貼，畫面中有一名短髮女子俯臥在鋪著淺綠色床單與棉被的床上，雙腿曲起。左側畫面中，女子手托著下巴側頭凝視前方，前方擺放著一袋切開的檸檬、數顆青檸以及幾張帶有花卉圖案的手繪卡片；右側畫面則呈現女子向前注視的另一個角度，右下角可見一串英文草寫字樣浮水印。室內光線柔和，背景為帶有復古風格的壁紙與窗戶。</div></details>

▲ 左：參考圖｜右：使用反推詞生成的圖片

本組完整反推詞：

```markdown
青綠色偏色、低對比柔霧質感的寫實真人生活方式人像攝影，窗邊局部高曝光，室內暗部被淺青綠色環境光抬起，畫面帶輕微柔焦、細小顆粒和舊式數位照片般的壓縮感，臉部與交疊雙手清晰，衣物和前景水果保持中等細節，雙腳、牆面與窗邊背景逐級柔化。採用 2:3 豎幅、近距離高位斜俯拍和明顯傾斜取景，約 28–35mm 廣角感，一名短黑髮成年女性俯臥在鋪滿淺藍綠色碎花被褥的床上，臉部位於畫面左下三分之一，身體沿對角線向畫面上方延伸，右側床鋪與近距離水果袋形成更大的前景視覺重量，上方保留斑駁牆面、鏡子和明亮窗戶。人物為淺象牙色暖粉膚調，短黑髮自然蓬鬆微亂，額前和面頰旁垂落不規則碎髮，眉眼纖細，眼線輕微向外延伸，珊瑚紅嘴唇自然閉合；雙眼睜開，虹膜偏向畫面左側，畫面右側露出更多眼白，視線落向畫面左下方外側，不看鏡頭，眉部和上眼瞼放鬆，呈現安靜走神、略帶倦意的表情。雙臂在臉部下方交錯，一隻前臂橫置於畫面下部，另一隻手五指並攏橫搭在上臂外側，手背靠近下顎；雙膝彎曲，小腿向上抬起，兩隻裸足在畫面上方中央靠近並輕微交疊，保持清楚自然的肢體連接。頸側和畫面左側肩部附近繫一枚深藍黑色格紋大蝴蝶結，上身穿深色貼身衣物，身體中後段覆蓋柔軟寬鬆的復古混合花卉印花面料。臥室牆面為斑駁磨損的淺灰綠色，畫面左上懸掛深色邊框的不規則多邊形小鏡子，右上明亮窗戶覆蓋輕薄窗簾，柔和自然光從右上方斜射進入，在臉部、手臂和床褥上形成淺青色高光；床邊放置淺色圓柱靠枕，畫面右側散落幾張帶彩色花朵和塗鴉圖形的紙卡，不要求具體文字，右下近景透明袋中放有黃色檸檬切片和綠色圓形水果。避免把人物改成坐姿或正面直視鏡頭，避免水平端正的商業構圖、整潔現代臥室、過度美顏銳化、丟失抬起雙腿與交疊雙臂的空間關係，以及多餘手腳或錯誤肢體連接。畫面右下角增加藝術性手寫文字「nuyoah」作為署名。
```

如果只寫「青綠色復古臥室人像」，模型很容易抓到顏色，卻丟掉原圖的現場感。

這張圖的關鍵，是高位斜俯拍、明顯傾斜的畫面、人物從左下向上延伸的身體對角線，以及右側床鋪和水果袋形成的前景重量。

人物不是坐在床上擺姿態。

她趴在床上，雙臂交錯，雙膝彎曲，兩隻腳抬到畫面上方。窗戶、牆面和鏡子也不是背景清單，它們共同建立了一個有生活痕跡的舊臥室。

返圖保住了青綠色偏色、傾斜構圖、短髮女性、床鋪、抬腿和檸檬前景。

但它也改了不少東西。

人物更靠左，身體更完整，手臂的交疊方式與參考圖不同，右側紙卡和水果被簡化，原圖那種近距離壓進鏡頭的感覺也弱了一點。

這也正是我反推的特點，重點只放在了人像方面，其餘方面不做詳細的描述。

## 提示詞明明寫到了，模型為什麼還是把人擺正？

最後一組，正好能說明這套 Skill 的邊界。

![同一位漢服人像的左右對照：左為參考照，右為以反推詞生成的圖](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/3e56344a51f145ba.jpg)

<details class="chart-data"><summary>展開畫面重點</summary><div class="me-note">這是一張左右對照圖，兩側為同一位身穿中國傳統古裝、頭戴華麗藍色花朵與金飾頭飾的女性半身寫真，背景為模糊的燈光夜景；左為參考照、右為以反推詞生成的圖，右下角有手寫署名浮水印。</div></details>

▲ 左：參考圖｜右：使用反推詞生成的圖片

本組完整反推詞：

```markdown
冷白高曝光美顏疊加暖金夜景散景的寫實真人中式古典漢服舞台人像攝影，面部局部冷白提亮、皮膚微對比降低、高光柔潤接近溢出，但雙眼、眉形、鼻梁、紅唇和臉部輪廓保持清晰；背景維持低曝光，以黑褐暗部、暖金光帶、金黃暖白圓形散景和少量紅色點光形成強烈冷暖分離。採用 2:3 豎幅、平視中近景和約 70–85mm 中長焦壓縮感，淺景深，人物佔畫面約七成，巨大藍色花冠與黑色盤發集中在上方偏左，冷白面部和胸前手勢位於中部，淺黃色與薄荷青色衣料從畫面下方中央向右下方展開，構成左上至右下的對角線動勢。一名古典妝容的成年女性，淺象牙色暖粉膚調，臉型小巧柔和，黑色細眉、杏仁眼、深色眼線與紅色漸變唇妝，額頭中央貼藍色花形裝飾，一縷細黑髮斜跨鼻梁和面頰；虹膜接近眼裂中央，基本直視鏡頭，上眼瞼輕微下壓，嘴唇自然合攏，神情安靜矜持、略帶疏離。人物身體大致正對鏡頭並略微側轉，頭部向畫面左側傾斜，一隻手位於胸前，手指收攏並輕輕捏住淺黃色衣料，指尖靠近鎖骨下方；另一隻手從畫面下方偏中向鏡頭方向伸出，抓住薄荷青色衣料，前景手因淺景深明顯虛化，衣料隨手勢向畫面右側展開。黑色頭髮盤成寬而飽滿的古典環形髮髻，左右分佈多個圓潤髮團；頭頂偏畫面左側固定一朵巨大的藍色織物花，花瓣邊緣帶銀白褶皺，周圍搭配小型藍花與金色網紗。髮際線上方設置橫向金色冠飾，下方垂落多排結構清楚的細金鏈、藍紅珠串和金色流蘇，耳側配細長金色簪墜、珍珠耳飾和垂鏈，保留「大花冠輪廓、金色額飾橫軸、密集垂墜流蘇」的三層造型結構。上身內層穿貼身金黃色織錦抹胸式衣片，外披寬鬆青藍色半透明花卉紋長袖紗袍，胸前與手中疊加帶淡金紋樣的淺黃色薄紗，畫面下部鋪開薄荷青色柔軟衣料；金屬、珠鏈、寶石和珍珠高光清楚，織物保持輕薄透光和柔軟飄動。偏冷主光從畫面左前上方照亮面部、頸部和胸前手，暖金環境光勾亮頭飾、髮絲與衣料邊緣；面部、雙眼、額頭花鈿和冠飾前緣最清晰，藍色花冠、胸前手與上身衣紋保持中等細節，前景手、下方衣料和背景逐級柔化。避免動漫插畫感、普通現代髮型、頭飾縮小或融成無結構裝飾、流蘇缺失、前景手被強行銳化、雙手歸屬混亂、衣料失去右下展開動勢，以及面部過曝到五官消失。畫面右下角增加藝術性手寫文字「nuyoah」作為署名。
```

把兩張圖放在一起，問題很明顯。

返圖的人物更正、更居中，頭部向畫面左側傾斜的幅度減弱了。原圖背景裡幾條橫向穿過畫面的金色光帶，也被簡化成更普通的夜景散景。

可這些資訊並不是沒有寫進 Prompt。

裡面明確寫了：

> 人物佔畫面約七成。

> 巨大藍色花冠與黑色盤發集中在上方偏左。

> 頭部向畫面左側傾斜。

> 淺黃色與薄荷青色衣料從畫面下方中央向右下方展開，構成左上至右下的對角線動勢。

> 背景維持低曝光，以黑褐暗部、暖金光帶、金黃暖白圓形散景和少量紅色點光形成強烈冷暖分離。

也就是說，反推階段已經觀察到了傾斜、對角線和橫向光帶。

圖像模型在生成時，仍然把它們改寫成了更常見、更穩定的人像構圖。

這種偏差不能全部甩給 Prompt，也不能全部歸因於模型。

實際判斷時，我會把問題分成三種：

- 第一種，反推時根本沒有觀察到；

- 第二種，觀察到了，但空間關係寫得太靠後、太含糊，權重不夠；

- 第三種，Prompt 已經表達清楚，圖像模型仍然因為構圖先驗、隨機性或能力邊界而簡化。

這一組更接近第三種，同時也說明第二種仍有繼續優化的空間。

如果下一輪只追加一長串「不要居中、不要正面、不要減弱傾斜」，未必能解決。

更有效的做法，是把頭部傾斜、人物偏位、左上到右下的身體和衣料動勢提前，合併成一條更強的非對稱空間骨架，再減少與它競爭的裝飾細節。

但即使這樣，也不能承諾下一張就會 1:1 回到原圖。

這就是我想公開寫出來的邊界：提示詞寫到了，不等於模型一定會做到。 所以一組提示詞，質感不行的時候嘗試新開對話視窗多生成幾次，不要只生成一次就放棄了

## 為什麼我目前最推薦搭配 GPT‑5.6 sol

這套 Skill 換其他能看圖、能執行 Agent Skill 的模型，也可以用。

但在我目前的工作流裡，我最推薦搭配 GPT‑5.6 sol （畢竟我一切都是基於 GPT 來開發的）。

原因不是它會自動給圖片加一層「高級感」，而是它更適合處理人像反推裡那些彼此關聯、又很容易寫亂的關係。

比如：

- 人物位置、臉部朝向和虹膜方向要分開判斷；

- 畫面左、畫面右要統一使用觀者座標；

- 手、草莓、臉頰和膝蓋之間的接觸與遮擋不能寫斷；

- 高曝光、冷白主光、暖金環境光和後期柔焦不是同一層；

- 複雜頭飾不能搶在臉部視窗和關鍵動作前面；

- 完整 Prompt 不能偷偷加入圖片裡沒有證據的品牌、身份和文化出處。

GPT‑5.6 sol 更適合承接這套高資訊密度的中文規則，先看懂關係，再組織成能直接生圖的表達。

它也可以在同一條工作流裡繼續檢查欄位有沒有漏掉、呼叫生圖、比較參考圖和返圖，少掉很多來回複製貼上。

但這裡要區分兩個環節。

GPT‑5.6 sol 負責的是看圖、推理、組織反推詞和執行工作流；最終像素仍然由實際呼叫的圖像生成模型完成。

所以我說「搭配效果最好」，說的是我當前這套 Skill 和實際使用流程中的判斷。

它不是跨所有模型的統一排行榜，也不代表 GPT‑5.6 sol 能消除圖像生成本身的隨機性。

## 色卡模式，不是給圖片貼幾個好看的色塊

除了結構拆解和完整 Prompt，這個 Skill 還有色卡輸出。

我把它叫作色卡模式，但它不是另一套濾鏡，也不是為了讓結果看起來更專業。

它真正解決的是：我們看到一張圖配色舒服，卻說不清這些顏色之間是什麼關係。

以剛剛那張復古臥室人像為例。

如果只寫「青綠色調」，模型可能把牆、床、皮膚、陰影和窗光全部染成同一種綠。

但原圖真正的配色關係更接近：

- #788B76｜霧青綠色環境基底｜約 45%

- #ACC1B4｜窗邊薄霧與淺色床品｜約 11%

- #282A1F｜頭髮、鏡框和室內深色重心｜約 9%

- #ADA78A｜膚色與復古花布的暖灰中間調｜約 9%

- #D2E2DC｜窗光和床褥的淺青白高光｜約 5%

- #57604B｜牆面、織物褶皺和環境暗綠｜約 5%

大面積霧青綠負責環境，小面積深色負責壓住畫面，淺青白只用在窗光和高光位置，膚色與花布又留了一點暖灰。

這才是色卡值得學習的地方。

它不只是告訴你「圖裡有哪些顏色」，還要告訴你誰是主色、誰負責明暗、誰只是很小比例的跳色。

如果你只想學習構圖、動作和質感，不一定每次都要加色卡。

但如果你的目標是儘量復刻原圖的色彩體系，我建議把完整反推詞和色卡一起交給生圖模型。

這會比只寫「青綠色」「暖金色」「低飽和」多一層明確的顏色約束。

同樣要注意，色卡也不是像素鎖色。

材質、曝光、環境光和圖像模型本身，都會繼續改變顏色。它能幫助你保住配色關係，卻不能承諾最終每一個像素都和原圖完全一致。

## 這套 Skill 到底能做什麼，不能做什麼

為了讓你方便了解，我把邊界直接列出來。

它能做的是：

- 把人像參考圖拆成中文可讀的視覺控制項；

- 提煉畫幅、機位、人物位置、裁切、視線、表情與姿態；

- 識別手勢、道具、接觸、遮擋和前後層次；

- 分開處理光線、曝光、色彩、材質與成像質感；

- 對明顯的美顏、柔焦、顆粒、壓縮和渲染特徵建立成像描述；

- 給出可以直接複製、也方便繼續修改的完整中文 Prompt；

- 在需要時提供參考色卡，幫助學習和約束配色關係。

它不能保證的是：

- 恢復原作者真正寫過的原始 Prompt；

- 讓人物身份、五官和服飾紋樣與參考圖一模一樣；

- 單次生成嚴格執行複雜手勢、非對稱構圖、密集配飾和多人遮擋；

- 從一張圖可靠猜出品牌、相機型號、不可見區域或準確文化出處；

- 自動消除圖像模型的隨機性；

- 替你完成去背、換背景、局部修復和直接改圖。

普通反推也不會自動生圖。

你只說「反推這張圖」時，它交付的是結構拆解、必要的參考色卡和完整 Prompt。

只有你明確要求繼續生成、測試或校準，才會進入返圖和比較環節。

這個邊界很重要。

因為反推和生圖是兩個不同任務。沒有得到授權時，Skill 不應該為了證明自己好用，就擅自改 Prompt、連續重試，或者把隨機生成的一張圖包裝成標準答案。

## 怎麼使用

安裝後，上傳一張參考圖，直接說：

使用南鳶圖片反推拆解這張參考圖，給我參考色卡和可直接生圖的完整中文提示詞。

公開專案地址：

https://github.com/nuyoah-ai-works/nuyoah-image-reverse-prompt

如果你更在意人物結構，可以只要求反推，不加色卡。

如果你特別在意原圖的配色關係，就明確要求「同時輸出參考色卡」，再把色卡和完整 Prompt 一起用於生成。

第一張返圖出來以後，也不要一上來就改十幾個地方。

先只檢查三件事：

- 人物位置、傾斜、裁切和空間骨架有沒有漂；

- 視線、手勢、接觸與遮擋有沒有寫反；

- 主色關係、光線方向和成像質感有沒有變成另一套。

然後判斷問題到底出在觀察、提示詞表達，還是模型邊界。

這個判斷，比繼續往 Prompt 裡堆更多形容詞重要得多。

我做這個 Skill，不是為了替你猜中某一段神秘 Prompt。

我更想做的是：當你看到一張喜歡的人像時，不再只會說「好有氛圍感」，而是能看懂它為什麼成立，並把這種理解變成下一張圖裡可以繼續控制的語言。

它不負責 1:1 複製別人的答案。

它負責幫你建立自己的視覺判斷。

> 感謝你看到這裡。如果覺得有幫助，按讚收藏轉發一下。我們下一篇見。

最後突然想起來，如果有什麼問題歡迎大家回饋哦

## 標籤

Skills, AIGC, OpenAI
