AI 生圖不是「你想什麼,它就畫什麼」。它比較像一個手很快、風格感很好、卻不看規格書的插畫師:你給氛圍,它交得又快又漂亮;你給規格,它會用同樣的自信畫錯。
先記住這一句:它擅長「風格與氛圍」,不擅長「精確與一致」。
多數人用得挫折,不是指令下得不夠好,而是把它用在它不擅長的地方:要它把中文字寫對、要同一個角色在多張圖裡長得一樣、要它照著「左邊站三個人」排位置。這些再怎麼調描述都不會好多少。
這篇只談判斷,不比較產品;要選工具、要更細的指令寫法,看AI 繪圖工具比較與教學。
它擅長什麼:驗收標準是「感覺對不對」的那些圖
可以放心交給 AI 的大致是這幾類:
- 氛圍圖與情境圖:文章開頭、電子報、活動宣傳要的那張「意思到了」的圖。
- 背景與底圖:材質、漸層、抽象紋理,或要留白給文字的版面。
- 概念示意:抽象題目要一個視覺代表,像「資料流動」「決策分歧」。
- 風格化插畫:手繪感、水彩、扁平風這類不追求寫實的畫面。
- 社群配圖與簡報意象圖:量大、壽命短、看過就滑掉的那種。
共同點是:驗收標準是「感覺對不對」,不是「有沒有錯」。 沒有標準答案,也不會有人拿它去對規格;在這個區間,AI 確實比你自己翻圖庫快。
它不擅長什麼:這四種硬要只會浪費時間
一、圖裡的文字,尤其是中文
模型是在「畫」字的形狀,不是在「排」字。它生得出很像中文的東西,卻不見得是你要的那幾個字;就算某次拼對,也只是那次對。做法只有一個:圖歸圖,字歸字。 讓 AI 生沒有文字的畫面,字用排版工具壓上去。這不是退而求其次,就是正解。
二、一致性:同一個角色出現在多張圖
做四格漫畫或品牌吉祥物時,你會發現同一段描述生出來的人,臉會變、衣服細節會變、連年紀都會變。模型每次生成基本上是重畫一次,不是延續上一張。有些做法能提高相似度,但「提高」跟「一致」是兩件事——需要真正一致的角色,是設計工作,不是生圖工作。
三、精確的數量與空間關係
「三個人站在左邊、兩隻貓在右邊」,生出來常常是四個人,貓還跑到中間;手指數量不對也是同一類問題。這不是你描述得不夠清楚,而是這類條件對模型而言更像參考意見,不是硬規則。數量或位置若是這張圖的重點,就別用生圖解決。
四、需要正確的專業細節
醫療器械、儀表板、機械結構、人體解剖、品牌標誌——AI 都生得出「很像」的版本。而「很像但不對」比「一看就是假的」更危險,因為它騙得過不熟的人。判準是:這張圖被內行人看到,錯了會不會有後果? 會的話,不要用。
怎麼描述才有用:三個原則
模板會過期,原則不會。
一、講「畫面上有什麼」,不要講「這張圖的感覺」。 「一張很有質感的圖」對模型幾乎沒有資訊量;改成「木質桌面、攤開的筆記本、一杯冒著熱氣的咖啡、清晨側光」,它才知道要畫什麼。
二、主體、環境、視角、光線、風格,各給一點。 不必每個都寫長,但都給一點畫面才會收斂:只寫主體,環境就隨機;只寫風格,構圖就亂。
三、不要一次改十個地方。 第一版不滿意時最常見的錯誤是整段重寫,這樣你永遠不知道是哪一句起了作用。一次只改一件事:先固定構圖,再調光線,最後才換風格。這跟提示詞入門的邏輯一樣,只是生圖看得更明顯。
動手前該知道的三個界線
一、商用之前,先看工具的條款
「生得出來」跟「能拿去賣」是兩件事。不少服務的免費方案明文限定個人、非商業使用,你拿去做客戶的案子就是違約。這一層五分鐘查得完,卻最多人跳過。判斷框架看這篇:AI 做的東西,我可以拿來賣嗎。
二、不要指名模仿在世的創作者
「用某某插畫家的風格畫一張」——這是所有用法裡風險最高的一種。想要那種質感,就描述質感本身:筆觸、色調、線條、光線。效果一樣好,風險差一整個級距。
三、不要生成真實人物的臉
尤其不要生成「看起來像真的發生過」的內容。政治人物、藝人、你的同事,都一樣。這不只是版權問題,還牽涉肖像權、名譽,甚至刑責。做得到,不等於可以做。
我要下的判斷
AI 生圖最好的用法,是取代你原本要去圖庫翻的那些圖,不是取代設計師。
過去要一張「意思到了」的配圖,你得在圖庫翻半天,最後還常常撞圖。這一段確實被取代了,而且取代得徹底。
但需要精確、需要一致、需要有人負責的視覺,還是得人做。品牌主視覺、產品說明圖、包裝,任何印出來會被指著說「這裡錯了」的東西,我不建議交給生圖。不是做不出來,而是出錯時沒有人能解釋為什麼,而客戶要的正是有人能解釋。
誠實的保留
- 這條界線會移動。 上面說的「不擅長」是現在的狀態,用之前自己測一次,比相信任何教學(含這篇)可靠。
- 生圖跟看圖是兩回事。 讓 AI 讀懂一張既有的圖是另一組能力,可看多模態 AI 是什麼。
常見問題
AI 生的圖可以商用嗎?
不能一概而論,關鍵在你用的工具方案怎麼寫——免費方案限定個人、非商業用途很常見。除了條款,還要看產出跟既有作品像不像。完整框架另有一篇:AI 做的東西,我可以拿來賣嗎。
為什麼 AI 生圖老是把中文字寫錯?
因為它是在畫字的形狀,不是在排字。對模型來說,那幾筆跟旁邊的樹葉、磚牆沒差別,所以會生出「很像中文」卻不是你要的字。務實做法是讓它生沒有文字的畫面,字另外壓上去。
怎麼讓同一個角色出現在多張圖裡都長一樣?
目前只能提高相似度,很難真正一致——每次生成基本上是重畫一次,不是延續上一張。如果角色一致正是案子的核心需求,例如繪本或品牌吉祥物,務實做法是把它當設計工作處理。
AI 生圖會取代設計師嗎?
會被取代的是「去圖庫找一張還可以的圖」這個動作,不是設計本身。需要精確、需要跨圖一致、需要有人負責的視覺,仍然得人做——出錯時客戶要的是有人能解釋,這件事生圖給不了。