影像生成 · 行為
同一句提示詞,不同的圖。每一次都是。

你終於抽到了滿意的那張。為了再要一個尺寸,你把提示詞又跑了一次,結果來的是另一張:杯子不一樣,光線不一樣,氛圍也不一樣。你輸入的內容一個字都沒改。
這是剛開始做影像生成的人最常遇到的意外,而且它並不是故障。為了準確呈現到底能差多少,我們在 2026年9月21日把同一句提示詞連續跑了三次,什麼都沒改。結果就在下面,其中一次還抓到了一件你在發布任何東西之前都該知道的事。
三次執行
一句提示詞,分三次分別送出,模型相同、設定相同:黃昏金光下,一只外帶咖啡杯放在飽經風霜的港口桌面上,背後的船隻失焦。
先別看光線與構圖那些明顯差異,去讀杯子。提示詞裡完全沒有提到任何文字。可是三次執行都替它印上了不同的標語:先是「Better Days Ahead」,接著是「Better Days Brewing」,再來是「Good Coffee Brighter Days」。
這才是真正影響生意的地方。生成器會自己編出你沒要過的品牌,而且每次編的都不一樣。如果你不讀圖就發布,你發的其實是別人腦中那家虛構的咖啡館。

為什麼會這樣
影像模型並不是去檢索你的提示詞、再把對應的那張圖取回來。它從雜訊開始,一步步把雜訊去掉,朝著符合你描述的方向修正。每一次的起始雜訊都不同,所以路徑不同,終點也就不同。
你的提示詞是限制條件,不是座標。「溫暖而吸引人」排除掉了海量的圖,卻仍然留下數百萬種可能。其中每一種都是對你所提要求的合理答案。
描述用盡的地方,模型會拿一個看起來合理的東西把空缺補上。你沒規定杯子上寫什麼,於是它寫了點什麼。你留白的每一處細節,它都會這樣繼續補下去。
當你需要第二次時該改什麼
你沒辦法叫取樣器不要取樣。你能做的,是把你在意的那幾個部分移出生成器,交給你自己能控制的東西。

去編輯,不要重新生成
這是最省時間、也最不容易被想到的習慣。如果你喜歡某張圖、又想改一點,那就編輯那張圖。不要把提示詞重寫一次再跑。
編輯是從你已有的像素出發的,所以凡是你沒要求改的地方都會原樣留著。重新生成則是從雜訊重新開始,一切又回到了抽籤狀態。
整組素材也一樣。如果你需要四則看起來像一家人的貼文,先生成一則,再把它當參考圖傳給另外三則。這時模型比對的是一個具體的東西,而不是在揣摩一個形容詞。
用畫布上那張圖,只改杯子:把上面所有文字去掉,讓表面保持素面。桌子、光線、船隻與構圖全部原樣保留,一點都別動。發布任何東西之前該做的檢查
把圖裡出現的每一個字都讀一遍。不是你接下來要寫的貼文文案,而是生成器畫進去的那些字。
接著檢查描述留白、而顧客一定會注意到的地方:件數、包裝顏色、手上的手指數對不對、背景招牌上有沒有寫著什麼。
這只要十五秒,卻能抓住編出來的標語、編出來的獎項和編出來的價格。這些東西都不在你的提示詞裡,而這正是它們容易被漏掉的原因。
| 會變的東西 | 變多少 | 你最好的施力點 |
|---|---|---|
| 圖裡的任何文字 | 每次都完全改變 | 留出空位,文字自己排 |
| 光線、角度與背景 | 變很多 | 一張參考圖 |
| 主體的形狀與材質 | 變得很明顯 | 參考圖,或者改成編輯而不是重新生成 |
| 整體風格與氛圍 | 如果提示詞夠具體就只變一點 | 風格用詞要精確,而且每次保持一致 |
| 畫面比例與尺寸 | 完全不變 | 設定,這部分本來就歸你管 |
當這種隨機正是你要的
值得記住的是,正是這種行為讓這個工具在一項工作剛開始時特別好用。如果你還不知道海報該長什麼樣,那麼針對同一份需求給出四個不同答案,恰恰就是你想要的,而且挑選比描述更快。
挫折感只會在之後出現,也就是你已經定案之後。所以把兩個階段區別對待:還在挑的時候就放開了生成,定案之後就停止生成,開始編輯你選中的那一張。
那些輸出很穩定的團隊並沒有什麼祕密提示詞。他們只生成一次,然後以第一張結果為基礎,去編輯、去當參考,做完後面所有東西。
關於可重現性的問題
我能設定隨機種子來再得到同一張圖嗎?
在 Ciyo 的畫布裡不行。實際可用的替代做法是:編輯你已有的那張圖,並把它當參考圖傳給所有需要與之相符的內容。
它為什麼在我的產品上寫了字?
因為你沒說那裡該寫什麼,而模型會拿看起來合理的東西填補空缺。在我們的三次執行裡,它每次都編了一句不同的標語。
提示詞寫得更長會更可重現嗎?
只會縮小範圍,不會把它關死。寫細有用,但描述永遠成不了規格:凡是你留白的地方,仍然是別人替你決定的。
一整檔活動都該用同一句提示詞嗎?
不該。先生成第一件,再把它當參考圖用在其餘素材上。比對一張圖,比比對一段文字可靠得多。
生成一次,然後去編輯
先做出第一張並留好,其餘的都從這張出發去搭,而不是從提示詞出發。