像素畫 · 實測

Claude Opus 5.5 能做像素畫嗎?一隻狐狸,一個像素一個像素地畫

一塊拉絲石墨色洞洞板上,炭黑色和象牙白的插釘排成階梯狀的愛心,一根琥珀色插釘獨自立在象牙白紙上
原創抽象編輯插畫,於 Ciyo 中以 GPT Image 2.5 Sunburst 生成。

Claude Opus 5.5 是語言模型,它不會像圖像模型那樣直接輸出圖片。所以當大家搜尋「Opus 5.5 像素畫」時,真正有用的問題不是它會不會畫畫,而是它能不能做出一張真的能用的角色圖:正確的網格、精簡的色盤、乾淨的邊緣和透明背景。

2026 年 9 月 30 日,我們把同一件小工作分別交給直接使用的 Claude Opus 5.5、Ciyo Agent 和一個圖像模型:為一家虛構的桌遊咖啡館做一隻 32 × 32 的狐狸吉祥物。我們量測了每一個檔案。程式碼路線每一次都給出精確的像素。圖像模型畫得比較好,做出的角色圖卻比較差。

簡短的答案:可以,前提是用程式碼來畫

語言模型做像素畫的方式,就像人在試算表裡做像素畫:決定每一格的顏色。實際上就是一段簡短的腳本,例如用 Python 加上 Pillow 函式庫,在固定網格上設定每個像素,再存成 PNG。因為沒有任何縮放或模糊,網格和色盤從一開始就是精確的。

限制在於繪圖功力。模型必須一列一列地想像形狀,所以姿勢只能保持簡單,小細節也需要再看一次。這就是為什麼下面的測試比一句「能」或「不能」更重要。

用 AI 取得像素畫的兩種方式
比較項目程式碼路線(語言模型放置像素)圖像路線(圖像模型作畫)
網格和尺寸精確:32 × 32 就是 32 × 32一張只是看起來有像素感的大圖
色盤只用你允許的顏色,沒有其他顏色在你減色之前有好幾萬種顏色
透明度只有完全透明或完全不透明的像素通常有一片需要去除的純色背景
繪圖品質形狀簡單,需要檢查姿勢和角色表現比較豐富
我們測試中的點數繪圖不花點數圖片花了 2 點

需求說明:一家桌遊咖啡館的吉祥物

Pip & Pine 是一家虛構的桌遊咖啡館,想要一隻小吉祥物,用在 Discord 表情符號和桌遊之夜的海報上。好的像素畫需求說明會寫明網格大小、顏色上限、外框線、背景和姿勢,也會說明檔案該怎麼做出來。

我們把同一份需求說明交給 Claude Code 裡的 Claude Opus 5.5(只允許使用 Python 和 Pillow),也交給一張新 Ciyo 畫板上的 Ciyo Agent。

兩邊都使用的需求說明(在 Claude Code 中,檔案存到資料夾而不是畫板)
我經營 Pip & Pine,一家桌遊咖啡館。我需要一隻 32x32 的像素畫吉祥物,用在我們的 Discord 表情符號和桌遊之夜海報上:一隻捧著一杯可可的小橘狐狸,面向右方,深色外框線,最多 12 種顏色,透明背景。請你自己一個像素一個像素地畫,不要使用圖像模型:用程式碼把每個像素放在 32x32 的網格上,然後把 1x 的 PNG 和一張 10x 的預覽圖存到畫板上。告訴我你用了哪些顏色。

Claude Opus 5.5 自己畫出了什麼

Claude Opus 5.5 寫了一段 Pillow 腳本,依照一張手工排好的網格設定每個像素。它算圖、檢視結果,並修改了兩次。它自己的紀錄寫著深色手臂「read as a stick」(看起來像一根棍子),所以它把上臂改成橘色,也把尾巴上一個多出來的奶油色像素拿掉。整件工作大約花了 3.6 分鐘。

我們檢查了檔案:32 × 32 像素、11 種顏色、536 個不透明像素,其餘每個像素都完全透明。沒有任何半透明的邊緣像素,這正是角色圖在遊戲引擎或 Discord 裡看起來清晰的原因。它唯一的提醒很誠實:非常淺的灰色蒸氣在淺色背景上很難看清楚。

同一份需求說明在 Ciyo 中

Ciyo Agent 也走同一條路。它說會「draw it by hand in Python: every pixel is set explicitly on a 32×32 grid in layers」(用 Python 手工繪製:每個像素都在 32×32 網格上分圖層明確設定),檢視了第一次的算圖,並因為爪子擋住了杯子上的愛心,把愛心移了位置。它把一個 32 × 32 的檔案和一張 320 × 320 的預覽圖存到畫板上,並以十六進位色碼列出它的 11 種顏色。沒有花任何點數。

我們的檢查結果和它的回報一致:11 種顏色、577 個不透明像素、沒有半透明像素,而 10× 預覽圖剛好是 1× 檔案的十倍大。有一個細節要知道:畫板會把很小的 1× 檔案平滑放大顯示,所以它在畫板上看起來是模糊的。用肉眼判斷時,請看 10× 預覽圖。

Ciyo 畫布上一隻 32 × 32 像素、捧著藍綠色杯子的狐狸,10 倍時清晰、1 倍時模糊,Agent 面板列出 11 種十六進位顏色
Ciyo Agent 手工放置像素的狐狸:清晰的 10× 預覽圖、被畫板放大顯示的 1× 檔案,以及對話中的色盤。2026 年 9 月 30 日。

接著我們請圖像模型畫同一隻狐狸

接下來,我們請 Ciyo Agent 用 GPT Image 2.5 最便宜的設定(2 點)做同一隻狐狸,把它縮成 32 × 32,對齊到同樣的 11 種顏色,再用同一段腳本為兩個版本評分。

原始圖片是 1,024 × 1,024,有純白背景和 45,153 種不同的顏色。它的「像素」是寬約 20 到 23 個螢幕像素的柔邊色塊,大約是 45 × 45 的網格,所以縮成 32 × 32 時會切過它自己的像素邊界。對齊色盤之後,Agent 算出了這樣做的代價:陰影幾乎消失(深橘色從 54 個像素變成 1 個),杯子從 34 個像素縮到 19 個並且沒了把手,外框線斷了 14 處。不過,圖像模型的狐狸姿勢確實比較好,尾巴比較蓬,耳朵也比較清楚。

Ciyo 畫板上,手工放置像素的狐狸和對齊後的圖像模型狐狸以 10 倍並排,右邊是原始 AI 圖片,旁邊是 Agent 列出圖像模型優缺點的清單
兩隻狐狸的 10× 和 1× 版本,右邊是原始 AI 圖片,對話中是 Agent 的評分。
比較用的要求
很好。現在我想比較一下:用圖像模型(GPT Image 2.5,最便宜的設定,正方形)做同一隻狐狸,然後把那張圖轉成真正的 32x32 像素畫,使用同樣的 11 色色盤,放在你的版本旁邊。告訴我圖像模型哪裡做得比較好、哪裡比較差,盡量附上數字(對齊前的顏色數、多餘的像素、外框線缺口)。

三隻狐狸的量測結果

並排之後,差異一眼就看得出來。兩隻程式碼狐狸都是外框線封閉的乾淨角色圖。對齊後的圖像模型狐狸輪廓最好看,像素卻最凌亂。

三個 32 × 32 檔案,2026 年 9 月 30 日檢查
檢查項目Ciyo Agent,程式碼Claude Opus 5.5,程式碼圖像模型,對齊後
顏色數111111(對齊前 45,153)
不透明像素577536525
半透明像素00對齊後 0
外框線除了蒸氣之外都封閉封閉斷了 14 處
點數0未在 Ciyo 中執行2
三隻 32 × 32 像素的狐狸放大 14 倍:Ciyo Agent 手工放置像素的狐狸、Claude Opus 5.5 捧著藍色杯子的狐狸,以及對齊到色盤的圖像模型狐狸
由左至右:Ciyo Agent 手工放置像素的狐狸、Claude Opus 5.5 自己畫的狐狸,以及對齊成 32 × 32 的 GPT Image 2.5 狐狸。全部以 14× 顯示,沒有平滑處理。

該走哪一條路

檔案必須精確時,就走程式碼路線:表情符號、網站圖示、遊戲角色圖,以及任何以實際尺寸顯示的東西。請它提供色盤、透明背景和一張 10× 預覽圖,接受之前先檢查預覽圖。

需要點子時,就用圖像模型:一個姿勢、一張角色表或一種氛圍。然後把結果對齊到真正的網格並修補外框線,或是把最好的姿勢交回程式碼路線當作參考。我們的 Agent 正好主動提出這個做法:參考圖像模型那條比較大的尾巴和奶油色的腳,重畫它的程式碼狐狸,不花任何點數。

吉祥物的下一步

32 × 32 檔案沒問題之後,請在大家實際看到的尺寸下檢查它,讓其他所有圖示共用同一個色盤,並且等靜態畫面乾淨了再做動畫。

Claude Opus 5.5 與像素畫

Claude Opus 5.5 能做像素畫嗎?

可以,方法是寫程式碼放置每一個像素。在我們 2026 年 9 月 30 日的測試中,它大約花 3.6 分鐘做出一隻 32 × 32、11 種顏色、背景完全透明的狐狸。它無法像圖像模型那樣直接畫出一張圖。

程式碼路線比圖像模型好嗎?

如果要精確的檔案,是的:網格和色盤會完全照你的要求出來。論繪圖品質,在我們的測試中圖像模型比較好,但它的 32 × 32 版本失去了大部分陰影,外框線也斷了 14 處。

為什麼我的 32 × 32 角色圖看起來很模糊?

有某個東西用平滑方式把它放大了。Ciyo 畫板對我們的 1× 檔案就是這樣。請改看以最近鄰方式放大的 10× 預覽圖,並在遊戲引擎中把濾鏡設為最近鄰。

這次測試在 Ciyo 中花了多少?

手工放置像素的狐狸沒有花任何點數。圖像模型的狐狸花了 2 點,而在 Agent 的工作區裡對齊和評分沒有增加任何費用。

做出你自己的像素吉祥物

把網格、色盤和姿勢交給 Ciyo Agent,請它放好每一個像素。再在同一張畫板上和圖像模型的版本比較。