像素畫 · 實測
Claude Opus 5.5 能做像素畫嗎?一隻狐狸,一個像素一個像素地畫

Claude Opus 5.5 是語言模型,它不會像圖像模型那樣直接輸出圖片。所以當大家搜尋「Opus 5.5 像素畫」時,真正有用的問題不是它會不會畫畫,而是它能不能做出一張真的能用的角色圖:正確的網格、精簡的色盤、乾淨的邊緣和透明背景。
2026 年 9 月 30 日,我們把同一件小工作分別交給直接使用的 Claude Opus 5.5、Ciyo Agent 和一個圖像模型:為一家虛構的桌遊咖啡館做一隻 32 × 32 的狐狸吉祥物。我們量測了每一個檔案。程式碼路線每一次都給出精確的像素。圖像模型畫得比較好,做出的角色圖卻比較差。
簡短的答案:可以,前提是用程式碼來畫
語言模型做像素畫的方式,就像人在試算表裡做像素畫:決定每一格的顏色。實際上就是一段簡短的腳本,例如用 Python 加上 Pillow 函式庫,在固定網格上設定每個像素,再存成 PNG。因為沒有任何縮放或模糊,網格和色盤從一開始就是精確的。
限制在於繪圖功力。模型必須一列一列地想像形狀,所以姿勢只能保持簡單,小細節也需要再看一次。這就是為什麼下面的測試比一句「能」或「不能」更重要。
| 比較項目 | 程式碼路線(語言模型放置像素) | 圖像路線(圖像模型作畫) |
|---|---|---|
| 網格和尺寸 | 精確:32 × 32 就是 32 × 32 | 一張只是看起來有像素感的大圖 |
| 色盤 | 只用你允許的顏色,沒有其他顏色 | 在你減色之前有好幾萬種顏色 |
| 透明度 | 只有完全透明或完全不透明的像素 | 通常有一片需要去除的純色背景 |
| 繪圖品質 | 形狀簡單,需要檢查 | 姿勢和角色表現比較豐富 |
| 我們測試中的點數 | 繪圖不花點數 | 圖片花了 2 點 |
需求說明:一家桌遊咖啡館的吉祥物
Pip & Pine 是一家虛構的桌遊咖啡館,想要一隻小吉祥物,用在 Discord 表情符號和桌遊之夜的海報上。好的像素畫需求說明會寫明網格大小、顏色上限、外框線、背景和姿勢,也會說明檔案該怎麼做出來。
我們把同一份需求說明交給 Claude Code 裡的 Claude Opus 5.5(只允許使用 Python 和 Pillow),也交給一張新 Ciyo 畫板上的 Ciyo Agent。
我經營 Pip & Pine,一家桌遊咖啡館。我需要一隻 32x32 的像素畫吉祥物,用在我們的 Discord 表情符號和桌遊之夜海報上:一隻捧著一杯可可的小橘狐狸,面向右方,深色外框線,最多 12 種顏色,透明背景。請你自己一個像素一個像素地畫,不要使用圖像模型:用程式碼把每個像素放在 32x32 的網格上,然後把 1x 的 PNG 和一張 10x 的預覽圖存到畫板上。告訴我你用了哪些顏色。Claude Opus 5.5 自己畫出了什麼
Claude Opus 5.5 寫了一段 Pillow 腳本,依照一張手工排好的網格設定每個像素。它算圖、檢視結果,並修改了兩次。它自己的紀錄寫著深色手臂「read as a stick」(看起來像一根棍子),所以它把上臂改成橘色,也把尾巴上一個多出來的奶油色像素拿掉。整件工作大約花了 3.6 分鐘。
我們檢查了檔案:32 × 32 像素、11 種顏色、536 個不透明像素,其餘每個像素都完全透明。沒有任何半透明的邊緣像素,這正是角色圖在遊戲引擎或 Discord 裡看起來清晰的原因。它唯一的提醒很誠實:非常淺的灰色蒸氣在淺色背景上很難看清楚。
同一份需求說明在 Ciyo 中
Ciyo Agent 也走同一條路。它說會「draw it by hand in Python: every pixel is set explicitly on a 32×32 grid in layers」(用 Python 手工繪製:每個像素都在 32×32 網格上分圖層明確設定),檢視了第一次的算圖,並因為爪子擋住了杯子上的愛心,把愛心移了位置。它把一個 32 × 32 的檔案和一張 320 × 320 的預覽圖存到畫板上,並以十六進位色碼列出它的 11 種顏色。沒有花任何點數。
我們的檢查結果和它的回報一致:11 種顏色、577 個不透明像素、沒有半透明像素,而 10× 預覽圖剛好是 1× 檔案的十倍大。有一個細節要知道:畫板會把很小的 1× 檔案平滑放大顯示,所以它在畫板上看起來是模糊的。用肉眼判斷時,請看 10× 預覽圖。

接著我們請圖像模型畫同一隻狐狸
接下來,我們請 Ciyo Agent 用 GPT Image 2.5 最便宜的設定(2 點)做同一隻狐狸,把它縮成 32 × 32,對齊到同樣的 11 種顏色,再用同一段腳本為兩個版本評分。
原始圖片是 1,024 × 1,024,有純白背景和 45,153 種不同的顏色。它的「像素」是寬約 20 到 23 個螢幕像素的柔邊色塊,大約是 45 × 45 的網格,所以縮成 32 × 32 時會切過它自己的像素邊界。對齊色盤之後,Agent 算出了這樣做的代價:陰影幾乎消失(深橘色從 54 個像素變成 1 個),杯子從 34 個像素縮到 19 個並且沒了把手,外框線斷了 14 處。不過,圖像模型的狐狸姿勢確實比較好,尾巴比較蓬,耳朵也比較清楚。

很好。現在我想比較一下:用圖像模型(GPT Image 2.5,最便宜的設定,正方形)做同一隻狐狸,然後把那張圖轉成真正的 32x32 像素畫,使用同樣的 11 色色盤,放在你的版本旁邊。告訴我圖像模型哪裡做得比較好、哪裡比較差,盡量附上數字(對齊前的顏色數、多餘的像素、外框線缺口)。三隻狐狸的量測結果
並排之後,差異一眼就看得出來。兩隻程式碼狐狸都是外框線封閉的乾淨角色圖。對齊後的圖像模型狐狸輪廓最好看,像素卻最凌亂。
| 檢查項目 | Ciyo Agent,程式碼 | Claude Opus 5.5,程式碼 | 圖像模型,對齊後 |
|---|---|---|---|
| 顏色數 | 11 | 11 | 11(對齊前 45,153) |
| 不透明像素 | 577 | 536 | 525 |
| 半透明像素 | 0 | 0 | 對齊後 0 |
| 外框線 | 除了蒸氣之外都封閉 | 封閉 | 斷了 14 處 |
| 點數 | 0 | 未在 Ciyo 中執行 | 2 |

該走哪一條路
檔案必須精確時,就走程式碼路線:表情符號、網站圖示、遊戲角色圖,以及任何以實際尺寸顯示的東西。請它提供色盤、透明背景和一張 10× 預覽圖,接受之前先檢查預覽圖。
需要點子時,就用圖像模型:一個姿勢、一張角色表或一種氛圍。然後把結果對齊到真正的網格並修補外框線,或是把最好的姿勢交回程式碼路線當作參考。我們的 Agent 正好主動提出這個做法:參考圖像模型那條比較大的尾巴和奶油色的腳,重畫它的程式碼狐狸,不花任何點數。
2026-09-29 發布。發文者給 Sonnet 5.5、Opus 5.5、GPT-6.1 Sol 和 GPT-6 Astra 同一段提示詞,要它們在單一 HTML 檔案中、不使用任何函式庫,做出一個會動的像素畫巫師,並列出每次執行的時間和估計成本。這是他們在其他工具中自己做的測試,不是 Ciyo;它說明的重點和我們的相同:語言模型是靠寫程式碼來做像素畫。
吉祥物的下一步
32 × 32 檔案沒問題之後,請在大家實際看到的尺寸下檢查它,讓其他所有圖示共用同一個色盤,並且等靜態畫面乾淨了再做動畫。
Claude Opus 5.5 與像素畫
Claude Opus 5.5 能做像素畫嗎?
可以,方法是寫程式碼放置每一個像素。在我們 2026 年 9 月 30 日的測試中,它大約花 3.6 分鐘做出一隻 32 × 32、11 種顏色、背景完全透明的狐狸。它無法像圖像模型那樣直接畫出一張圖。
程式碼路線比圖像模型好嗎?
如果要精確的檔案,是的:網格和色盤會完全照你的要求出來。論繪圖品質,在我們的測試中圖像模型比較好,但它的 32 × 32 版本失去了大部分陰影,外框線也斷了 14 處。
為什麼我的 32 × 32 角色圖看起來很模糊?
有某個東西用平滑方式把它放大了。Ciyo 畫板對我們的 1× 檔案就是這樣。請改看以最近鄰方式放大的 10× 預覽圖,並在遊戲引擎中把濾鏡設為最近鄰。
這次測試在 Ciyo 中花了多少?
手工放置像素的狐狸沒有花任何點數。圖像模型的狐狸花了 2 點,而在 Agent 的工作區裡對齊和評分沒有增加任何費用。
做出你自己的像素吉祥物
把網格、色盤和姿勢交給 Ciyo Agent,請它放好每一個像素。再在同一張畫板上和圖像模型的版本比較。