像素画 · 实测

Claude Opus 5.5 能画像素画吗?一只狐狸,一个像素一个像素地画

拉丝石墨色洞洞板上,炭黑色和象牙色的小钉拼成一颗阶梯状的心,另有一枚琥珀色小钉单独立在象牙色纸上
原创抽象编辑插画,在 Ciyo 中用 GPT Image 2.5 Sunburst 生成。

Claude Opus 5.5 是语言模型。它不像图像模型那样直接输出图片。所以当人们搜索“Opus 5.5 像素画”时,真正有用的问题不是它会不会画画,而是它能不能做出一张真正能用的精灵图:网格正确、调色板精简、边缘干净、背景透明。

2026年9月30日,我们把同一个小任务分别交给直接使用的 Claude Opus 5.5、Ciyo Agent(Ciyo 智能体)和一个图像模型:为一家虚构的桌游咖啡馆画一只 32 × 32 的狐狸吉祥物。我们测量了每一个文件。代码路线每次都给出了精确的像素。图像模型画得更好看,做出的精灵图却更差。

简短的回答:能,只要它用代码来画

语言模型做像素画的方式,就像人在电子表格里做像素画:逐个决定每个格子的颜色。实际上就是一段简短的脚本,比如用 Python 加 Pillow 库,在固定网格上设置每个像素,再保存成 PNG。这样网格和调色板天生就是精确的,因为整个过程没有任何缩放或模糊。

限制在于画功。模型得一行一行地在脑子里构想形状,所以姿势只能简单,小细节需要再看一遍。正因如此,下面的测试比一句“能”或“不能”更有参考价值。

用 AI 得到像素画的两种方式
对比项代码路线(语言模型逐个放置像素)图像路线(图像模型直接绘制)
网格和尺寸精确:32 × 32 就是 32 × 32一张只是看起来像像素的大图
调色板只有你允许的颜色减色之前有好几万种颜色
透明度只有全透明或全不透明的像素通常有一层纯色背景需要去掉
画面质量形状简单,需要复查姿势和角色感更丰富
我们测试中的额度绘制本身不花额度图片花了 2 个额度

需求:给一家桌游咖啡馆做吉祥物

Pip & Pine 是一家虚构的桌游咖啡馆,想要一个小吉祥物,用在 Discord 表情和桌游之夜的海报上。一份好的像素画需求要写明网格尺寸、颜色上限、描边、背景和姿势,还要说明文件该怎么做出来。

我们把同一份需求发给了 Claude Code 里的 Claude Opus 5.5(只允许使用 Python 和 Pillow),也发给了新建 Ciyo 画板上的 Ciyo Agent。

两边用的同一份需求(在 Claude Code 里,文件存到文件夹而不是画板)
我经营一家桌游咖啡馆 Pip & Pine。我需要一个 32x32 的像素画吉祥物,用在我们的 Discord 表情和桌游之夜海报上:一只橙色小狐狸捧着一杯可可,面朝右,深色描边,最多 12 种颜色,透明背景。请你亲手一个像素一个像素地画,不要用图像模型:用代码把每个像素放在 32x32 的网格上,然后把 1x 的 PNG 和一张 10x 预览图保存到画板上。告诉我你用了哪些颜色。

Claude Opus 5.5 自己画出了什么

Claude Opus 5.5 写了一段 Pillow 脚本,按一张手工编排的网格设置每个像素。它渲染出结果,看了一遍,又修改了两次。它自己的日志写着,深色的手臂“read as a stick”(看起来像一根棍子),于是它把上臂改成了橙色,还去掉了尾巴上一个多余的奶油色像素。整个任务用了大约 3.6 分钟。

我们检查了文件:32 × 32 像素,11 种颜色,536 个不透明像素,其余像素全部完全透明。没有半透明的边缘像素,这正是精灵图在游戏引擎或 Discord 里显得清晰利落的原因。它唯一的提醒很实在:很浅的灰色热气在浅色背景上很难看清。

同一份需求交给 Ciyo

Ciyo Agent 走的是同一条路。它说会“draw it by hand in Python: every pixel is set explicitly on a 32×32 grid in layers”(用 Python 手工绘制:在 32×32 网格上分层显式设置每个像素),看了第一次渲染后,因为爪子挡住了杯子上的爱心,就把爱心挪了位置。它把一个 32 × 32 的文件和一张 320 × 320 的预览图保存到画板上,并以十六进制值列出了它用的 11 种颜色。没有花任何额度。

我们的检查和它的报告一致:11 种颜色,577 个不透明像素,没有半透明像素,10× 预览图正好是 1× 文件的十倍。有一个细节需要知道:画板会把很小的 1× 文件平滑放大显示,所以它在画板上看起来是模糊的。用眼睛判断时,要看 10× 预览图。

Ciyo 画布上一只 32 × 32 的像素狐狸捧着青绿色杯子,10 倍时清晰、1 倍时模糊,智能体面板列出 11 个十六进制颜色值
Ciyo Agent 手工摆放像素的狐狸:清晰的 10× 预览图、被画板放大显示的 1× 文件,以及聊天里的调色板。2026年9月30日。

接着我们让图像模型画同一只狐狸

接下来,我们请 Ciyo Agent 用最便宜的设置(2 个额度)让 GPT Image 2.5 画同一只狐狸,缩小到 32 × 32,对齐到同样的 11 种颜色,再用同一个脚本给两个版本打分。

原始图片是 1,024 × 1,024,纯白背景,有 45,153 种不同的颜色。它的“像素”是约 20 到 23 个屏幕像素宽的柔和色块,网格大约是 45 × 45,所以缩小到 32 × 32 时切穿了它自己的像素边缘。对齐之后,智能体统计了这样做的代价:明暗几乎消失(深橙色从 54 个像素变成 1 个),杯子从 34 个像素缩到 19 个并丢了把手,描边断了 14 处。不过,图像模型的狐狸姿势确实更好,尾巴更蓬松,耳朵也更清楚。

Ciyo 画板上,手工摆放像素的狐狸和对齐后的图像模型狐狸以 10 倍并排展示,右边是原始 AI 图片,旁边是智能体列出的图像模型优缺点
两只狐狸的 10× 和 1× 版本,右边是原始 AI 图片,聊天里是智能体的评分。
对比请求
不错。现在我想做个对比:用图像模型(GPT Image 2.5,最便宜的设置,方形)画同一只狐狸,再把那张图变成真正的 32x32 像素画,使用同样的 11 色调色板,放在你那只旁边。告诉我图像模型哪些地方做得更好、哪些更差,能计数的地方给出数字(对齐前的颜色数、杂散像素、描边缺口)。

三只狐狸的测量结果

并排放在一起,差别一目了然。两只代码狐狸都是描边闭合的干净精灵图。对齐后的图像模型狐狸轮廓最好看,像素却最乱。

三个 32 × 32 文件,2026年9月30日检查
检查项Ciyo Agent,代码Claude Opus 5.5,代码图像模型,对齐后
颜色数111111(对齐前 45,153)
不透明像素577536525
半透明像素00对齐后为 0
描边除热气外全部闭合闭合断开 14 处
额度0未在 Ciyo 中测试2
三只放大 14 倍的 32 × 32 像素狐狸:Ciyo Agent 手工摆放像素的狐狸、Claude Opus 5.5 画的蓝色杯子狐狸,以及对齐到调色板的图像模型狐狸
从左到右:Ciyo Agent 手工摆放像素的狐狸、Claude Opus 5.5 自己画的狐狸、对齐到 32 × 32 的 GPT Image 2.5 狐狸。全部以 14× 显示,未做平滑。

该选哪条路

文件必须精确时,用代码路线:表情、favicon 图标、游戏精灵图,以及任何以实际尺寸显示的东西。要求它给出调色板、透明背景和一张 10× 预览图,接受之前先检查预览图。

需要灵感时,用图像模型:一个姿势、一张角色设定图或一种氛围。然后把结果对齐到真正的网格并修补描边,或者把最好的姿势交回代码路线作为参考。我们的智能体正好主动提出了这一点:参照图像模型那条更大的尾巴和奶油色的脚,重画它的代码狐狸,不花额度。

吉祥物的下一步

32 × 32 文件做对之后,在用户实际看到的尺寸下检查它,让其他所有图标共用一套调色板,等静态帧干净了再做动画。

Claude Opus 5.5 与像素画

Claude Opus 5.5 能画像素画吗?

能,靠写代码逐个放置像素。在我们 2026年9月30日的测试中,它用大约 3.6 分钟做出了一只 32 × 32、11 种颜色、背景完全透明的狐狸。它不能像图像模型那样直接画出一张图片。

代码路线比图像模型更好吗?

如果要的是精确的文件,是的:网格和调色板完全按要求生成。论画面质量,在我们的测试中图像模型更好,但它的 32 × 32 版本丢掉了大部分明暗,描边也断了 14 处。

为什么我的 32 × 32 精灵图看起来是模糊的?

有东西在用平滑方式放大它。Ciyo 画板就这样显示了我们的 1× 文件。请改看最近邻放大的 10× 预览图,并在游戏引擎里设置最近邻过滤。

这次测试在 Ciyo 里花了多少钱?

手工摆放像素的狐狸没有花额度。图像模型狐狸花了 2 个额度,在智能体的工作区里对齐和评分没有额外费用。

做一个你自己的像素吉祥物

把网格、调色板和姿势告诉 Ciyo Agent,请它逐个放置每个像素。再在同一张画板上和图像模型的版本比一比。