像素画 · 实测
Claude Opus 5.5 能画像素画吗?一只狐狸,一个像素一个像素地画

Claude Opus 5.5 是语言模型。它不像图像模型那样直接输出图片。所以当人们搜索“Opus 5.5 像素画”时,真正有用的问题不是它会不会画画,而是它能不能做出一张真正能用的精灵图:网格正确、调色板精简、边缘干净、背景透明。
2026年9月30日,我们把同一个小任务分别交给直接使用的 Claude Opus 5.5、Ciyo Agent(Ciyo 智能体)和一个图像模型:为一家虚构的桌游咖啡馆画一只 32 × 32 的狐狸吉祥物。我们测量了每一个文件。代码路线每次都给出了精确的像素。图像模型画得更好看,做出的精灵图却更差。
简短的回答:能,只要它用代码来画
语言模型做像素画的方式,就像人在电子表格里做像素画:逐个决定每个格子的颜色。实际上就是一段简短的脚本,比如用 Python 加 Pillow 库,在固定网格上设置每个像素,再保存成 PNG。这样网格和调色板天生就是精确的,因为整个过程没有任何缩放或模糊。
限制在于画功。模型得一行一行地在脑子里构想形状,所以姿势只能简单,小细节需要再看一遍。正因如此,下面的测试比一句“能”或“不能”更有参考价值。
| 对比项 | 代码路线(语言模型逐个放置像素) | 图像路线(图像模型直接绘制) |
|---|---|---|
| 网格和尺寸 | 精确:32 × 32 就是 32 × 32 | 一张只是看起来像像素的大图 |
| 调色板 | 只有你允许的颜色 | 减色之前有好几万种颜色 |
| 透明度 | 只有全透明或全不透明的像素 | 通常有一层纯色背景需要去掉 |
| 画面质量 | 形状简单,需要复查 | 姿势和角色感更丰富 |
| 我们测试中的额度 | 绘制本身不花额度 | 图片花了 2 个额度 |
需求:给一家桌游咖啡馆做吉祥物
Pip & Pine 是一家虚构的桌游咖啡馆,想要一个小吉祥物,用在 Discord 表情和桌游之夜的海报上。一份好的像素画需求要写明网格尺寸、颜色上限、描边、背景和姿势,还要说明文件该怎么做出来。
我们把同一份需求发给了 Claude Code 里的 Claude Opus 5.5(只允许使用 Python 和 Pillow),也发给了新建 Ciyo 画板上的 Ciyo Agent。
我经营一家桌游咖啡馆 Pip & Pine。我需要一个 32x32 的像素画吉祥物,用在我们的 Discord 表情和桌游之夜海报上:一只橙色小狐狸捧着一杯可可,面朝右,深色描边,最多 12 种颜色,透明背景。请你亲手一个像素一个像素地画,不要用图像模型:用代码把每个像素放在 32x32 的网格上,然后把 1x 的 PNG 和一张 10x 预览图保存到画板上。告诉我你用了哪些颜色。Claude Opus 5.5 自己画出了什么
Claude Opus 5.5 写了一段 Pillow 脚本,按一张手工编排的网格设置每个像素。它渲染出结果,看了一遍,又修改了两次。它自己的日志写着,深色的手臂“read as a stick”(看起来像一根棍子),于是它把上臂改成了橙色,还去掉了尾巴上一个多余的奶油色像素。整个任务用了大约 3.6 分钟。
我们检查了文件:32 × 32 像素,11 种颜色,536 个不透明像素,其余像素全部完全透明。没有半透明的边缘像素,这正是精灵图在游戏引擎或 Discord 里显得清晰利落的原因。它唯一的提醒很实在:很浅的灰色热气在浅色背景上很难看清。
同一份需求交给 Ciyo
Ciyo Agent 走的是同一条路。它说会“draw it by hand in Python: every pixel is set explicitly on a 32×32 grid in layers”(用 Python 手工绘制:在 32×32 网格上分层显式设置每个像素),看了第一次渲染后,因为爪子挡住了杯子上的爱心,就把爱心挪了位置。它把一个 32 × 32 的文件和一张 320 × 320 的预览图保存到画板上,并以十六进制值列出了它用的 11 种颜色。没有花任何额度。
我们的检查和它的报告一致:11 种颜色,577 个不透明像素,没有半透明像素,10× 预览图正好是 1× 文件的十倍。有一个细节需要知道:画板会把很小的 1× 文件平滑放大显示,所以它在画板上看起来是模糊的。用眼睛判断时,要看 10× 预览图。

接着我们让图像模型画同一只狐狸
接下来,我们请 Ciyo Agent 用最便宜的设置(2 个额度)让 GPT Image 2.5 画同一只狐狸,缩小到 32 × 32,对齐到同样的 11 种颜色,再用同一个脚本给两个版本打分。
原始图片是 1,024 × 1,024,纯白背景,有 45,153 种不同的颜色。它的“像素”是约 20 到 23 个屏幕像素宽的柔和色块,网格大约是 45 × 45,所以缩小到 32 × 32 时切穿了它自己的像素边缘。对齐之后,智能体统计了这样做的代价:明暗几乎消失(深橙色从 54 个像素变成 1 个),杯子从 34 个像素缩到 19 个并丢了把手,描边断了 14 处。不过,图像模型的狐狸姿势确实更好,尾巴更蓬松,耳朵也更清楚。

不错。现在我想做个对比:用图像模型(GPT Image 2.5,最便宜的设置,方形)画同一只狐狸,再把那张图变成真正的 32x32 像素画,使用同样的 11 色调色板,放在你那只旁边。告诉我图像模型哪些地方做得更好、哪些更差,能计数的地方给出数字(对齐前的颜色数、杂散像素、描边缺口)。三只狐狸的测量结果
并排放在一起,差别一目了然。两只代码狐狸都是描边闭合的干净精灵图。对齐后的图像模型狐狸轮廓最好看,像素却最乱。
| 检查项 | Ciyo Agent,代码 | Claude Opus 5.5,代码 | 图像模型,对齐后 |
|---|---|---|---|
| 颜色数 | 11 | 11 | 11(对齐前 45,153) |
| 不透明像素 | 577 | 536 | 525 |
| 半透明像素 | 0 | 0 | 对齐后为 0 |
| 描边 | 除热气外全部闭合 | 闭合 | 断开 14 处 |
| 额度 | 0 | 未在 Ciyo 中测试 | 2 |

该选哪条路
文件必须精确时,用代码路线:表情、favicon 图标、游戏精灵图,以及任何以实际尺寸显示的东西。要求它给出调色板、透明背景和一张 10× 预览图,接受之前先检查预览图。
需要灵感时,用图像模型:一个姿势、一张角色设定图或一种氛围。然后把结果对齐到真正的网格并修补描边,或者把最好的姿势交回代码路线作为参考。我们的智能体正好主动提出了这一点:参照图像模型那条更大的尾巴和奶油色的脚,重画它的代码狐狸,不花额度。
2026-09-29 发布。作者给 Sonnet 5.5、Opus 5.5、GPT-6.1 Sol 和 GPT-6 Astra 同一段提示词,要求在一个不用任何库的 HTML 文件里做一个会动的像素画巫师,并列出了每次运行的耗时和估算费用。这是作者在其他工具里做的测试,不是 Ciyo;它说明的和我们的测试是同一点:语言模型靠写代码来做像素画。
吉祥物的下一步
32 × 32 文件做对之后,在用户实际看到的尺寸下检查它,让其他所有图标共用一套调色板,等静态帧干净了再做动画。
Claude Opus 5.5 与像素画
Claude Opus 5.5 能画像素画吗?
能,靠写代码逐个放置像素。在我们 2026年9月30日的测试中,它用大约 3.6 分钟做出了一只 32 × 32、11 种颜色、背景完全透明的狐狸。它不能像图像模型那样直接画出一张图片。
代码路线比图像模型更好吗?
如果要的是精确的文件,是的:网格和调色板完全按要求生成。论画面质量,在我们的测试中图像模型更好,但它的 32 × 32 版本丢掉了大部分明暗,描边也断了 14 处。
为什么我的 32 × 32 精灵图看起来是模糊的?
有东西在用平滑方式放大它。Ciyo 画板就这样显示了我们的 1× 文件。请改看最近邻放大的 10× 预览图,并在游戏引擎里设置最近邻过滤。
这次测试在 Ciyo 里花了多少钱?
手工摆放像素的狐狸没有花额度。图像模型狐狸花了 2 个额度,在智能体的工作区里对齐和评分没有额外费用。
做一个你自己的像素吉祥物
把网格、调色板和姿势告诉 Ciyo Agent,请它逐个放置每个像素。再在同一张画板上和图像模型的版本比一比。