新模型 · 对比
GPT-5.6 Sol 对比 GPT-6 Sol:值得换吗?

2026年9月22日,GPT-6 Sol 取代 GPT-5.6 Sol,成为 OpenAI 的中等价位模型,API 价格减半:每百万输入和输出 token 分别为 $2 和 $10,此前是 $4 和 $20。OpenAI 还表示,它犯的事实性错误大约只有前代的一半。
9月23日,两个模型都还在 ChatGPT Work 的列表里,所以我们用相同的 Medium 推理强度,给它们同一份小商家简报,比较各自最终摆到顾客面前的是什么。
纸面上改了什么
OpenAI 用与 GPT-6 Astra 相近的方法训练了 GPT-6 Sol,并把价格砍了一半。它的发布帖说,在一项由用户标记过错误的对话构建而成的内部事实性测试中,GPT-6 Sol 的错误大约只有 GPT-5.6 Sol 的一半。这是 OpenAI 的测量,不是我们的。
两个模型都只用文字回答,上下文窗口同为 1.05M(105 万)token。
| 模型 | 输入 | 输出 |
|---|---|---|
| GPT-5.6 Sol(促销价) | $4 | $20 |
| GPT-6 Sol | $2 | $10 |
我们的测试
两个模型拿到的都是 Kettle & Crumb 的简报:一家虚构的面包店将在 10月3日(星期六)推出售价 $9 的南瓜黑麦酸种面包,共 60 个,预订在星期四截止,不打折,不配送。简报要求模型把任何猜测都列出来。然后我们发了一条追问,要的是事实里没有的东西:平时的星期五优惠和营业时间。

现在为 10月2日(星期五)再写一段更短的配文。提一下我们平时的星期五优惠和我们的营业时间。真正要紧的差别
两个模型都把每个事实写对了,也都拒绝编造星期五优惠或营业时间,而是留下了占位符。用时很接近:GPT-6 Sol 用了 15 秒,GPT-5.6 Sol 用了 17 秒。
差别在于一行字。GPT-5.6 Sol 的配文让顾客到 14 Alder Street 自取。事实里只说了不配送;自取是个合理的猜测,但它没有出现在假设清单里,就直接进了公开的配文。GPT-6 Sol 在两段配文里都没有放进任何猜测。

GPT-6 Sol 是怎么写简报的
GPT-6 Sol 是我们测试过的最照字面办事的模型。它的提示词描述的是素净台面上的一个面包,并把台面、光线和机位角度列为它自己做的选择。这和 OpenAI 报告的事实性提升相符——同时也意味着,你应该自己提供产品的外观。

该不该换?
如果是做创意规划,该换:GPT-6 Sol 价格只有一半,而且在我们这一次测试里,没有把猜测放进面向顾客的文字。请保留让这次测试公平的那个简报习惯——列出事实,要求列出假设——因为猜得更少的模型,仍然会猜。
Ciyo 两个 Sol 模型都不运行。它的智能体提供 Ciyo Agent 和 GPT-6 Astra;无论哪个 Sol 写的提示词,都可以贴进图像生成器。
一份独立的价格核对
基准测试追踪机构在发布当天测到了同样的降价幅度。
2026-09-22 由独立基准测试机构 Artificial Analysis 发布。它报告说,在它的指数上,Sol 和 Luna 的成本相比 GPT-5.6 Sol 和 Luna 减半。这是他们对通用任务的测量,不是对创意简报的测量。
GPT-5.6 Sol 对比 GPT-6 Sol
GPT-6 Sol 比 GPT-5.6 Sol 便宜吗?
是的。每百万输入和输出 token 分别为 $2 和 $10,而 GPT-5.6 Sol 的促销价是 $4 和 $20。
GPT-6 Sol 更准确吗?
OpenAI 报告称事实性错误大约减少一半。在我们这一份简报里,GPT-6 Sol 的配文里没有放进任何猜测;GPT-5.6 Sol 放进了一个。
GPT-5.6 Sol 还能用吗?
2026年9月23日,它仍在 ChatGPT Work 的模型列表中。
Ciyo 用了哪个 Sol 模型吗?
都没有。Ciyo 的智能体提供 Ciyo Agent 和 GPT-6 Astra。
守住事实,在 Ciyo 里出图
用你信得过的任何模型做规划,然后在同一块 Ciyo 画板上生成并比较图片。