新模型 · 比較

Opus 5.5 對 GPT-6 Sol:一份需求,兩個模型

兩支對折的象牙白紙箭頭,指向一塊炭黑石盤,石盤中心有一根小小的琥珀色玻璃針
原創抽象編輯插畫,於 Ciyo 中以 GPT Image 2.5 Sunburst 生成。

Anthropic 的 Claude Opus 5.5 與 OpenAI 的 GPT-6 Sol 都在 2026 年 9 月 22 日發布,兩者都被定位為各家旗艦之下、能力強又較便宜的選擇。隨後的搜尋問的是最明顯的問題:哪一個比較好?

9 月 23 日,我們針對一份工作回答了這個問題——為一家小麵包店規劃新品上市貼文——再把每個模型的第一段影像提示詞在 Ciyo 裡做成真實的圖。比起文字,圖片讓差別更容易看出來。

價格與使用管道

GPT-6 Sol 每百萬輸入 token $2、每百萬輸出 token $10;Claude Opus 5.5 則是 $4 與 $20。在應用程式裡,Sol 在付費方案的 ChatGPT Work 與 Codex 中,Opus 5.5 則在 claude.ai 的 Pro、Max、Team 與 Enterprise 方案中。

兩者都能讀取影像,並以文字回答。兩者在 Ciyo 裡都無法使用;Ciyo 的 Agent 提供 Ciyo Agent 與 GPT-6 Astra。

測試設定與結果,2026-09-23
項目GPT-6 SolClaude Opus 5.5
在哪裡測ChatGPT Work,Mediumclaude.ai,Medium
回答耗時15 秒約 60 秒
事實錯誤00
貼文文案中的猜測00
列出的假設1 行5 項,放在最前面
追問時是否捏造優惠或營業時間否,用佔位文字否,用佔位文字

這份需求

Kettle & Crumb 是虛構的:一家社區麵包店在 10 月 3 日星期六推出每條 $9 的南瓜裸麥酸種麵包,共 60 條,預購在星期四截止。需求要一份創意簡報、三段不含文字的 4:5 影像提示詞和一則貼文文案,並要模型列出它的猜測。

給兩者的同一份需求
你正在為一家小型社區麵包店規劃一則 Instagram 貼文。只能使用下面的事實。如果你需要事實裡沒有的東西,請把它寫進一份名為「假設」的清單,而不要把它當成事實陳述。

事實:
- 麵包店:Kettle & Crumb,14 Alder Street
- 新產品:南瓜裸麥酸種麵包,10 月 3 日星期六上市
- 價格:每條 $9
- 上市當天只有 60 條
- 預購於 10 月 1 日星期四截止,透過我們個人簡介裡的連結
- 不打折,不外送
- 受眾:已經在 Instagram 上追蹤我們、住在附近的人

請給我三樣東西:
1. 一份不超過 80 字的創意簡報。
2. 三段不同的影像提示詞,用於一張 4:5 的照片。影像中不得出現任何文字、字母或標誌。
3. 一則不超過 60 字的貼文文案。

Sol:正確而樸素

Sol 在 15 秒內回答,沒有錯誤,也沒有捏造的細節。它的提示詞刻意寫得很簡略:素面檯面上的一條麵包、外殼的特寫、一個低角度的四分之三視角。它註明需求沒有給出麵包的外觀,所以它也就沒有描述。

ChatGPT Work 中 GPT-6 Sol 的創意簡報、三段簡短的影像提示詞和一張貼文文案卡片
GPT-6 Sol,Medium,2026 年 9 月 23 日。

Opus:較慢而具體

Opus 花了大約一分鐘。它開頭列出五個假設,其中包括內部組織可能因南瓜而帶橘色調,並提醒老闆在生成圖片之前先核對麵包的真實外觀。接著它的提示詞就用上了這些假設:切開的一片、背景裡的一顆南瓜、溫暖的側光、麵包師傅沾滿麵粉的雙手。

claude.ai 中 Opus 5.5 的假設清單、創意簡報和三段詳細的影像提示詞
Claude Opus 5.5,Medium,2026 年 9 月 23 日。

兩張圖

我們把每個模型的第一段提示詞貼進 Ciyo 的影像生成器,設定相同:GPT Image 2.5 Flare,4:5,1K,每張 2 點。Sol 的提示詞做出一條灰色檯面上、乾淨未切開的麵包——準確但普通。Opus 的做出一條切開的麵包,帶色調的內部組織、一片切片和一顆南瓜——更吸引人,但建立在老闆必須確認的猜測上。

兩者都沒有錯。Sol 的圖用在任何酸種麵包上都能放心發布;如果內部組織真的是橘色的,Opus 的圖更能把這條麵包賣出去。

Ciyo 畫板,左邊是灰底上未切開的素面麵包,右邊是木頭砧板上切開的麵包和一顆南瓜
Ciyo,2026 年 9 月 23 日。左:來自 GPT-6 Sol 的提示詞。右:來自 Claude Opus 5.5 的提示詞。

第二項任務:核對一張圖表

我們也請兩者核對一張圖表投影片,我們在上面改動了一個標籤。兩者都抓到了。在未經改動的投影片上,Opus 回報沒有不符之處,並說明了它的判讀精度;Sol 則把三個單位的差距標記為不符。完整的測試另有專文。

其他人在發布當天的發現

早期的並排比較貼文比的是程式碼,而不是創意工作。它們可以當作風向參考,不能當作創意簡報的證據。

Opus 5.5 對 GPT-6 Sol

規劃社群貼文,哪一個比較好?

在我們這一次的測試裡,Opus 5.5 寫出更豐富的提示詞,並把猜測放在最前面;GPT-6 Sol 更快,也更照字面來。兩者的每個事實都正確。

哪一個比較便宜?

GPT-6 Sol:每百萬輸入與輸出 token 為 $2 與 $10。Claude Opus 5.5:$4 與 $20。

兩者能做出圖嗎?

兩者都以文字回答。ChatGPT 能替 Sol 呼叫影像工具;Opus 被要求出圖時畫了一張 SVG 插畫。照片是我們在 Ciyo 裡做的。

Ciyo 裡能用這兩個模型嗎?

不能。Ciyo 的 Agent 提供 Ciyo Agent 與 GPT-6 Astra;把任一模型的提示詞貼進影像生成器即可。

在同一張畫板上比較提示詞

把每個模型的提示詞貼進 Ciyo,選定之前先並排看看做出來的圖。