GPT-6.1 Sol · 実測
GPT-6.1 Sol と GPT-6 Astra: キャンペーンの計画は Sol で足りるか

OpenAI は 2026年9月29日に GPT-6.1 Sol を公開し、“nearly matches GPT-6 Astra's intelligence on agentic coding, computer use, and professional work at one-fifth of Astra's standard input and output token prices.”(エージェント型のコーディング、コンピューター操作、専門的な仕事で GPT-6 Astra の知能にほぼ並び、Astra の標準の入力・出力トークン価格の 5 分の 1 で使える)と述べています。初期のテストの多くはコードについてのものです。マーケティングのキャンペーンを計画する人にとっての問いはもっと単純です。安いほうのモデルは、Astra と同じくらい丁寧に依頼文に従うのでしょうか。
2026年9月30日、架空のはちみつ店の発売について、破りやすいルールを九つ付けた同じ依頼文を、ChatGPT Work で両方のモデルに渡しました。どちらも九つすべてに従いました。そのあと、それぞれのモデルのプロンプトから主となる画像を Ciyo で作りました。どちらの画像にも、頼んだとおりの正確な文字が入っていました。
9月29日に変わったこと
GPT-6.1 Sol は GPT-6 Sol のアップグレード版です。ChatGPT では、Plus、Pro、Business、Enterprise、Edu のユーザーが ChatGPT Work と Codex で使え、OpenAI によると “not yet available in Chat”(Chat ではまだ使えない)とのことです。API では gpt-6.1-sol という名前で、入力トークン 100 万あたり $2、キャッシュされた入力トークン 100 万あたり $0.10、出力トークン 100 万あたり $10 です。
OpenAI は、いちばん難しい仕事には引き続き Astra を勧めています。発表では、Astra は “should be used for the most difficult scientific research tasks.”(最も難しい科学研究の仕事に使うべき)とされています。キャンペーンの計画はそうした仕事ではありません。ルールに従って丁寧に書く仕事であり、まさに安いモデルで足りる可能性がある領域です。
| モデル | 入力 | キャッシュされた入力 | 出力 |
|---|---|---|---|
| GPT-6.1 Sol | $2 | $0.10 | $10 |
| GPT-6 Astra | $10 | ここでは比較していない | $50 |
依頼文: 破りやすい九つのルール
Harbor & Hive は、新しいはちみつを発売する架空のはちみつ店です。良い計画の依頼文は、使ってほしい事実だけを渡し、ルールを確かめられる形にします。正確な数、縦横比、語数の上限、画像に入れる正確な一行の文字、そして入れてはいけないものです。私たちは、どちらのモデルも答える前に採点表を書いておきました。
同じメッセージを ChatGPT Work の GPT-6.1 Sol と GPT-6 Astra に、それぞれ新しいチャットで、同じ “High”(高)の推論設定で送りました。
22 Pier Lane にあるはちみつ店 Harbor & Hive の小さな発売キャンペーンを計画しています。商品: Ember Spice はちみつ、250 g の瓶、$14、10月10日(土)発売。対象: 25-45 歳の地元の Instagram のフォロワー。次のものを正確にください: (1) GPT Image 2.5 用の画像プロンプト三つ。4:5 のフィード投稿一つ、9:16 のストーリー一つ、1:1 の商品写真一つ。各プロンプトは 80 words(英単語で 80 語)未満。文字を入れてよいのはフィード投稿だけで、その文字は正確に "Ember Spice - Oct 10" とすること。(2) Seedance 2.5 用の 8-second(8 秒)の動画ショット一つを、1:1 の商品写真から始まる単一のプロンプトで。(3) Instagram のキャプション三つ、それぞれ 30 words(30 語)未満。(4) 投稿前に画像を確認するための 5-item(5 項目)のチェックリスト。ルール: 健康や医療に関する主張はしない、割引はしない、私が伝えていない事実を作らない。最後に、使った事実をすべて並べた一行を付けてください。採点: どちらも九つ中九つ
どちらの答えも、プロンプト、キャプション、チェックリストの項目の数が正しく、縦横比も正しく、フィードの文字も正確で、作られた事実も、健康に関する主張も、割引もありませんでした。画像プロンプトは 52〜60 語、キャプションは 20〜23 語で、上限に十分収まっていました。
違いは小さいものの、実際にありました。Sol は画像プロンプトの中に店の名前を入れていました。画像モデルがそれを瓶に印刷しようとするかもしれません。Astra は画像プロンプトに名前を入れませんでしたが、キャプションの一つに “this Saturday”(今週の土曜日)とあり、これは発売の週にしか正しくありません。Astra のチェックリストには役に立つ項目が一つ加わっていました。投稿する前に、絵の中の瓶を本物の商品と比べる、という項目です。
| 確認項目 | GPT-6.1 Sol | GPT-6 Astra |
|---|---|---|
| プロンプト 3 つ、動画ショット 1 つ、キャプション 3 つ、確認項目 5 つ | はい | はい |
| 正しいプロンプトに正しい縦横比 | はい | はい |
| 画像プロンプトが 80 語未満 | 59、52、54 | 60、57、57 |
| キャプションが 30 語未満 | 20、21、20 | 21、23、23 |
| フィードの文字が正確で、文字はフィードだけ | はい | はい |
| 作られた事実、健康の主張、割引がない | はい | はい |
| 動画が 1:1 の写真から始まる | はい | はい |
| 最後に事実の一行がある | はい | はい |
| 直す価値がある点 | 画像プロンプトの中に店の名前 | キャプションの一つに “this Saturday” |
| ChatGPT に表示された時間 | 36 s 作業 | 13 s、その後さらに約 23 s |
次に、Ciyo で画像を作る
計画の価値は、それが生む絵で決まります。そこで、それぞれのモデルの 4:5 のフィード用プロンプトを一語も変えずに新しい Ciyo のボードに持ち込み、Ciyo Agent に GPT Image 2.5 Flare の 1K で両方を生成し、文字を一文字ずつ確かめるよう頼みました。二枚の画像は 4 クレジットでした。
その日、エージェントはビューアーで新しい画像を開けなかったため、代わりにファイルに文字認識をかけ、そのことを伝えてきました。どちらも 93〜97% の信頼度で正確に “Ember Spice - Oct 10” と読めました。Sol の画像では、文字認識が瓶の上のかすかな模様も拾いましたが、拡大すると文字ではありませんでした。エージェントの判定は “On text alone neither prompt wins, but Astra's image is slightly cleaner.”(文字だけならどちらのプロンプトも勝っていないが、Astra の画像のほうが少しすっきりしている)でした。

はちみつの発売のために、計画用の二つのモデルを比べています。この二つの 4:5 のフィード用プロンプトを書かれたとおりに、それぞれ一枚ずつ、GPT Image 2.5 Flare、1K で生成してください。ラベルは "Sol feed" と "Astra feed" にしてください。そのあと、それぞれの画像の文字を "Ember Spice - Oct 10" と一文字ずつ照らし合わせ、どちらが使えるか教えてください。[このあとに両方のプロンプトを一語も変えずに貼り付け]二つのフィード投稿
並べてみると、どちらも使える発売の投稿です。飾りのない瓶、正確な一行の文字、温かい光。Astra のプロンプトは温かい背景と横からの光を求めていて、その絵のほうが雰囲気があります。Sol のプロンプトは中間色の背景を求めていて、その絵はより素朴です。この違いはプロンプトの言葉づかいから来ているもので、どちらのモデルでも変えられます。

キャンペーンの計画にどちらのモデルを使うか
事実がはっきりしていてルールを確かめられるこのような依頼文では、私たちのテストで GPT-6.1 Sol は Astra と同じくらいうまく仕事をこなし、API 価格は Astra の 5 分の 1 でした。新しいブランド、ぶつかり合う目標、長い調査の依頼文など、計画により多くの判断が必要な仕事には Astra を取っておいてください。どちらの場合も、出力を自分のルールと照らし合わせて読んでください。私たちのテストでの小さなミスは、チェックリストで見つけられる種類のものでした。
Ciyo では、エージェントのメニューに Ciyo Agent と GPT-6 Astra があり、GPT-6.1 Sol は選択肢に入っていません。私たちがしたように、ChatGPT Work や Codex で Sol を使って計画を立て、そのプロンプトを Ciyo のボードに持ち込んで絵を生成し、確かめることができます。
2026-09-29に投稿。投稿者は、105 個のバグを仕込んだ二つのコードリポジトリでモデルをテストし、GPT-6 Astra は $33 で 45 個、GPT-6.1 Sol は $6.56 で 44 個を見つけたと報告し、これを一回だけの実行(“n=1”)と呼んでいます。これはクリエイティブな仕事ではなくコーディングのテストで、投稿者自身のテストです。それでも私たちのテストと同じ方向を示しています。ずっと安い価格で、近い結果が出るということです。
発売の次の一歩
承認した計画を絵と短い動画にし、それを確認する人の目の前に依頼文のルールを置いておいてください。
クリエイティブの計画に使う GPT-6.1 Sol
GPT-6.1 Sol はマーケティングの依頼文に十分使えますか
私たちのテストでは、使えました。2026年9月30日、発売の依頼文の九つのルールすべてに、GPT-6 Astra と同じように従いました。どちらを使う場合も、出力を自分のルールと照らし合わせて確かめてください。
GPT-6.1 Sol は画像を作れますか
Sol が書くのは文章とプロンプトで、絵は画像モデルが作ります。私たちは両方のモデルのプロンプトを Ciyo の GPT Image 2.5 で生成し、どちらの画像にも頼んだとおりの正確な文字が入っていました。
GPT-6.1 Sol はどこで使えますか
OpenAI によると、Plus、Pro、Business、Enterprise、Edu のユーザー向けの ChatGPT Work と Codex、そして API の gpt-6.1-sol です。Chat ではまだ使えないとしています。
Ciyo で GPT-6.1 Sol は動きますか
いいえ。2026年9月30日の時点で、Ciyo のエージェントのメニューにあったのは Ciyo Agent と GPT-6 Astra でした。Sol で書いたプロンプトを Ciyo のボードに持ち込み、画像を作って確かめることはできます。
キャンペーンの計画を絵にする
プロンプトを Ciyo のボードに貼り付け、GPT Image 2.5 で生成し、投稿する前に Ciyo Agent に文字を確かめてもらいましょう。