Ciyo · GPT-6

面向創作應用程式的 GPT-6 Astra API 指南

一個黃銅接頭把來自一疊紙卡的琥珀色纜線,連接到一張裝框的小型靜物照片。
為本文製作的概念配圖。

GPT-6 Astra 的官方 API 模型識別碼是 gpt-6-astra。OpenAI 的模型指南建議透過 Responses API 使用它,模型頁面則列出 Responses、Chat Completions 和 Batch 支援。對一個把需求變成圖片、版面或文案的產品來說,值得關注的是推理控制、內建的圖片工具和價格級距。

本指南反映 2026 年 9 月 7 日的 OpenAI 開發者文件。它為建立創作工具的人而寫,所以花在圖片生成工具和每份素材成本上的篇幅,多於一般的智慧體架構。上線前請重新核對連結頁面;參數和價格都是有日期的快照。

寫程式碼之前先確認存取權限

API 存取與 ChatGPT 訂閱是分開的。Plus 或 Pro 方案不會產生 API 額度,API 金鑰也不會在 Chat 中解鎖 GPT-6 Pro。先確認 gpt-6-astra 出現在將要為請求付費的組織和專案中,再傳送一個很小的文字請求,之後才加入檔案、工具或大型上下文。

速率限制隨用量層級擴大。模型頁面列出 Tier 1 每分鐘 500 次請求與 500,000 token,到 Tier 5 提高至每分鐘 15,000 次請求與 40,000,000 token。為整個目錄生成版本的批次任務應按這些數字規劃規模,或改用不在意延遲的 Batch 端點。

第一個請求

在 Responses API 請求中把 model 設為 gpt-6-astra,並以 input 傳入你的提示詞。指南建議使用 Responses API,因為 Chat Completions 不支援這個模型的工具呼叫。推理程度在 Responses 中以 reasoning.effort 設定;如果必須留在 Chat Completions,則使用 reasoning_effort。

Astra 支援 low、medium、high、xhigh 和 max 推理程度。它不支援 none 和 minimal,所以從使用其中任一的 GPT-5.6 請求複製過來的設定,應先從 low 開始再做比較。移除 temperature、top_p、top_logprobs 和 logprobs;模型指南把它們列為遷移到 Astra 時要刪除的參數。

2026 年 9 月 7 日的 Astra 最小 Responses API 請求
欄位原因
modelgpt-6-astra唯一記錄在案的快照
input你的文字需求,可選擇附上圖片支援文字與圖片輸入
reasoning.effortlow、medium、high、xhigh 或 max不支援 none 和 minimal
tools需要時加入 [{ type: "image_generation" }]把渲染器加入這一輪
temperature、top_p、logprobs省略被列為要移除的參數

為每種創作任務挑選推理程度

OpenAI 的推理指南把 low 對應到起草與偏執行的工作,medium 對應到研究以及處理試算表和簡報,high 對應到困難推理與深度規劃,xhigh 或 max 對應到品質比延遲更重要的長時間執行。對創作應用程式來說可以這樣對應:替代文字與說明文字的版本用 low,宣傳需求用 medium,約束互相衝突的多素材計畫用 high。

推理程度也是一種費用控制。推理 token 不會出現在回應中,但按每百萬 50 美元的輸出 token 計費,並占用上下文視窗的空間。usage 物件會在 output_tokens_details.reasoning_tokens 之下回報這些 token。每次請求都記錄這個欄位;它能解釋為什麼兩次可見答案相似的請求,費用可能相差很大。

呼叫圖片生成工具

在請求中加入 tools: [{ type: "image_generation" }],並在 input 裡描述畫面。Astra 規劃圖片並呼叫工具;回應包含一個型別為 image_generation_call 的輸出項目,其 result 欄位存放 base64 編碼的圖片。工具接受 size、quality(low、medium 或 high)、format、compression、background、值為 auto、generate 或 edit 的 action,以及用於串流預覽的 partial_images,範圍為 1 到 3。

畫素由 GPT Image 2 渲染,而不是 Astra,並按圖片模型的費率計費:標準價格下每百萬圖片輸出 token 30 美元、每百萬圖片輸入 token 8 美元、每百萬文字輸入 token 5 美元。後續編輯時,傳入 previous_response_id,或把先前的 image_generation_call 放進 input,讓渲染器保留原圖作為參考。

非同步工具與任務中追加指令

Astra 引入了非同步函式呼叫。把函式標記為 async: true,模型會在你的程式碼執行工具時繼續工作,等結果準備好後,再帶著原本的 call_id 回傳。對創作應用程式來說,這適合渲染影片預覽或擷取大型素材庫等較慢的步驟。

任務中追加指令讓你在任務執行時透過 WebSocket 傳送更新;Responses API 會保留已完成的工作並套用修正。configuration_update 輸入項目可以在對話中途更改推理程度而不必重寫提示詞,因此快取的前綴得以保留。這兩項功能在文件中都列為 Astra 的新功能,需要你的應用程式自行實作。

認識四個價格級距

標準處理為每百萬輸入 token 10 美元、快取輸入 1 美元、快取寫入 12.50 美元、輸出 50 美元。輸入超過 272,000 token 的請求按長上下文級距計費:輸入 20 美元、快取 2 美元、快取寫入 25 美元、輸出 75 美元。OpenAI 描述為最高兩倍速度的 Fast 模式,把標準費率加倍為輸入 20 美元、輸出 100 美元。

Batch 端點把短上下文請求的標準價格減半:輸入 5 美元、快取 0.50 美元、快取寫入 6.25 美元、輸出 25 美元。夜間生成文案版本、為圖庫產生替代文字,或為明天的審閱準備需求,都是天然的 Batch 候選任務。Fast 模式不適用於歐盟資料落地,指南建議在該情況下使用 Standard。

2026 年 9 月 7 日的 Astra API 價格級距,單位為美元每百萬 token
級距輸入快取輸入輸出
標準,輸入不超過 272K$10$1$50
長上下文,輸入超過 272K$20$2$75
Fast 模式$20$2$100
Batch$5$0.50$25
四根長條比較 Astra 每百萬 token 的輸出價格:標準 50 美元、長上下文 75 美元、Fast 模式 100 美元、Batch 25 美元。
2026 年 9 月 7 日各級距的公開輸出費率。輸入費率依相同模式,從 5 美元到 20 美元。

快取重複出現的部分

多數創作請求都會重複使用一段品牌內容:語氣、禁用宣稱、色彩規則和產品事實。把這個區塊放在 input 的最前面,讓快取前綴在多次請求之間保持一致。Astra 以 prompt_cache_options.ttl 取代較舊的 prompt_cache_retention 參數,指南使用 30m 值表示半小時的快取視窗。

快取 token 每百萬 1 美元而不是 10 美元,所以一段 15,000 token 的品牌內容每次重用只需 0.015 美元,而不是 0.15 美元。快取寫入按每百萬 12.50 美元計費,因此這個區塊應該是穩定的文字,而不是每次請求都變動的提示詞。在你自己的分析中分開回報快取 token;它們是提高一致性最便宜的方法。

每份通過審核素材的成本

一次 20,000 個未快取輸入 token 加 4,000 個輸出 token 的需求請求,按標準費率為 0.40 美元。加上 10,000 個推理 token,輸出這一項增加 0.50 美元。再加一張高品質圖片,渲染器自己的 token 會另外計費。決定流程是否可行的數字,是每份通過審核素材的成本,而不是每次呼叫的成本。

每份素材追蹤四個項目:Astra 輸入、含推理的 Astra 輸出、圖片 token,以及通過審核前的嘗試次數。需要三次嘗試的較低推理程度,可能比一次就通過的較高程度更貴。這與 Ciyo 對自家積分採用的算法相同:每次生成都會在執行前顯示價格。

API 不會提供的東西

Astra 沒有直接的圖片輸出;每張圖片都經由圖片工具或另一個渲染器產生。沒有 none 推理程度,沒有 temperature 控制,傳送不支援的參數時也沒有自動回退。ChatGPT 中的 GPT-6 Pro 不是獨立的 API 模型;API 只列出一個 gpt-6-astra 快照。

安全檢查也可能中止任務。OpenAI 的發布文章指出,在 API 中被暫停的任務會直接停止,而不是請你審核,因此正式產品應妥善處理被中斷的回應。讓失敗路徑對使用者可見,並保留產生該結果的請求記錄。

繼續閱讀

關於 Astra API 的常見問題

ChatGPT Plus 方案包含 Astra 的 API 存取權嗎?

不包含。ChatGPT 方案與 API 計費是分開的。隨著逐步開放,Plus 在 ChatGPT Work 和 Codex 中包含 Astra;透過 API 使用 gpt-6-astra 則按 token 向你的組織計費。

我可以用 Chat Completions 代替 Responses 嗎?

模型頁面列出 Chat Completions 支援,但 OpenAI 的指南說明 Chat Completions 不支援 Astra 的工具呼叫,並建議使用 Responses API。圖片生成工具與非同步函式都是 Responses 的功能。

推理 token 是免費的嗎?

不是。推理 token 按你所在級距的輸出費率計為輸出 token,並且占用上下文。usage 物件會在 output_tokens_details.reasoning_tokens 之下回報它們。

不用 API 金鑰也能先做渲染步驟的原型

在 Ciyo 畫布上用 GPT Image 2 生成,保留你通過的輸出,並在把 Astra API 接進自家產品時使用同一份需求。