Ciyo · GPT-6

面向创作应用的 GPT-6 Astra API 指南

一个黄铜接线块把一条来自纸卡堆的琥珀色线缆连到一张装框的小幅静物照片上。
为本文创作的概念配图。

GPT-6 Astra 的官方 API 模型标识是 gpt-6-astra。OpenAI 的模型指南建议通过 Responses API 接入,模型页面列出了 Responses、Chat Completions 和 Batch 支持。对于把需求变成图片、版面或文案的产品来说,值得关注的是推理控制、内置图片工具和价格档位。

本指南依据 2026 年 9 月 7 日的 OpenAI 开发者文档。它面向开发创作工具的人,所以在图片生成工具和单个素材成本上花的篇幅多于通用智能体架构。上线前请重新核对链接页面;参数和价格都是带日期的快照。

写代码前先检查权限

API 权限与 ChatGPT 订阅相互独立。Plus 或 Pro 套餐不会产生 API 额度,API 密钥也不会解锁 Chat 里的 GPT-6 Pro。确认 gpt-6-astra 出现在将为请求付费的组织和项目中,然后先发送一个很小的文本请求,再加入文件、工具或大量上下文。

速率限制随用量层级提升。模型页面列出 Tier 1 每分钟 500 次请求和 500,000 token,到 Tier 5 升至每分钟 15,000 次请求和 40,000,000 token。为整个产品目录生成版本的批量任务应按这些数字规划规模,或者转到不在意延迟的 Batch 端点。

第一个请求

在 Responses API 请求中把 model 设为 gpt-6-astra,并把提示词作为 input 传入。指南建议使用 Responses API,因为 Chat Completions 不支持这个模型的工具调用。推理在 Responses 中用 reasoning.effort 设置;如果必须留在 Chat Completions,则用 reasoning_effort。

Astra 支持 low、medium、high、xhigh 和 max 推理程度。它不支持 none 和 minimal,所以从使用其中任一的 GPT-5.6 请求复制过来的配置应从 low 起步再做比较。删除 temperature、top_p、top_logprobs 和 logprobs;模型指南把它们列为迁移到 Astra 时应去掉的参数。

Astra 的最小 Responses API 请求,2026 年 9 月 7 日
字段原因
modelgpt-6-astra唯一记录在案的快照
input文本形式的需求,可选附带图片支持文本与图片输入
reasoning.effortlow、medium、high、xhigh 或 max不支持 none 和 minimal
tools需要时填 [{ type: "image_generation" }]把图片模型加入本轮
temperature、top_p、logprobs省略被列为应删除的参数

按创作任务选推理程度

OpenAI 的推理指南把 low 对应起草和执行类工作,medium 对应研究以及处理电子表格和幻灯片,high 对应困难推理和深度规划,xhigh 或 max 对应质量比延迟更重要的长时间任务。对创作应用来说可以这样映射:替代文本和说明文字的版本用 low,宣传需求用 medium,含冲突约束的多素材方案用 high。

推理程度也是费用控制手段。推理 token 不出现在响应里,却按每百万 50 美元的输出 token 计费,并占用上下文窗口空间。用量对象在 output_tokens_details.reasoning_tokens 下报告它们。为每个请求记录这个字段;它能解释为什么两个可见答案相似的请求费用差别很大。

调用图片生成工具

在请求中加入 tools: [{ type: "image_generation" }],并在 input 里描述画面。Astra 会策划图片并调用工具;响应中包含一个类型为 image_generation_call 的输出项,其 result 字段保存 base64 编码的图片。工具接受 size、quality(low、medium 或 high)、format、compression、background、取值为 auto、generate 或 edit 的 action,以及 1 到 3 的 partial_images 用于流式预览。

像素由 GPT Image 2 渲染,而不是 Astra,并按图片模型的费率计费:标准价下每百万图片输出 token 30 美元、每百万图片输入 token 8 美元、每百万文本输入 token 5 美元。后续编辑时,传入 previous_response_id 或把之前的 image_generation_call 放进 input,图片模型就能以原图为参考。

异步工具与任务中追加指令

Astra 引入了异步函数调用。给函数标记 async: true,模型就会在你的代码运行工具时继续工作,结果就绪后再用原来的 call_id 返回。对创作应用来说,这适合渲染视频预览或拉取大型素材库之类的慢步骤。

任务中追加指令让你在任务运行时通过 WebSocket 发送更新;Responses API 会保留已完成的工作并应用修正。configuration_update 输入项可以在对话中途改变推理程度而不重写提示词,因此缓存前缀得以保留。这两项功能在文档中都标为 Astra 新增,需要你的应用自行实现。

了解四个价格档

标准处理每百万输入 token 10 美元,缓存输入 1 美元,缓存写入 12.50 美元,输出 50 美元。输入超过 272,000 token 的请求按长上下文档计费:输入 20 美元,缓存 2 美元,缓存写入 25 美元,输出 75 美元。OpenAI 称速度最多快一倍的 Fast 模式把标准价翻倍,输入 20 美元,输出 100 美元。

Batch 端点把标准价减半,短上下文请求的输入 5 美元,缓存 0.50 美元,缓存写入 6.25 美元,输出 25 美元。夜间生成文案版本、为图库生成替代文本,或为明天的审阅准备需求,都是自然的 Batch 候选。Fast 模式不支持欧盟数据驻留,指南在这种情况下建议使用 Standard。

Astra API 各档位每百万 token 价格,2026 年 9 月 7 日
档位输入缓存输入输出
标准,输入不超过 272K$10$1$50
长上下文,输入超过 272K$20$2$75
Fast 模式$20$2$100
Batch$5$0.50$25
四根柱子比较 Astra 每百万 token 的输出价格:标准 50 美元,长上下文 75 美元,Fast 模式 100 美元,Batch 25 美元。
2026 年 9 月 7 日各档位的公开输出价格。输入价格遵循同样的规律,从 5 美元到 20 美元。

缓存重复的部分

大多数创作请求都会重用一段品牌资料:语气、禁用表述、配色规则和产品事实。把这一块放在 input 的最前面,缓存前缀才能在请求之间匹配。Astra 用 prompt_cache_options.ttl 取代了较早的 prompt_cache_retention 参数,指南用 30m 表示半小时的缓存窗口。

一个缓存 token 的费用是 1 美元而不是 10 美元,所以 15,000 token 的品牌资料每次重用花 0.015 美元而不是 0.15 美元。缓存写入按每百万 12.50 美元计费,因此这一块应该是稳定的文本,而不是每次请求都变的提示词。在你自己的分析里单独报告缓存 token;它们是提高一致性最便宜的方式。

每个通过审核素材的费用

一次包含 20,000 个未缓存输入 token 和 4,000 个输出 token 的需求请求,按标准价为 0.40 美元。加上 10,000 个推理 token,输出一行增加 0.50 美元。再加一张高质量图片,图片模型自己的 token 会另外计费。判断流程是否可行的数字是每个通过审核素材的费用,而不是每次调用的费用。

为每个素材记录四行:Astra 输入、含推理的 Astra 输出、图片 token,以及通过审核前的尝试次数。需要三次尝试的低推理档位可能比一次通过的高档位更贵。Ciyo 对自己的积分采用同样的算法,每次生成都会在运行前显示价格。

API 不会给你什么

Astra 没有直接的图片输出;每张图都要经过图片工具或其他图片模型。没有 none 推理程度,没有 temperature 控制,发送不支持的参数时也没有自动回退。ChatGPT 里的 GPT-6 Pro 不是独立的 API 模型;API 只列出一个 gpt-6-astra 快照。

安全检查也可能中止任务。OpenAI 的发布文章指出,在 API 中被暂停的任务会直接停止,而不是请你审核,所以生产应用应妥善处理被中断的响应。让失败路径对用户可见,并保留产生它的请求日志。

继续阅读

关于 Astra API 的常见问题

ChatGPT Plus 套餐包含 Astra 的 API 权限吗?

不包含。ChatGPT 套餐与 API 计费相互独立。Plus 随开放进度在 ChatGPT Work 和 Codex 中包含 Astra;API 使用 gpt-6-astra 则按 token 向你的组织计费。

可以用 Chat Completions 代替 Responses 吗?

模型页面列出了 Chat Completions 支持,但 OpenAI 的指南说明 Chat Completions 不支持 Astra 的工具调用,并建议使用 Responses API。图片生成工具和异步函数都是 Responses 的功能。

推理 token 免费吗?

不免费。推理 token 按所在档位的输出价作为输出 token 计费,并占用上下文。用量对象在 output_tokens_details.reasoning_tokens 下报告它们。

不用 API 密钥也能先做渲染原型

在 Ciyo 画布上用 GPT Image 2 生成,保留你认可的结果,等把 Astra API 接进自己的产品时再使用同一份需求。