OpenAI Platform重要能力增强2 个来源印证2026-09-29 → 2026-09-30
OpenAI GPT-6 Astra 新增 Ultrafast 低延迟推理模式及定价
OpenAI Adds Ultrafast Low-Latency Tier and Pricing for GPT-6 Astra
低延迟
EVENT SUMMARY
事件摘要
OpenAI 在 Responses API 中为 GPT-6 Astra 新增 Ultrafast 服务层级,旨在通过减少输出 token 间的时间间隔来满足极低延迟场景的需求。该模式定价约为 Standard 的 6 倍、Fast 的 3 倍(如短上下文输入 $60.00/1M tokens,输出 $300.00/1M tokens)。目前仅支持全球处理和美国数据驻留,暂不支持 EU 及其他区域推理驻留,且受速率限制。此举标志着 OpenAI 将推理速度作为独立付费维度,进一步细化低延迟市场的商业化策略。
ANALYST VIEW
中立分析
为什么重要
Ultrafast 层级将推理速度作为独立付费维度,与 Anthropic 等厂商在低延迟方向上形成差异化竞争,可能推动行业将延迟等级细分为更多付费档位,同时也为 OpenAI 创造更高客单价。
影响对象
对延迟极度敏感的场景(如实时对话、交易系统)提供新选项,但成本较高,适合预算充足的企业级低延迟应用;欧洲客户因数据驻留要求可能无法使用。
证据说明
来源为 OpenAI 官方 changelog 及定价页面 diff,确认了 Ultrafast 模式的 API 参数、可用性、区域限制及具体定价数据。
不确定性
具体的延迟改善幅度(如 token/s 提升比例)未披露;速率限制的具体数值未说明;其他模型是否及何时支持 Ultrafast 未知。
SOURCES
2 个来源 · 2 条记录
OpenAI Platform·pricing指向来源页2026-09-30
OpenAI 新增 Ultrafast 服务层级,GPT-6 Astra 率先支持,价格为 Standard 的 6 倍
来源原文:Ultrafast ### Ultrafast pricing data | Model | Short context input | Short context cached input | Short context cache writes | Short context output | Long context input | Long context cached input | Long context cache writes | Long context output | | --- | --- | --- | --- | --- | --- | --- | --- | --- | | gpt-6-astra | $60.00 | $6.00 | $75.00 | $300.00 | $120.00 | $12.00 | $150.00 | $450.00 |
https://developers.openai.com/api/docs/pricing.md
OpenAI Platform·changelog指向来源页2026-09-29
GPT-6 Astra 新增 Ultrafast 模式
来源原文:Added Ultrafast mode for GPT-6 Astra in the Responses API. Use gpt-6-astra with service_tier: 'ultrafast' to reduce the time between generated output tokens. It is available to API customers, subject to rate limits, with global processing and US data residency. EU and other regional inference residency aren't supported.
https://developers.openai.com/api/docs/changelog.md