信信号图谱
OpenAI Platform重要能力增强2 个来源印证2026-09-29 → 2026-09-30

OpenAI GPT-6 Astra 新增 Ultrafast 低延迟推理模式及定价

OpenAI Adds Ultrafast Low-Latency Tier and Pricing for GPT-6 Astra

低延迟

EVENT SUMMARY

事件摘要

OpenAI 在 Responses API 中为 GPT-6 Astra 新增 Ultrafast 服务层级,旨在通过减少输出 token 间的时间间隔来满足极低延迟场景的需求。该模式定价约为 Standard 的 6 倍、Fast 的 3 倍(如短上下文输入 $60.00/1M tokens,输出 $300.00/1M tokens)。目前仅支持全球处理和美国数据驻留,暂不支持 EU 及其他区域推理驻留,且受速率限制。此举标志着 OpenAI 将推理速度作为独立付费维度,进一步细化低延迟市场的商业化策略。

ANALYST VIEW

中立分析

为什么重要

Ultrafast 层级将推理速度作为独立付费维度,与 Anthropic 等厂商在低延迟方向上形成差异化竞争,可能推动行业将延迟等级细分为更多付费档位,同时也为 OpenAI 创造更高客单价。

影响对象

对延迟极度敏感的场景(如实时对话、交易系统)提供新选项,但成本较高,适合预算充足的企业级低延迟应用;欧洲客户因数据驻留要求可能无法使用。

证据说明

来源为 OpenAI 官方 changelog 及定价页面 diff,确认了 Ultrafast 模式的 API 参数、可用性、区域限制及具体定价数据。

不确定性

具体的延迟改善幅度(如 token/s 提升比例)未披露;速率限制的具体数值未说明;其他模型是否及何时支持 Ultrafast 未知。

SOURCES

2 个来源 · 2 条记录