核心事件:Ultrafast API 面向更广用户开放在即

据 IT之家 9 月 27 日报道,OpenAI 已在 Platform 和 API 文档中添加 Ultrafast API 相关内容,预示其即将扩大该功能的开放范围。DevDay 活动定于 9 月 29 日举行,扩大开放极可能在此期间正式公布。
硬信息要点如下:
- 发布时间:预计 2026 年 9 月 29 日 DevDay 期间
- 新版本:搭载 GPT-5.6 Sol 的 Ultrafast 模式
- 当前状态:仍仅向部分客户开放;Responses API Playground 中为隐藏功能
- 输出性能:最高可达每秒 750 个 Token(Standard 模式对比基准)
- 性能提升:推理速度最高为 Standard 模式的 14 倍
关键事实与细节:隐藏功能与速度革命
Ultrafast 模式此前已进入预览阶段,最高输出速度被明确表述为每秒 750 个 Token。Token 是模型处理语言的基本单位,每秒 750 Token 相当于人类快速打字速度的数倍,大幅缩短用户等待响应时间。
OpenAI 正为其 Responses API Playground 准备全新的速度选项菜单:用户将可在 Standard、Fast 和 Ultrafast 三档之间按需选择。目前该入口仍处于隐藏状态,表明功能尚在灰度测试或内部调试阶段。
一项反差性事实值得注意:每秒 750 Token 的吞吐效率显著高于当前多数商用模型——行业常见商用模型吞吐率普遍在每秒 50 至 200 Token 区间。
新模型支持情况:GPT-6 系列是否兼容待解
OpenAI 已最新推出 GPT-6 系列模型,包含 GPT-6 Sol 和 GPT-6 Astra 两款。根据现有信息,尚未有证据表明 GPT-6 系列是否会在发布时同步支持 Ultrafast 模式。“是否支持 Ultrafast”仍是待确认项,源材料中未给出任何确定性表述。
Ultrafast 功能的底层模型归属存在过渡期:GPT-5.6 Sol 已确认作为首发载体,而新一代 GPT-6 系列与其兼容性未明。开发者在规划集成方案时需预留验证周期。
对比表格:三种速度模式(基于原文信息整理)
| 模式 | 当前状态 | 最高吞吐 | 相对 Standard 表现 | 备注 |
|---|---|---|---|---|
| Standard | 已广泛可用 | 默认基准 | 基准 | 常规响应选项 |
| Fast | 未明确提及 | 未公开 | 未披露 | 信息有限 |
| Ultrafast | 预览阶段,仅限部分客户 | 750 Token/sec | 最高提升 14 倍 | DevDay 前可能扩大开放 |
读者落地建议
- 适合立即体验者:已获邀参与预览的客户或开发者,可提前测试 Ultrafast 在低延迟场景(如实时对话、高频交互)中的稳定性
- 建议等待公开版本者:普通开发者与中小团队宜 waits for general availability,避免因功能隐藏或权限限制导致集成受阻
- GPT-6 用户建议:若以 GPT-6 系列为目标集成对象,可暂缓调整架构,待官方明确是否支持 Ultrafast 后再行规划
写在最后
Ultrafast 的扩大开放是 OpenAI 在推理速度维度的又一次激进尝试,可能重塑低延迟 API 市场的竞争格局。不过,性能指数提升若伴随成本结构变化,将决定其是否真正普惠化——目前仍需观察公开后的定价策略。
