Featured image of post OpenAI Ultrafast API 将扩大开放范围,GPT-5.6 Sol 搭载 Ultrafast 模式支持每秒 750 Token 输出

OpenAI Ultrafast API 将扩大开放范围,GPT-5.6 Sol 搭载 Ultrafast 模式支持每秒 750 Token 输出

OpenAI 正在为 Responses API Playground 推出 Ultrafast 速度选项,GPT-5.6 Sol 搭载的 Ultrafast 模式已预览支持每秒 750 个 Token 输出。

核心事件:Ultrafast API 面向更广用户开放在即

核心事件:Ultrafast API 面向更广用户开放在即
核心事件:Ultrafast API 面向更广用户开放在即|新闻截图

据 IT之家 9 月 27 日报道,OpenAI 已在 Platform 和 API 文档中添加 Ultrafast API 相关内容,预示其即将扩大该功能的开放范围。DevDay 活动定于 9 月 29 日举行,扩大开放极可能在此期间正式公布。

硬信息要点如下:

  • 发布时间:预计 2026 年 9 月 29 日 DevDay 期间
  • 新版本:搭载 GPT-5.6 Sol 的 Ultrafast 模式
  • 当前状态:仍仅向部分客户开放;Responses API Playground 中为隐藏功能
  • 输出性能:最高可达每秒 750 个 Token(Standard 模式对比基准)
  • 性能提升:推理速度最高为 Standard 模式的 14 倍

关键事实与细节:隐藏功能与速度革命

Ultrafast 模式此前已进入预览阶段,最高输出速度被明确表述为每秒 750 个 Token。Token 是模型处理语言的基本单位,每秒 750 Token 相当于人类快速打字速度的数倍,大幅缩短用户等待响应时间。

OpenAI 正为其 Responses API Playground 准备全新的速度选项菜单:用户将可在 Standard、Fast 和 Ultrafast 三档之间按需选择。目前该入口仍处于隐藏状态,表明功能尚在灰度测试或内部调试阶段。

一项反差性事实值得注意:每秒 750 Token 的吞吐效率显著高于当前多数商用模型——行业常见商用模型吞吐率普遍在每秒 50 至 200 Token 区间。

新模型支持情况:GPT-6 系列是否兼容待解

OpenAI 已最新推出 GPT-6 系列模型,包含 GPT-6 Sol 和 GPT-6 Astra 两款。根据现有信息,尚未有证据表明 GPT-6 系列是否会在发布时同步支持 Ultrafast 模式。“是否支持 Ultrafast”仍是待确认项,源材料中未给出任何确定性表述。

Ultrafast 功能的底层模型归属存在过渡期:GPT-5.6 Sol 已确认作为首发载体,而新一代 GPT-6 系列与其兼容性未明。开发者在规划集成方案时需预留验证周期。

对比表格:三种速度模式(基于原文信息整理)

模式当前状态最高吞吐相对 Standard 表现备注
Standard已广泛可用默认基准基准常规响应选项
Fast未明确提及未公开未披露信息有限
Ultrafast预览阶段,仅限部分客户750 Token/sec最高提升 14 倍DevDay 前可能扩大开放

读者落地建议

  • 适合立即体验者:已获邀参与预览的客户或开发者,可提前测试 Ultrafast 在低延迟场景(如实时对话、高频交互)中的稳定性
  • 建议等待公开版本者:普通开发者与中小团队宜 waits for general availability,避免因功能隐藏或权限限制导致集成受阻
  • GPT-6 用户建议:若以 GPT-6 系列为目标集成对象,可暂缓调整架构,待官方明确是否支持 Ultrafast 后再行规划

写在最后

Ultrafast 的扩大开放是 OpenAI 在推理速度维度的又一次激进尝试,可能重塑低延迟 API 市场的竞争格局。不过,性能指数提升若伴随成本结构变化,将决定其是否真正普惠化——目前仍需观察公开后的定价策略。