OpenAI 预览 GPT-5.6 Sol 的 Ultrafast

OpenAI News··作者 OpenAI News

关键信息

OpenAI 表示,Ultrafast 目前仍处于预览阶段,现阶段只向少量客户开放,并会随着产能提升逐步扩大访问范围。该公告也强调“每秒 token 数”是流式生成中的关键速度指标,也就是模型在返回首个分片后持续增量生成文本的能力。

资讯摘要

OpenAI 推出了 Ultrafast,这是 GPT-5.6 Sol 的一个新的 API 服务层,目标是显著提升生成速度。公司在公告中表示,该模式的运行速度最高可达标准处理的 14 倍,输出速度最高可达到每秒 750 个 token。OpenAI 将这一方向概括为“每秒完成更多有用工作”,而不是为了获得实时响应就被迫选择更小或更专门的模型。该功能由 OpenAI 与芯片公司 Cerebras 的合作提供支持。Cerebras 以适合超高速 AI 工作负载的晶圆级硬件而闻名,因此被用于加速推理并不意外。

OpenAI 还表示,Ultrafast 目前以预览形式发布,只向少量客户开放。随着产能增长,访问范围会逐步扩大。OpenAI 认为这一层级适合用于事故响应、客服与支持、金融市场分析和电商等 корпоратив workflow 场景。该发布也反映出行业竞争正在从单纯比拼模型能力,转向同时强调吞吐量和延迟表现。

OpenAI 预览 GPT-5.6 Sol 的 Ultrafast

资讯正文

预览 Ultrafast,这是 OpenAI API 的一个新服务层级,可将 GPT-5.6 Sol 的运行速度提升至最高 14 倍。该服务由 Cerebras 提供支持,最高可实现每秒 750 个输出 token。

来源与参考

  1. 原始链接
  2. OpenAI introduces 'Ultrafast,' a new mode that makes GPT-5.6 Sol work at 14x the speed | TechCrunch
  3. Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed

收录于 2026-08-14