OpenAI 预览 GPT-5.6 Sol 的 Ultrafast 模式
这一新的 API 服务层借助 Cerebras 运行 GPT-5.6 Sol,输出速度最高可达每秒 750 个 token。
为什么重要
这次预览表明,对于前沿模型 API 来说,延迟和吞吐量正成为更明确的产品差异化因素,尤其是在依赖快速生成的应用场景中。
核心要点
- 1.OpenAI 预览了一个名为 Ultrafast 模式的新 API 服务层。
- 2.该服务层运行 GPT-5.6 Sol,并由 Cerebras 提供支持。
- 3.OpenAI 表示,其输出速度最高可达每秒 750 个 token。
OpenAI 预览了 Ultrafast 模式,这是面向 GPT-5.6 Sol 的新 API 服务层。该公司表示,这一服务层由 Cerebras 提供支持,可让 GPT-5.6 Sol 的运行速度最高提升至 14 倍,输出速度最高达到每秒 750 个 token。
⚡ 今天就能用
获得访问权限后,可以评估 Ultrafast 模式下的 GPT-5.6 Sol 是否能降低面向用户的 API 工作流延迟。
来源与原始报道
本简报汇总并链接到以下媒体的报道。
觉得这篇简报有用?下一篇直接送到你的邮箱。