模型OpenAI News·原文 2026年8月13日本站收录 2026年9月5日

OpenAI推出Ultrafast API服务:GPT-5.6 Sol处理速度提升达14倍

新服务由Cerebras提供算力支持,输出速度最高可达每秒750个token。

AI解读:OpenAI的Ultrafast服务将GPT-5.6 Sol的运行速度提升至原来的14倍,输出可达每秒750个token,这直接降低了AI应用在高并发或实时交互场景中的响应延迟。对依赖API的开发者而言,更快的速度意味着更高的吞吐量和更流畅的用户体验,尤其适合聊天机器人、实时翻译等对延迟敏感的任务。不过,这一速度提升并非OpenAI独立实现,而是由Cerebras的专用硬件驱动,且服务目前仅处于预览阶段,其稳定性和价格尚未公布,实际使用效果还需进一步验证。

OpenAI于今日宣布推出Ultrafast API服务层,该服务可将GPT-5.6 Sol模型的运行速度提升至原来的14倍,输出速率最高达到每秒750个token。

硬件与性能

根据OpenAI官方公告,Ultrafast服务由Cerebras提供硬件支持,这一算力配置使GPT-5.6 Sol的推理速度较标准版显著加快。公告称,该服务现在处于预览阶段,尚未提及正式商用版本的具体时间。

信息来源

OpenAI News原始来源