GPT-5.6 Sol 超快模式:Cerebras 与 OpenAI 联手,推理速度提升 11 倍
突破速度与智能的权衡
长期以来,AI 开发者不得不在速度和智能之间做出取舍。模型越大越聪明,计算和数据传输成本就越高,响应时间也越长。用户要么等待高质量结果,要么接受次优的快速答案。现在,Cerebras 和 OpenAI 推出的 Ultrafast Mode 有望打破这一僵局,让前沿智能以惊人的速度落地。
性能数据:快得不止一点
据 Cerebras 官方测试,GPT-5.6 Sol 在 Ultrafast 模式下输出速度高达 750 tokens/秒,且没有任何质量损失。与竞争对手相比,它比 Fable 5 快 11 倍,比 Opus 4.8 的 Fast 模式快 5 倍。在更具挑战性的 Humanity's Last Exam (HLE) 基准测试中,GPT-5.6 Sol 仅用 11 小时 11 分钟 就完成了全部 2500 道博士级难题,而 Claude Fable 5 则需要 78 小时 27 分钟,速度提升近 7 倍。
经济价值:高质量推理的加速器
除了学术基准,Cerebras 还使用了 GDP-Val 基准,衡量模型在知识工作(如法律、金融、工程)中的实际价值。结果显示,Ultrafast 模式带来了 5.6 倍 的端到端速度提升,且没有质量下降,这意味着更快的推理能直接加速高价值的经济活动。GPT-5.6 Sol 本身也是 OpenAI 在法律文书、财务模型和工程报告等领域最强的模型。
可用性与未来
Ultrafast Mode 将首先在 OpenAI API 中推出,首批面向精选客户,后续逐步开放。Cerebras 与 OpenAI 的这次合作,展示了专用硬件与先进模型的协同潜力,也为实时 AI 应用开辟了新的可能性。
小结
GPT-5.6 Sol Ultrafast 不仅是一次速度升级,更是在不牺牲智能的前提下,将前沿模型的能力推向了实时场景。对于时间敏感、任务关键的应用,这或许正是等待已久的解决方案。



