SheepNav
精选今天0 投票

预览Ultrafast模式:GPT-5.6 Sol速度提升高达14倍

速度与智能兼得:OpenAI 推出 Ultrafast 服务层

OpenAI 今日宣布预览 Ultrafast,一种新的 API 服务层级,可将旗舰模型 GPT-5.6 Sol 的推理速度提升至标准处理的 14 倍。该服务由 Cerebras 提供硬件支持,输出速度可达 每秒 750 个 token,旨在将前沿智能带入对延迟极其敏感的业务场景。

速度不再牺牲智能

长期以来,实时 AI 应用往往依赖较小的专用模型,因为大模型的推理速度难以满足即时响应的需求。Ultrafast 的出现打破了这一权衡:它让企业无需在速度与智能之间取舍,从而将 AI 部署到更广泛的时间敏感型工作流中。OpenAI 表示,Ultrafast 代表了“每秒完成更多有用工作”的新方向。

早期应用场景

OpenAI 列举了几个 Ultrafast 可能产生显著影响的领域:

  • 事件响应与可靠性:在系统故障发生时,实时分析日志、代码变更和工程师报告,迅速定位根因并辅助修复。
  • 金融研究与安全:在市场条件变化时,即时分析行情、评估交易并识别可疑行为。
  • 客户支持与语音:在对话不中断的情况下,实时解决复杂客户问题,即使答案需要多步骤查询。
  • 电商:在购物者犹豫的瞬间,回答产品问题、检查库存、提供个性化推荐,并解决结账问题,减少购物车放弃率。
  • 实时研究与实验:将原本需要过夜运行的研究转变为交互式会话,让团队快速迭代实验。

预览与未来展望

目前 Ultrafast 处于预览阶段,OpenAI 正与首批客户合作,以评估速度提升的实际影响,并将经验融入后续产品开发。企业用户可通过官网注册,获取访问权限扩展的通知。

这一举措标志着 AI 服务向“实时智能”迈出重要一步,也预示着未来竞争将不仅聚焦于模型能力,更在于响应速度。

延伸阅读

  1. 构建后量子密码学的务实路径
  2. Gemini 3.7 Flash 发布:更快更智能的AI模型引领新潮流
  3. Flock收紧规则应对监控争议,保障公民隐私
查看原文