GPT-6.1 Sol 正式上线 Amazon Bedrock:以近 Astra 级推理重塑日常智能体工作
GPT-6.1 Sol 登陆 Amazon Bedrock
亚马逊云科技宣布,GPT-6.1 Sol 现已在 Amazon Bedrock 上正式可用。作为 GPT-6 Sol 的重要升级版本,它在智能体编程、计算机使用以及高频专业工作负载上带来了更强的推理能力。据 OpenAI 介绍,该模型将 接近 Astra 级别的智能 带入日常工作流。
对于 AI 智能体而言,完成一项任务往往需要收集信息、调用工具、尝试不同路径、从错误中恢复并验证结果。每一步决策都会影响后续走向,一次错误转向就可能增加模型交互、工具调用、延迟以及人工干预。因此,智能体的经济性由整个任务过程决定:Token 价格影响单次交互成本,而推理质量则决定工作需要多少次交互、能否成功完成。
推理质量如何改变开发工作流
软件工程是体现推理质量影响的典型场景。智能体可能需要理解陌生的代码库、追踪依赖关系、确定修改位置并验证实现。根据 OpenAI 的数据,GPT-6.1 Sol 在 DeepSWE v1.1 上的表现与 GPT-6 Astra 持平,但每个任务的成本仅约为其五分之一。同时,它比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点,且使用的推理强度更低。
Codex 可将这种推理能力贯穿整个开发周期。用户可以在 Amazon Bedrock 上配置 Codex 使用 GPT-6.1 Sol,覆盖调查、实现和测试等环节。Codex 可与代码仓库、本地文件、终端和开发工具协作,编写功能、修复缺陷并运行测试,并可通过桌面应用、CLI 和支持的 IDE 访问。针对 AWS 开发,Agent Toolkit for AWS 能通过一条终端命令将 Codex 连接到 AWS 文档、API 和服务。
从信息到行动
当智能体需要解读复杂文档、选择合适的工具并随条件变化而调整时,同样的推理能力同样适用。GPT-6.1 Sol 在 Amazon Bedrock 上的正式可用,意味着企业可以在一个为性能、安全和规模化可靠性而构建的推理引擎上,将更强推理能力应用于日常智能体工作。
