AWS 在首尔与新加坡上线 Anthropic 模型区域内推理,满足本地数据合规需求
亚太本地推理再进一步
AWS 宣布,Amazon Bedrock 现已在首尔(ap-northeast-2)和新加坡(ap-southeast-1)两个区域支持 Anthropic 模型的区域内推理(in-region inference)。具体而言:
- 首尔区域:支持 Claude Opus 5 和 Claude Sonnet 5
- 新加坡区域:支持 Claude Sonnet 5
对于在韩国或新加坡有本地数据处理要求的客户——例如金融服务、医疗健康、公共部门——现在可以大规模使用这些模型,且推理请求与数据完全在调用所在区域内处理,不会离开该区域。
区域内推理与跨区域推理有何不同
Amazon Bedrock 提供的区域内推理,核心价值在于帮助客户满足严格的数据驻留(data residency)要求。与跨区域推理配置文件不同,区域内推理没有路由层:你发往首尔或新加坡区域的请求,仅由该区域独立处理,输入提示词与输出结果在整个请求生命周期内都停留在该区域内。
代价是,吞吐量受该区域自身容量限制,请求受各区域服务配额约束。计费遵循所调用区域的标准按需定价;配额消耗、Amazon CloudWatch 指标以及 AWS CloudTrail 日志条目,均限定在同一区域内,监控时无需区分来源与目标区域。
如何开始使用
区域内推理通过 bedrock-runtime 端点提供。对于新应用,AWS 推荐使用该端点,并以直接模型 ID 调用,例如 anthropic.claude-opus-5 或 anthropic.claude-sonnet-5。
它支持 Anthropic 的 Messages API,以及 Amazon Bedrock 的 InvokeModel API 和 Converse API,同时兼容 Amazon Bedrock Guardrails 和智能提示词路由等特性。
这意味着,无论是从 Amazon Bedrock 控制台,还是通过代码接入,开发团队都可以在满足合规前提下,将 Claude 模型能力部署到亚太本地业务场景中。
谁最该关注
对于受监管行业而言,数据不能出境往往是采用生成式 AI 的首要障碍。此次首尔与新加坡的区域内推理支持,直接回应了这一痛点:合规团队无需再为数据跨境流动额外评估,工程团队也能以标准 API 方式快速集成。
需要注意的是,区域内推理的容量与配额由单一区域决定,高并发场景下可能需要提前规划配额申请。
