SheepNav
新上线今天0 投票

AWS 在首尔与新加坡上线 Anthropic 模型区域内推理,满足本地数据合规需求

亚太本地推理再进一步

AWS 宣布,Amazon Bedrock 现已在首尔(ap-northeast-2)和新加坡(ap-southeast-1)两个区域支持 Anthropic 模型的区域内推理(in-region inference)。具体而言:

  • 首尔区域:支持 Claude Opus 5 和 Claude Sonnet 5
  • 新加坡区域:支持 Claude Sonnet 5

对于在韩国或新加坡有本地数据处理要求的客户——例如金融服务、医疗健康、公共部门——现在可以大规模使用这些模型,且推理请求与数据完全在调用所在区域内处理,不会离开该区域。

区域内推理与跨区域推理有何不同

Amazon Bedrock 提供的区域内推理,核心价值在于帮助客户满足严格的数据驻留(data residency)要求。与跨区域推理配置文件不同,区域内推理没有路由层:你发往首尔或新加坡区域的请求,仅由该区域独立处理,输入提示词与输出结果在整个请求生命周期内都停留在该区域内。

代价是,吞吐量受该区域自身容量限制,请求受各区域服务配额约束。计费遵循所调用区域的标准按需定价;配额消耗、Amazon CloudWatch 指标以及 AWS CloudTrail 日志条目,均限定在同一区域内,监控时无需区分来源与目标区域。

如何开始使用

区域内推理通过 bedrock-runtime 端点提供。对于新应用,AWS 推荐使用该端点,并以直接模型 ID 调用,例如 anthropic.claude-opus-5 或 anthropic.claude-sonnet-5。

它支持 Anthropic 的 Messages API,以及 Amazon Bedrock 的 InvokeModel API 和 Converse API,同时兼容 Amazon Bedrock Guardrails 和智能提示词路由等特性。

这意味着,无论是从 Amazon Bedrock 控制台,还是通过代码接入,开发团队都可以在满足合规前提下,将 Claude 模型能力部署到亚太本地业务场景中。

谁最该关注

对于受监管行业而言,数据不能出境往往是采用生成式 AI 的首要障碍。此次首尔与新加坡的区域内推理支持,直接回应了这一痛点:合规团队无需再为数据跨境流动额外评估,工程团队也能以标准 API 方式快速集成。

需要注意的是,区域内推理的容量与配额由单一区域决定,高并发场景下可能需要提前规划配额申请。

延伸阅读

  1. Google 发布 Gemini 4 Argon,号称迄今最强模型,专攻网络安全与编程
  2. AI硬件设计新星Flow Engineering获5000万美元B轮融资,估值达7.5亿美元
  3. Google 发布 Gemini 4,宣称能力过强仅限“可信网络防御者”使用
查看原文