跳到正文
热点事件持续更新

AWS发布Bedrock AgentCore评估框架与GovCloud合规指南

2 篇报道1 个报道来源1 小时前更新

先了解这件事

AI 综述

2026年10月5日,AWS发布Amazon Bedrock AgentCore Evaluations,通过内置与自定义评估器量化多智能体系统在任务成功、指令遵循及可解释性等维度的表现,支持按需开发与在线生产监控模式。该方案结合Amazon Bedrock Guardrails,实现从开发基准测试到持续生产监测的闭环验证。次日(10月6日),AWS进一步发布教程,指导开发者将Anthropic的Claude Code接入Amazon Bedrock,使其能在AWS GovCloud (US)区域运行,以满足ITAR、FedRAMP Class D及DoD IL4/IL5等严格合规要求,确保数据不出GovCloud基础设施。

AI 根据报道生成 · 1 小时前更新

事件进展

2 个进展
  1. 10月6日 01:25 · 1 篇报道
    Claude Code 支持在 AWS GovCloud 运行
    AWS Machine Learning Blog:AWS 发布指南:如何在 GovCloud 中配置 Claude Code 以运行受监管工作负载
  2. 10月5日 23:50 · 1 篇报道
    AWS发布Bedrock AgentCore评估框架与Guardrails
    AWS Machine Learning Blog:Amazon Bedrock AgentCore 如何评估多智能体系统的可解释性与有用性

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. AWS Machine Learning Blog精选
    AWS 发布指南:如何在 GovCloud 中配置 Claude Code 以运行受监管工作负载

    AWS 发布教程,指导开发者将 Anthropic 的 agentic coding 工具 Claude Code 接入 Amazon Bedrock,使其能在 AWS GovCloud (US) 区域运行,从而满足 ITAR、FedRAMP Class D 及 DoD IL4/IL5 等严格合规要求。该方案允许在本地终端或 IDE 中使用 AI 辅助开发,同时确保数据不出 GovCloud 基础设施。 文章核心在于对两种 Bedrock 端点的技术取舍:bedrock-runtime 支持 Guardrails(护栏)和 invocation logging(调用日志),适合需要完整审计追踪的场景;而 bedrock-mantle 原生支持 Anthropic Messages API,提供 server-side tools 和 Projects 等功能,但仅限 us-gov-west-1 区域且无日志能力。对于必须保留审计记录的组织,官方推荐优先使用 runtime 端点。 在成本与治理层面,材料指出 Claude Opus 5.5 虽单次任务 token 消耗更少,但单价高于 Sonnet 5.5,建议默认团队使用 Sonnet 5.5 仅在深度推理场景切换至 Opus。为防止失控,文章提供了具体的实施路径,包括通过 IAM Identity Center 管理身份、设置 per-user token guardrails(每日令牌限额)、利用 CLAUDE.md 文件统一代码规范以及通过 hooks 强制执行自动化检查。

10月5日
  1. AWS Machine Learning Blog
    Amazon Bedrock AgentCore 如何评估多智能体系统的可解释性与有用性

    Amazon Bedrock AgentCore Evaluations 通过内置与自定义评估器,直接量化多智能体系统在任务成功、指令遵循及可解释性等维度的表现。该方案支持按需开发与在线生产监控模式,结合 Amazon Bedrock Guardrails 实现从开发基准测试到持续生产监测的闭环验证。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。