Amazon Bedrock Guardrails
Amazon Bedrock Guardrails 是面向生成式 AI、模型、RAG 或 Agent 风险控制的 AI 安全工具。
分类:云模型 Guardrails 与策略治理
公司 / 团队:Amazon Web Services
详细介绍
该工具的主要能力包括内容过滤、拒绝主题、敏感信息过滤与遮蔽、词语过滤、上下文相关性检查、Automated Reasoning Checks、越狱/提示词注入与提示词泄露检测。
AI 安全工具的真实效果取决于模型、语言、攻击方法、上下文长度、输入模态、系统提示、RAG 数据、工具权限、部署位置、阈值、规则、版本和业务容错。详情页应把防护位置、风险类型、模态、动作、API、延迟、部署方式、数据处理、日志、评测结果和产品状态拆成动态字段维护。
适合场景
- Bedrock 模型应用
- 多模型统一策略
- RAG 输入输出控制
- 敏感数据保护
- 企业 Agent 安全
使用注意
- 不同 Guardrail 能力、地区和套餐状态可能不同
- 提示词攻击过滤在部分调用流程中需要正确标记输入区域
- 策略必须与 IAM、网络、日志和人工审批结合
- 上线前应建立正常样本、边界样本、已知攻击、未知变体、跨语言、多模态和故障场景测试集,并完成权限审查、红队、安全评审、日志、回滚和应急预案。