孤本网
/ 0 阅读
0

Amazon Bedrock 知识库支持自然语言理赔查询,引入代理式检索与接地检查

一句话结论

亚马逊云科技推出 Bedrock 知识库理赔查询方案,支持多轮代理检索、自动引用及接地护栏,降低幻觉风险。

关键要点

  • Amazon Bedrock Knowledge Bases 提供全托管 RAG 能力,自动完成文档解析、分块、嵌入及向量存储,无需手动配置向量数据库。
  • AgenticRetrieveStream API 支持将复杂问题拆分为子查询并多次检索,流式返回答案、引用及检索追踪事件,引用通过字符跨度映射至源文档。
  • 系统强制使用 Amazon Bedrock Guardrails 上下文接地检查,拦截低于设定阈值的响应,在理赔场景中优先拒绝回答而非生成无依据内容。
  • 在 40 题测试中,普通检索召回率为 90.5%,引用召回率 81.2%;对抗性测试中检索召回率达 96.7%,引用召回率 90.2%,且与过滤器矛盾的分块数为 0。
  • 元数据侧车文件限制为 10KB,支持数值范围比较;访问控制必须通过认证会话推导区域及客户 ID 过滤器,严禁接受用户自由文本作为边界。

背景与事实

亚马逊云科技在 Amazon Bedrock(亚马逊云科技 Bedrock)平台发布了基于知识库的自然语言理赔查询功能。该方案允许用户使用自然语言查询存储在 Amazon S3(亚马逊云科技简单存储服务)中的理赔文档,支持 PDF、Word 及纯文本等原生格式。每个理赔文档对应一个同名的 .metadata.json 元数据侧车文件,该文件限制大小为 10KB,包含 claim_id、status 等字符串或布尔类型,以及 amount、date_filed 等数字类型字段。日期以 YYYYMMDD 整数格式存储,以支持“上个月”等数值范围比较;金额字段仅存储单一可比较值,明细保留在正文中。

创建知识库时,系统通过 bedrock-agent 客户端将嵌入模型类型设为 MANAGED,由 Amazon Bedrock 自动选择并运行嵌入模型,无需用户配置底层向量存储。通过 service role 授予知识库读取 S3 桶的权限,并可使用 AWS KMS 密钥对托管向量存储进行静态加密。摄取路径通过 StartIngestionJob 启动解析、分块、嵌入及索引任务,文档更新后需重新运行任务以同步索引,状态可通过 get_ingestion_job 或控制台检查。检索路径调用 AgenticRetrieveStream API,结合 Amazon Bedrock Guardrails 进行上下文接地检查,最终返回带有引用的自然语言答案。

影响分析

该方案对中文开发者及理赔行业从业者具有显著的落地参考意义。首先,全托管的 RAG 架构消除了自建向量数据库的运维负担,使团队能聚焦于理赔业务逻辑而非底层基础设施。其次,引入“代理式检索”(Agentic Retrieval)机制,系统将复杂问题拆解为子查询并验证证据充分性,解决了传统单次检索在处理多部分问题时的局限性。对于涉及合规要求的金融保险场景,强制性的接地护栏与最小权限访问控制模型,为 AI 生成内容提供了安全边界。但需明确,此方案目前基于合成数据演示,面向生产环境部署前必须经过人工审查与对抗性测试,不能完全依赖自动评分结果。

适用边界

该结论适用于核保、保单服务等具有明确结构化元数据及文档边界的窄域场景。若查询涉及宽泛无过滤的库存类问题或开放式探索,系统表现最弱。此外,引用覆盖率并不保证答案的完整性,且该架构不替代最终的人工决策,所有理赔决定仍需保留人在回路机制。若元数据侧车超过 10KB 限制,或需要处理非结构化的复杂附件,该方案需进行额外适配。

孤本观察

编辑判断显示,该方案在对抗性测试中将检索召回率提升至 96.7%,表明“拆分问题+多次验证”的代理策略比单次检索更具备鲁棒性。同时,将“拒绝回答”设定为接地失败后的默认行为,反映了在高风险领域对幻觉容忍度极低的设计哲学。

常见问题

Amazon Bedrock 知识库元数据侧车文件的大小限制及日期存储格式是什么?

元数据侧车文件限制为 10KB。日期以 YYYYMMDD 整数格式存储,以支持数值范围比较。

在 40 题测试中,普通检索与对抗性测试的召回率分别是多少?

普通检索召回率 90.5%,引用召回率 81.2%;对抗性测试检索召回率 96.7%,引用召回率 90.2%。

AgenticRetrieveStream API 如何处理复杂问题及返回结果?

该系统将复杂问题拆分为子查询并多次检索,流式返回答案、引用及检索追踪事件,引用映射至源文档。

Amazon Bedrock 知识库对访问控制有何具体限制?

访问控制必须通过认证会话推导区域及客户 ID 过滤器,严禁接受用户自由文本作为边界。

如果接地检查低于设定阈值,系统会如何响应?

系统强制使用 Amazon Bedrock Guardrails 拦截低于阈值的响应,在理赔场景中优先拒绝回答而非生成无依据内容。

来源:AWS Machine Learning Blog