孤本网
/ 0 阅读
0
0

华为发布 AI 数据平台三项升级路线,聚焦本体构建、KV 直通与数据韧性

一句话结论

华为发布 AI 数据平台升级路线,通过知识本体、KV 直通与数据韧性三大技术,解决智能体“模型不知道的事”。

关键要点

  • 华为 AI 数据平台升级三条路线:数据本体、原生 KV 语义直通、智能体数据韧性。
  • 本体构建需将智能体任务正确率提升至 90% 以上。
  • KV Cache 通过三级缓存架构,首 Token 时延降低 80%,可降至 10 秒以内。
  • 存储 I/O 时延从 350 微秒降至 55 微秒,单框带宽达 1TB/s。
  • 数据韧性目标:秒级风险拦截、分钟级数据一致性恢复,预测拦截 99% 高风险操作。

背景与事实

在 9 月 17 日举行的华为全联接大会 2026“华为数据存储峰会”上,华为公司副总裁、数据存储产品线总裁袁远提出,华为 AI 数据平台未来将沿着三条路线升级:数据本体、原生 KV 语义直通、智能体数据韧性。

数据本体针对智能体知识检索局限问题。以国内某三甲医院实践为例,采用 AI 数据平台构建专业知识库后,AI 辅助诊断报告采纳率从 50% 提升至 90%,智能体每日调用次数从 2000 次增加至 16000 次。但医疗场景暴露了知识检索局限:关于疾病、药物、症状的材料可以快速找到,但如果一名患者同时有多种疾病,正在服用一种药物的同时,又存在特殊的检查结果,组合这些信息成为难题。

华为将数据本体建设放在三大创新的第一项,通过实体抽取、关系抽取、关系增强和层级组织,将语义信息用于智能体的意图理解、任务规划、执行调用与结果验证。模型参与实体提取和知识关系更新,通过数据本体定义知识间关系,将智能体任务正确率提升至 90% 以上。

原生 KV 语义直通解决推理性能瓶颈。KV Cache 保存推理中产生的注意力键值缓存,在满足复用条件时减少已有上下文的重复计算。长任务越多,保存和复用这些缓存的需求越突出。传统架构中,将 KV Cache 缓存全部放在显存和内存里会导致存储空间捉襟见肘,出现 KV Cache 溢出、频繁淘汰等问题。

华为 AI 数据平台中的 KV Cache 库与 UCM(Unified Cache Manager)承担多级缓存统一调度工作。将外置全闪存储(以 OceanStor A800 为例)的 SSD 用作第三级缓存,承接显存与内存溢出的缓存数据,大幅扩充 KV Cache 缓存空间。通过前缀缓存等能力实现“以查代算”后,首 Token 时延降低 80%,可降至 10 秒以内。

存储 I/O 时延从 350 微秒降至 55 微秒,单框带宽达到 1TB/s,KV Cache 加载速度提升 2 倍。

智能体数据韧性处理操作风险。华为提出的第三条创新路线包括实时分析智能体意图和异常行为,联动告警、阻断、安全快照及恢复机制,目标是实现秒级风险拦截、分钟级数据一致性恢复。同时通过 AI 勒索检测以及主存、备份联动应对外部攻击,预测并提前拦截 99% 高风险操作、实现 99% 勒索软件检测率。

影响分析

这对中文开发者与从业者的实际影响是:AI Agent 开发需从单纯接入文档转向构建结构化知识本体,存储架构需支持多级缓存管理。

对于企业 IT 部门,数据本体建设意味着需投入大量技术和业务人员梳理业务知识,将分散在文件、系统和老员工工作习惯中的关系明确记录下来。本体建设不会因为有模型参与就变得轻松,一个名称对应多个业务含义、两套系统对同一指标采用不同口径的情况仍普遍存在。模型可以帮助抽取,但抽取出来的关系是否正确仍需领域知识检验。内容更新也要跟上:制度改了,旧关系何时失效;源文件被修订,哪些推理依据应跟着调整,这些细节决定本体能否长期使用。

对于性能优化,KV Cache 三级缓存架构提供明确的技术路径。当大量历史计算结果值得复用时,如何访问这些结果会影响计算侧效率。传统以文件方式承载 KV 数据需经过转换、查目录、找文件、读取再转换的复杂过程,原生 KV 语义直通与参数面网络直通减少协议转换和中间访问环节。

对于风险控制,数据韧性要求企业建立秒级拦截和分钟级恢复能力。批量删除可能是危险操作,也可能是合法的数据清理,拦得过多业务难以继续,拦得太少保护失去意义。实际部署需结合检测范围、误报漏报和业务规则评估。数据恢复也需处理多份关联数据的一致性,只恢复其中一份后续流程可能仍然出错。

适用边界

上述结论在以下条件下不成立:

  • 仅接入文档而未构建结构化知识本体的场景,任务正确率难以达到 90% 以上。
  • 未部署 UCM 及外置全闪存储的多级缓存架构,KV Cache 溢出和频繁淘汰问题仍会存在。
  • 未配置实时分析智能体意图和异常行为机制,数据韧性目标(秒级拦截、分钟级恢复)无法实现。
  • 医疗、采购等强领域知识场景,若缺乏领域专家参与本体构建和关系检验,本体质量无法保证。
  • 高并发短任务场景,KV Cache 复用的收益相对有限,优化优先级可能降低。

孤本观察

华为作为存储厂商同时关注知识组织、推理性能与操作风险,反映 AI 数据平台已从单纯存储扩展到智能体全生命周期管理。

企业评估 AI 数据平台时,应请业务专家带来公司内部真正棘手的问题进行测试,看智能体能否找到依据、处理冲突并明确何时请求帮助,比单纯接入更多文档更接近实际工作需求。

华为发布 AI 数据平台三项升级路线,聚焦本体构建、KV 直通与数据韧性

华为发布 AI 数据平台三项升级路线,聚焦本体构建、KV 直通与数据韧性

华为发布 AI 数据平台三项升级路线,聚焦本体构建、KV 直通与数据韧性

华为发布 AI 数据平台三项升级路线,聚焦本体构建、KV 直通与数据韧性

华为发布 AI 数据平台三项升级路线,聚焦本体构建、KV 直通与数据韧性

常见问题

华为 AI 数据平台通过三级缓存架构优化后,首 Token 时延能降低多少?

通过三级缓存架构,首 Token 时延降低 80%,可降至 10 秒以内。

华为 AI 数据平台升级后,KV Cache 加载速度和存储 I/O 时延表现如何?

KV Cache 加载速度提升 2 倍,存储 I/O 时延从 350 微秒降至 55 微秒。

华为智能体数据韧性路线的目标风险拦截率是多少?

预测并提前拦截 99% 的高风险操作,实现 99% 勒索软件检测率。

在华为 AI 数据平台本体构建实践中,AI 辅助诊断报告采纳率有何变化?

AI 辅助诊断报告采纳率从 50% 提升至 90%,智能体每日调用次数增加至 16000 次。

为什么未部署 UCM 及外置全闪存储会导致 KV Cache 出现问题?

未部署该多级缓存架构时,KV Cache 仍会面临存储空间不足导致的溢出和频繁淘汰问题。

来源:InfoQ 中文 AI


评论