鲸苇科技
首页 / 技术经验 / 文章详情

技术经验

企业智能体调用内部数据时怎么拦下外部工具:把数据边界划在调用前还是调用后

面向给业务部门配智能体的 IT 负责人和安全合规岗,梳理智能体在调用内部客户数据、订单数据、财务数据时,怎么拦下要发往外部工具的请求,按什么规则把数据边界划在调用前、调用中还是调用后,并说明 ClawMercs 企业智能体中心在数据边界上的常见做法。

企业智能体调用内部数据时怎么拦下外部工具:把数据边界划在调用前还是调用后配图

企业智能体最让安全合规头疼的不是不能干活,是干活时把内部数据送出去了。客服智能体调用客户档案回答问题,结果把客户的身份证号、银行卡号、合同金额发给了外部翻译工具;财务智能体调用订单数据核算,结果把订单明细、供应商名单发给了外部图表工具;运营智能体调用库存数据生成报表,结果把库存地址、供应商报价发给了外部搜索引擎。这背后的核心难题不是智能体越权,是数据边界没有划清。

数据边界出现漏洞的原因有三个。第一是边界划得太晚,等智能体已经把内部数据拼进 prompt 才拦截,敏感数据已经离开内网;第二是边界划得不一致,敏感字段在 A 工具拦截、在 B 工具不拦截,规则散落在多个配置文件;第三是边界没有审计,智能体调用了什么数据、发给了哪个外部工具、谁审批的,没记录就追不了责。

把数据边界划清可以参考三种划法。第一种是调用前拦截,智能体在调用内部数据前先匹配敏感字段规则,命中的字段直接替换为占位符或脱敏值,整个调用链路不会接触到原始数据;第二种是调用中拦截,智能体拼装 prompt 时实时检查敏感字段,命中规则立刻拦截并告警;第三种是调用后拦截,智能体已经发到外部工具但工具返回结果时再审查,发现泄露再回滚。调用前最安全但需要规则覆盖所有字段;调用中灵活但需要实时计算;调用后风险高但实现简单。

判断划哪种边界可以参考三个判断点。第一是看数据敏感度等级,高敏感字段(身份证、银行卡、合同金额)必须用调用前拦截;第二是看智能体调用频率,高频调用的智能体用调用中拦截成本高、风险大;第三是看合规要求,金融、医疗、政企客户必须审计每一次调用的数据,按调用后拦截加全量审计。

这套做法适用于已经把智能体接入业务系统的企业。如果智能体还没接入生产系统,先把数据分级和字段清单做好;如果智能体已经接入但还没发生数据泄露事件,建议先做调用前拦截;如果是金融、医疗类高合规要求企业,必须调用前拦截加全量审计。

ClawMercs 企业智能体中心在数据边界上做了专门设计。系统按字段分级维护敏感字段规则,调用前自动替换身份证、银行卡、合同金额为脱敏值,调用中实时检查 prompt 内容并告警,调用后记录每一次数据外发的工具名、数据字段、审批人;按智能体配置不同的边界策略,财务智能体用调用前拦截、客服智能体用调用中拦截、运营智能体用调用后拦截加审计。如果已经在用 ClawMercs 企业智能体中心,可以直接在数据边界配置里启用按智能体分级的拦截策略;如果还在用通用智能体框架,建议先把字段分级、规则配置、审计日志三套字段打通,再做数据边界。

落地可以按三步推进。第一步梳理过去一个月内所有智能体调用内部数据的记录,标记敏感字段出现的位置;第二步按上面的三个判断点给每个智能体配置不同的边界策略;第三步用 ClawMercs 或类似系统把边界策略固化,并按月复盘敏感字段外发次数和审计通过率。

END沟通业务需求
联系我们