网信办《实施意见》提出健全智能体合规服务体系:企业采购不能只看模型能力

2026年5月8日,中央网信办、国家发展改革委、工业和信息化部联合印发《智能体规范应用与创新发展实施意见》。文件将智能体定义为具备自主感知、记忆、决策、交互与执行能力的智能系统,并提出健全智能体合规服务体系,强化技术监测、风险预警、检测评估、咨询和认证等支撑。对准备采购或部署智能体的企业而言,选型标准正在从“模型能做什么”转向“企业能否安全、持续地使用”。

企业围绕智能体采购开展能力与合规评审

合规服务体系,首先改变智能体的采购逻辑

传统软件采购往往围绕功能、性能、价格和交付周期展开。智能体具有自主规划、调用工具、长期记忆和执行任务等特征,使用边界并不完全由单一模型决定,还取决于数据来源、权限配置、外部工具、人工复核和运行环境。

《实施意见》提出,坚持安全可控,将智能体安全、可靠、可信贯穿技术研发、应用部署与推广全过程;同时完善标准体系,降低智能体研发、适配和应用门槛。这意味着企业采购时不能只测试回答质量,也不能把模型参数、演示效果或单次准确率直接等同于可上线能力。

采购文件至少应把以下问题写清楚:

  • 智能体具体服务哪些业务任务,哪些任务明确禁止自动执行;
  • 它能够访问哪些数据、系统和工具,权限如何授予、收回和审计;
  • 关键决策是否需要人工确认,异常情况下如何暂停或回滚;
  • 供应商能否提供检测评估、风险监测、问题处置和版本变更材料;
  • 服务中断、模型替换、数据泄露或行为失控时,双方如何分工和响应。

这里的重点不是把所有风险都转移给服务商,而是将风险控制要求前置到合同、技术架构和验收标准中。

技术评测:从模型能力测试转向任务闭环测试

智能体的评估对象不应只是底层模型,而应是“模型、提示、工具、数据、权限和人工流程”组成的完整系统。

企业在上线前可以按照业务任务建立测试集,至少覆盖四类场景:

任务完成与结果可靠性

测试智能体能否正确理解任务、规划步骤、调用工具并完成闭环。对于财务、人力、客服、研发等场景,还应检查引用依据、输出格式、异常信息和人工复核节点,而不是只看最终答案是否流畅。

越权与误操作

通过模拟恶意指令、冲突指令、异常权限和不完整信息,检查智能体是否会访问无关数据、调用超出授权范围的工具,或者在缺少确认的情况下执行高风险动作。国家网信办在答记者问中提到,智能体的高自主性、高权限可能带来隐私泄露、越权操作和行为失控等风险,这些应成为企业测试的重点。

稳定性与可追溯性

企业需要确认系统能否记录任务输入、关键决策、工具调用、人工干预和最终结果。发生错误时,能够定位是模型判断、数据问题、权限配置还是工具接口导致,而不是只能得到一条无法复盘的最终输出。

版本变化与持续评估

模型、知识库、插件和策略更新都可能改变智能体行为。验收不能只进行一次,企业应在供应商版本变更、业务规则调整和重大安全事件后重新评估,避免“上线时合格、运行后失控”。

供应商尽调:重点核验其能否提供持续服务

《实施意见》提出健全智能体合规服务体系,涉及风险监测预警、检测评估、咨询和认证等服务方向。对采购方来说,这些服务不应被理解为一张孤立的合规证书,而应转化为供应商可交付、可验证的运营能力。

供应商尽调可重点核验以下内容:

  1. 检测评估能力:是否能够针对企业实际业务进行测试,是否说明测试范围、方法、样本和限制条件。
  2. 风险监测能力:是否能持续发现异常调用、敏感信息暴露、越权行为、错误执行和服务波动,并提供告警记录。
  3. 预警与响应机制:发现重大风险后,谁负责通知企业,多久响应,是否支持暂停服务、撤销权限或回滚版本。
  4. 咨询支持范围:咨询是否覆盖部署架构、数据治理、权限管理、人工复核和运营制度,而不是只提供通用材料。
  5. 认证或评估结果的边界:认证针对的是具体产品、版本、场景还是某一时间点,是否存在适用条件和有效范围。
  6. 变更管理机制:模型、算法、工具接口、数据处理方式发生变化时,供应商是否提前告知并配合重新评估。

企业还应将上述内容写入采购合同和服务级别协议,形成可验收的交付物,例如评估报告、风险清单、监测报表、事件通报记录、版本变更说明和整改闭环记录。

上线运营:把风险监测纳入日常管理

智能体上线后,风险监测不能只由技术团队临时处理。企业应建立业务、技术、安全、法务和管理层之间的协同机制,明确不同风险的处置权限。

一个可执行的运行流程可以分为四步:

  • 日常监测:关注调用量、失败率、异常工具调用、敏感数据访问和人工接管情况;
  • 分级预警:按照影响范围和业务后果区分一般异常、重大异常和需要立即暂停的事件;
  • 应急处置:保留关闭高风险工具、冻结账号、回滚版本和切换人工流程的能力;
  • 运营复盘:分析事件原因,更新测试集、权限策略、知识库和操作规程。

尤其是在能够直接发送邮件、修改业务数据、执行交易或控制设备的场景中,企业应设置最小权限、双重确认和人工兜底。对低风险的信息检索类任务,可以采用更灵活的自动化方式;对涉及重要数据、资金、生产和公共服务的任务,则应提高评估和审批强度。这是企业根据实际业务风险进行分级管理的落地方法,不等同于对具体场景作出新的监管认定。

企业上线前核验清单

在签约或上线前,管理者可以用以下清单进行一次跨部门核验:

  • 是否明确智能体的业务目标、适用范围和禁用范围;
  • 是否完成真实任务场景下的能力、稳定性和安全测试;
  • 是否梳理数据来源、保存方式、访问权限和删除机制;
  • 是否限制智能体调用外部工具的范围,并保留调用日志;
  • 是否设置人工确认、异常中止和回滚机制;
  • 是否核验供应商的检测评估、风险监测、咨询和事件响应能力;
  • 是否要求供应商说明认证或评估结果的对象、范围、版本和有效条件;
  • 是否约定模型、知识库、插件和接口发生变化时的通知与复评机制;
  • 是否明确企业、供应商及其他参与方在开发、部署和运营环节的工作边界;
  • 是否建立上线后的监测、预警、应急和复盘制度。

编辑观察:合规服务将成为智能体采购的基础设施

这份《实施意见》的直接信号,是智能体的规模化应用需要与标准、监测、评估和服务体系同步推进。对企业来说,合规不应停留在采购阶段的一份材料,也不应被简化为供应商提供的单项认证,而应成为贯穿选型、测试、上线和运营的管理流程。

因此,企业评价智能体时,除了问“它能完成什么任务”,还应继续追问三个问题:风险能否被发现,异常能否被控制,问题能否被复盘。只有当模型能力、权限边界、检测评估和持续监测形成闭环,智能体才更可能从演示系统转化为可持续使用的业务系统。

资料来源:中央网络安全和信息化委员会办公室《智能体规范应用与创新发展实施意见》(2026年5月8日):https://www.cac.gov.cn/2026-05/08/c_1779979789523320.htm;《〈智能体规范应用与创新发展实施意见〉答记者问》(2026年5月8日):https://www.cac.gov.cn/2026-05/08/c_1779979789738376.htm

关于文章版权的声明:

https://news.softunis.com/75105.html 文章来自软盟资讯

若非本站原创的文章,特别作如下声明:

本文刊载所有内容仅供提供信息交流和业务探讨而非提供法律建议目的使用,不代表任何监管机构的立场和观点。不承担任何由于内容的合法性及真实性所引起的争议和法律责任。

凡注明为其他媒体来源的信息,均为转载,版权归版权所有人所有。

如有未注明作者及出处的文章和资料等素材,请版权所有者联系我们,我们将及时补上或者删除,共同建设自媒体信息平台,感谢你的支持!

(0)
美国两党议员提出《停止失控AI法案》:智能体安全标准将如何影响企业部署?
上一篇 2026年9月12日 15:01
网信办实施意见提出完善智能体工具链:企业采购如何从模型评测转向任务闭环
下一篇 2026年9月12日 15:31

相关文章推荐

发表回复

登录后才能评论