当智能体开始替人操作系统、调用工具、执行任务,安全规则必须跟得上它的权限。10月上旬,全国网络安全标准化技术委员会下达智能体应用安全强制性国家标准计划,这项由中国移动牵头起草的标准,将把智能体的身份标识、权限调用、高风险操作人工介入、紧急关停等环节纳入强制要求。与此同时,首部生成式AI安全分级标准也即将落地实施,中国AI治理正在完成从倡导自律到硬约束的关键一跃。
从披露的起草方向看,标准瞄准的是智能体最危险的四个环节。身份标识解决的是谁在操作的问题,智能体执行动作时必须可识别、可追溯,杜绝冒用用户身份的灰区;权限调用解决能碰什么的问题,工具与数据的访问范围要有明确边界和审批链路;高风险操作人工介入针对转账、删除、发送这类不可逆动作,把最终决定权留给人;紧急关停则兜底失控场景,确保任何时刻都能一键中断。这四条恰好对应了全球范围内智能体事故的四大根源,针对性极强,也意味着未来智能体产品的安全设计文档,将围绕这四张清单逐项展开。
时间点选得很讲究。过去几个月,海外智能体安全事故接连曝光:头部厂商的智能体越权访问政府网站、外泄用户内容、执行命令注入,一家公司为此通知了上百家受影响组织,监管机构随之启动大范围调查。国内市场上,智能体产品数量爆发式增长,个人助理、办公智能体、数字员工全面铺开,权限边界却大多靠企业自律。在事故案例与产业规模同时到位的节点立法,既避免过早扼杀创新,也防止风险积累到不可收拾,这个节奏与此前生成式内容管理办法的推出时机有异曲同工之妙。
牵头方是中国移动这一细节也值得留意。运营商既运营海量网络基础设施,又直接面向数亿用户提供智能体服务,是智能体滥用风险的第一线承受者。由最有动机把安全做实的主体牵头起草,标准的可执行性会比纯学术或纯监管视角的文本更接地气,条款落到的都是运营中真实会疼的地方。
与强制国标配套推进的,是首部生成式AI安全分级标准,电信和互联网生成式人工智能服务安全分级指南拟于10月8日实施。它的核心贡献是把安全从一句口号变成一套可度量的标尺:按服务场景、用户规模、内容风险等维度给生成式AI服务划定等级,不同等级对应不同的评估要求与监管强度。对平台来说,上线前先定级再合规,流程从模糊变清晰,评估过一次的成果还能在同类服务中复用,边际成本递减;对监管来说,分级管理让有限的审核资源集中到高风险服务上,治理效率大幅提升。分级与国标一软一硬互相咬合,前者给企业一张自查的地图,后者划出不可逾越的红线,这种组合拳在国内平台的治理工具箱里并不多见。
两条线合起来看,一套完整的治理拼图正在成形:分级指南管准入,国标管运行,内容标识规则管溯源,再加上海外市场已经跑通的审计与事故报告机制作参照。对开发者与运营方,合规不再是发布前的走过场,而是贯穿产品生命周期的工程科目,从需求评审阶段就要把安全需求写进设计文档。
硬约束抬高了门槛,也重新分配了机会。对头部平台,强制标准实际上是利好:安全工程投入本来就是它们的强项,标准落地后小团队的跟跑成本骤增,行业集中度有望进一步提升。对安全厂商,智能体权限审计、越权检测、行为日志分析将成为新的产品线,安全能力第一次在智能体赛道有了明确的付费方。对出海企业,国内的分级思路与国际上兴起的前沿模型安全承诺、第三方评估机制逻辑相通,一套合规底座多个市场复用,是值得提前规划的架构决策。
给从业者的建议很具体:先把智能体的每一次工具调用记录下来,做到可回放、可审计,这是所有后续合规动作的地基;再把高风险操作清单化,逐项设计人工确认与紧急中止机制;最后对照分级指南预判自身等级,把评估所需的文档与测试提前备齐,别等检查来了再翻箱倒柜。智能体时代的安全竞争,比的不是谁跑得快,而是谁能在监管亮牌之前就把底牌整理干净。规则落地只是时间问题,先跑通合规的企业,将拿到下一阶段的入场券。
把这份标准放到全球治理的坐标系里,其位置更加清晰。海外市场近一年形成了两条治理线索:一是政府主导的安全承诺与行政令,要求前沿模型厂商做出内部评估与外部审计的承诺;二是行业自发的评估组织与第三方审计机制,用独立复核对冲厂商自证的局限。国内的分级加国标组合,走的同样是分级管理加强制底线的技术治理路线,思路相通而抓手更具体,企业只要建好一套合规底座,多市场复用是完全可行的架构选择。
值得关注的还有标准的辐射效应。牵头起草方来自电信运营商阵营,意味着规则将从通信与互联网服务的主阵地率先执行,金融、医疗等垂直行业大概率会在国标基础上叠加更严的行业标准,形成国标打底、行标加高的双层结构。对做智能体产品规划的人来说,按高于当前业务场景一档的要求预埋安全能力,比事后补课便宜得多,合规预算应该被当作产品成本而不是法务费用来规划。