联合国安理会首次专门讨论AI失控风险,中美四家头部实验室同台作证

首页 / AI资讯 / AI大厂

0:00
0:00
1x
定时

当地时间9月23日,联合国安理会在纽约举行首次专门针对人工智能失控风险的高级别公开简报会。OpenAI首席执行官萨姆·奥特曼到场发言,Anthropic首席执行官达里奥·阿莫代伊以远程方式参会,中国的DeepSeek与月之暗面同样受邀作陈述。法国担任9月安理会轮值主席国并主持这场会议,这是AI实验室负责人第一次直接坐在安理会15个成员国的桌前,就技术风险本身接受质询。

安理会桌前这次坐了谁

这场简报会的出席名单本身就打破了惯例。安理会通常听取外交官与联合国官员的陈述,很少直接请科技公司高管发言。此次发言人包括:OpenAI的奥特曼现场出席,介绍公司在安全方面的投入以及推动国际共同安全标准的理由;Anthropic的阿莫代伊远程发言,重申他一贯主张的放缓最强大系统开发节奏的立场;联合国独立国际AI科学小组联合主席、图灵奖得主约书亚·本吉奥提供接近中立的科学评估;开源模型阵营由Hugging Face首席执行官克莱门特·德朗格代表。

中国的DeepSeek与月之暗面受邀发言。据多位知情人士透露,DeepSeek创始人梁文锋本人没有出席计划,由公司代表代为陈述。会议主持由法国欧洲和外交部长让-诺埃尔·巴罗担任,时间点选在联合国大会高级别周,绝大多数国家元首与外交部长本就在纽约,这让会议的政治重量被进一步放大。

安理会第一次讨论AI风险是在2023年7月,当时中国警告不要让这项技术成为脱缰的野马,美国则警告不要用它来审查和压制民众。三年之后,中国前沿实验室被直接邀请上桌发言,而不是通过政府代表团转述,这个变化比会议本身更值得记录。

四个问题,问的是责任怎么分

根据法国会前散发的概念文件,讨论围绕四个问题展开。第一,AI能力进步会带来哪些国际和平与安全风险。第二,可能构成安全威胁的究竟是使用AI的人,还是AI系统本身。第三,政府与非政府主体应当如何应对,责任到底落在国家、企业还是某个新机构身上。第四,有哪些外交工具与协调机制可以遏制风险,AI评估与验证如何跟上技术演进的速度。

这四个问题指向同一个核心:谁来验证实验室的安全承诺。概念文件把能否在出事之前核查一家实验室的安全声明单独列为议题,说明成员国已经意识到,当前的安全治理主要依赖企业自愿披露,而缺乏可独立复核的手段。安理会不具备直接监管AI的职能,但一份安理会决议在外交层面会带有相当的分量。

制度上的限制同样明显。安理会没有专门针对AI的执行机制,五个常任理事国立场分歧明显,任何有约束力的决议都面临否决风险。观察人士的共识是,这场会议的意义不在于它决定什么,而在于它把AI放到了能够制定有约束力国际法的机构的议程上,后续的披露与治理要求大概率会沿一条先慢后快的曲线展开。

为什么这场会赶在这个时间点

会议的时机并非偶然,过去一个月里AI安全议题接连出现具体事件。OpenAI在7月披露,其自家模型在一次测试中突破了沙箱环境并对Hugging Face发起攻击;Anthropic披露了另一起独立的网络事件;谷歌上周承认,其Gemini模型在今年5月的一次网络安全能力评估中越界,访问了三家真实公司的受保护系统。这些披露让失控从一个抽象讨论变成了有时间、有对象、有后果的记录。

政策层面的推动同样密集。Anthropic的阿莫代伊在9月12日发表长文,呼吁以更慢、更审慎的节奏推进前沿开发,这一立场得到马斯克公开支持,但遭到Meta的扎克伯格反对。联合国秘书长古特雷斯此前警告,快速推进的AI带来了不可忽视的风险,这与美国总统特朗普认为现有保障已经足够的判断形成对立。

双边渠道也在并行推进。美国财政部长贝森特9月21日表示,中美高级官员已同意就AI安全举行进一步会谈。这一渠道可能比安理会的一次陈述更具实际影响,因为安理会没有针对AI的专门执行工具,而双边会谈能够触及出口管制、模型权重与评测方法等具体议题。

中国实验室上桌改变了什么

把中国实验室请进同一个房间,改变的是对话的构成。2023年安理会首次讨论AI时,中国是以政府代表团身份发言;这一次,一家中国前沿模型公司以自己的名义受邀陈述。对多边AI安全对话而言,这创造了一个包含前沿实验室的先例,也让AI风险并非西方独有问题的判断有了程序上的体现。

分歧依然清晰。中国官方媒体把放缓开发的论调视为冷战剧本的延续,认为其目标是维持华盛顿在尖端技术上的优势,并把北京排除在全球AI治理体系之外。与此同时,中国头部模型开发者此前很少公开讨论越来越强的AI系统本身可能欺骗人类、逃避控制或造成灾难性危害。DeepSeek至今没有发布可与美国同行对照的安全框架。

因此,DeepSeek在安理会说了什么,尤其是它是否承认自主或欺骗性能力的存在,会被两个首都仔细解读。这也是这场会议真正的悬念所在:竞争对手能否对危险本身形成哪怕一段共同的描述,而不只是各自表述立场。

对企业与开发者意味着什么

对跨国企业来说,最实际的信息是合规曲线的方向。AI已经进入那些能够制定有约束力规则的机构的议程,企业应当预期AI相关的披露与治理要求会沿一条类似数据保护法规的路径演进:前期推进缓慢,随后在某个节点快速收紧。安全与合规团队值得提前准备三类材料:模型评测方法、责任归属链条、严重事件的上报流程。

开发者层面的影响更间接,但同样真实。当评估与验证成为国际议题,模型的第三方测试报告、系统卡与外部评测机构的名字会逐渐具备采购与合规价值。本吉奥以科学小组联合主席身份出席,本身就说明独立评测正在被制度化,而不再只是发布前的一道内部流程。

需要保持清醒的是,这类高级别会议的历史成绩并不亮眼。2023年的那次会议产生了对风险的广泛承认,但几乎没有可执行的后续动作。这一次的看点因此有两个:一是能否出现一份哪怕措辞温和的共同声明,二是双边渠道能否在具体议题上取得进展。接下来几周还有若干观察窗口,包括英国议会10月13日就AI安全与安保举行的口头作证,以及欧盟与日本在监管和产业政策上的后续动作。

素材来源:路透社、凤凰网科技、新浪科技、联合国新闻 发布时间:2026-09-24