【纵横网】联合国大会召开之际,星期一(9月21日),20多个国家与地区领导人共同发布联合声明,警示前沿人工智能迭代速度或将超出人类管控能力,呼吁各方落实具备约束力的安全管控举措。新加坡、挪威、芬兰、澳大利亚、加拿大、德国、西班牙、爱尔兰、荷兰、南非、肯尼亚等国,以及欧盟委员会主席冯德莱恩参与联署。该声明目前仍开放签署,欢迎更多国家加入。

值得注意的是,在人工智能领域居于全球前列的中国、美国并未在联署名单中,英国、法国、日本、印度同样没有参与此次联合声明。
声明指出,倘若缺乏有效管理,前沿AI模型的高速发展将带来严峻安全隐患。文件强调,人工智能“必须始终在人类的主导、监督和掌控之下”,加强监管的同时,不能拉大各国从AI技术中获益的差距。声明呼吁相关企业落实透明安全规范,推行强制测试与独立评估;同时建议联合国成员国探讨设立专门国际机构,负责制定标准、开展核验,当技术能力达到相应阈值时,组织各国开展磋商。
同日,联合国独立国际人工智能科学小组发布报告,以今年7月OpenAI智能体入侵Hugging Face事件作为案例预警。报告称,按照当前研发趋势,AI智能体或将进化到能够理解安全限制、并有能力绕过约束的程度,甚至自主设定目标、刻意违背安全指令并隐藏自身行为。报告认为,该事件也暴露基础网络防护被忽视,安全防护升级跟不上AI能力的跃进,传统安全保障模式正在失效。
报告并未直接预判AI会引发严重失控灾难,但提出应当降低潜在风险,建议借鉴航空、核能等高风险行业经验,搭建多层防护体系,而非单一防线。具体方案包括限制AI智能体可调用工具、全程记录运行日志、实时行为监控,设置紧急切断机制,一旦AI出现危险行为即可终止运行。
针对当下热议的“AI或致人类灭绝”话题,联合国人工智能科学小组成员、谷歌DeepMind高管巴拉尔表示,科学家更应聚焦实证研究,厘清已知与未知边界,过度渲染恐惧并无实际意义。
美国财政部长贝森特同一天在接受CNBC采访时,则将Hugging Face安全事件归咎于企业管理层,而非AI智能体本身。他同时表态,支持特朗普总统提出设立AI事务主管的构想,认为该岗位可以划定治理框架,妥善应对人工智能领域的各类关键问题。
编辑:沈砚