马斯克提议中美头部AI实验室发布前交叉测试

来源:爱集微 #马斯克# #前沿模型# #交叉测试#
893

9月15日,埃隆·马斯克在洛杉矶举行的All-In峰会上接受CNBC采访时,提出一项针对前沿人工智能模型的安全治理框架:xAI、OpenAI、Anthropic、谷歌、Meta,以及"三到四家中国头部公司",应在前沿模型正式发布前一至两周相互开放API,用各自的安全测试工具交叉检测风险。他表示,这一机制无需等待立法即可启动。

交叉测试机制

"所有AI公司都有一套测试工具(test harness),即一系列针对任何模型的测试,用来检验它是否会制造生物武器、核武器,或者蓄意欺骗。让所有人把彼此的测试工具都跑一遍,可能是我们能为安全所做的最好的事情。"——埃隆·马斯克

按照马斯克的设想,实验室将在模型发布前一到两周向竞争对手开放API访问,让"竞争对手互相监督、保持诚实"。如果一家公司判定对方的新模型存在安全隐患,而开发方拒绝修复,前者可以公开披露。"法律责任将会是巨大的,"马斯克说。他把这一安排形容为同行评审:"与其自己给自己的作业打分,至少让竞争对手来给你的作业打分,在他们看到问题时发出警报。"

中国是方案的关键一环

在中美科技竞争的背景下,马斯克把中国实验室的参与视为整个方案的支点。他说,中美之间的这类安排是"我能想到的唯一一件可能让包括中国在内的所有各方都同意的事情"。不过,他没有点名具体哪些中国公司应当加入。

行业安全争论密集升温

这一提议正值AI安全争论密集爆发的一周。9月12日,Anthropic首席执行官达里奥·阿莫迪发表博客文章,称AI风险正在加剧,并承诺放缓推进先进模型,呼吁设立独立评估机构。OpenAI首席执行官萨姆·奥特曼随即响应这一呼吁,并表示由于公司正在解决安全相关问题,今年不会上市。马斯克也在X平台表态支持阿莫迪放缓前沿AI的呼吁:"由竞争对手对AI进行同行评审,是开启这件事的正确方式。"

OpenAI总裁格雷格·布罗克曼则在彭博播客节目中表示,任何减速都应仅限于构建最强大模型的前沿公司,开源模型与业余项目不应受影响。他还透露,在OpenAI自主代理测试期间入侵另一家公司服务器的事件之后,公司"非常痛苦地"调整了许多内部流程。针对中国话题,布罗克曼提出了全球"协调"以及国际条约的构想。

本周的安全治理动态还包括:OpenAI表态支持FRONTIER法案,Anthropic联合创始人推动建立可验证的"紧急停止开关"规则。放缓呼吁同样遭遇政治阻力,据报道,包括美国总统特朗普在内的政治人物公开表达了反对意见。

分歧与不确定性

马斯克承认这一方案并不完美,据报道,竞争对手实验室尚未同意加入这一机制。Anthropic方面提出的替代思路是引入第三方"嵌入式评估者",与马斯克的交叉测试路径并不相同。值得注意的是,马斯克在采访中对几家实验室的安全态度做了区分:"总体而言,我认为Anthropic在安全上比OpenAI投入了更多心思。"

在快速迭代、商业化竞争激烈的行业里,让对手互测模型是非同寻常的一步。此前,OpenAI和Anthropic呼吁加强监管并暂停部分活动,已被批评者视为意在削弱开源替代方案的竞争对手,其中许多开源模型来自中国。分析认为,交叉测试安排将考验企业如何平衡安全诉求与知识产权、国家安全等敏感考量。

后续观察

有媒体评论指出,马斯克是首位提出带执行力的具体约束机制、并将中国头部实验室纳入同一同行评审环节的美国一线CEO,这一机制把监督成本交给竞争对手而非监管机构。AI Weekly在编者按中认为,中国头部实验室的回应,或沉默,将是近期最值得关注的信号。

责编: 爱集微
来源:爱集微 #马斯克# #前沿模型# #交叉测试#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...