想要AI更安全,先让对手来"挑刺":马斯克提议AI巨头在模型发布前相互

信息来自 财联社 | 科技创新 | 2026-09-15 22:01:04

据媒体当地时间9月15日报道,在9月13日至15日于洛杉矶举行的、由知名科技播客主办的All-In峰会上, SpaceX首席执行官埃隆·马斯克以视频方式远程出席。

马斯克表示,这一"同行评审"机制无需等待新的立法,可以立即启动。

马斯克说道:

"所有AI公司都有一套测试工具(test harness),也就是用来检验模型是否会帮助制造生物武器、核武器,或是否存在蓄意欺骗行为的一系列测试。"

"让每家公司都用别家的测试工具跑一遍,可能是我们为确保自身安全所能做的最好的事,应当尽快推动。"

他形容,这意味着AI公司不再"自己给自己的作业打分",而是至少由竞争对手来批改,一旦发现问题就可拉响警报。

在具体操作层面,马斯克提出,模型开发方应在发布前向同行提供API访问权限。如果被指出的问题迟迟未获解决,竞争对手可以公开表态,宣称该模型的发布并不安全。

马斯克所提的"互测"机制在行业内已有雏形。2025年8月27日,据两家公司官网同步发布的报告,OpenAI与Anthropic公布了一次联合安全评估的结果。

双方当时相互开放API权限并放宽部分外部防护措施,用各自内部的对齐(即模型行为是否符合人类意图)与安全测试,评估对方已公开发布的模型,并同时公布结果。这被视为头部实验室首次向直接竞争对手开放内部测试。

免责声明:本文信息来自 财联社 平台,仅供参考。如有侵权,请及时联系我们删除。

评论交流

0
支持回复和点赞