What happened

据媒体援引知情人士报道,Anthropic与OpenAI曾考虑签署一份具有法律约束力的协议,相互对对方的大模型进行压力测试。报道称,今年早些时候,这两家公司及其律师团队曾就这一计划展开讨论。

按照该计划,竞争对手公司可以对彼此最新可用的模型进行深度测试,以寻找潜在风险或安全漏洞。此类测试仅适用于已商业化的模型,且双方约定不得留存对方的数据。不过报道并未明确双方最终是否达成了此类协议。

近来,在顶尖AI实验室之间推行某种形式的同行评审的想法越来越受到关注。SpaceX首席执行官埃隆·马斯克上周在洛杉矶举行的“All-In Summit”峰会上建议,美国领先的几家大模型公司以及部分中国AI公司,应当允许竞争对手进行交叉测试和同行评审。

Why it matters

这一报道反映出,在AI能力快速提升的背景下,由竞争对手而非开发方自己来检验模型安全性的思路正在获得更多讨论空间。若此类互测安排落地,意味着安全评估的主体可能从企业内部扩展到外部同行。

从报道提及的讨论内容看,互测被限定在已商业化模型、且不得留存对方数据,这显示相关设想在操作层面仍需处理商业机密与数据边界问题。这也可能是报道未明确协议是否达成的原因之一。

马斯克关于让各家公司用别家测试工具跑一遍的说法,以及他“不再自己给自己的作业打分”的比喻,把同行评审从理念推向了具体机制层面的讨论。

Key facts

Anthropic和OpenAI曾考虑签署一份具有法律约束力的协议,以相互对对方的大模型进行压力测试。

报道称,今年早些时候,这两家公司及其律师团队曾就此计划展开讨论。

在该计划中,竞争对手公司可以对彼此最新可用模型进行深度测试,以寻找潜在的风险或安全漏洞。

此类测试仅适用于已商业化的模型,且双方约定不得留存对方的数据。

报道并未明确双方最终是否达成了此类协议。

马斯克建议美国领先的几家大模型公司以及部分中国AI公司允许竞争对手进行交叉测试和同行评审。

What to watch next

报道未明确OpenAI与Anthropic是否最终达成协议,后续是否出现正式安排或官方回应,是判断这一互测设想进展的关键。

同行评审与交叉测试的讨论已从企业层面延伸到行业倡议层面,相关机制如何界定测试范围、数据留存与责任归属,值得持续关注。

Sources