发生了什么

Anthropic与OpenAI希望将独立的安全评估员嵌入各自的AI实验室内部。

研究人员对这一前所未有的访问权限表示欢迎。

但研究者同时警告,要实现有意义的监督,还需要透明度、独立性,并最终需要监管。

为什么重要

让外部评估者进入实验室内部,可能让安全审查比以往更贴近模型开发的实际过程。

不过,研究者提出的条件表明,仅靠访问权限本身并不足以构成有效监督;若缺乏透明度与独立性,这种安排可能难以形成真正的制衡。

研究者将监管列为最终方向,暗示行业自愿安排可能只是过渡,而非终点。

关键事实

Anthropic与OpenAI希望将独立安全评估员嵌入其AI实验室内部。

研究人员欢迎这种前所未有的访问权限。

研究者警告,有意义的监督需要透明度、独立性和最终的监管。

接下来看什么

关注这些嵌入安排将如何具体落实,以及评估员能否保持独立于实验室的立场。

观察透明度机制是否随之建立,以及监管是否会如研究者所言成为后续步骤。

来源