发生了什么
Anthropic与OpenAI希望将独立的安全评估员嵌入各自的AI实验室内部。
研究人员对这一前所未有的访问权限表示欢迎。
但研究者同时警告,要实现有意义的监督,还需要透明度、独立性,并最终需要监管。
为什么重要
让外部评估者进入实验室内部,可能让安全审查比以往更贴近模型开发的实际过程。
不过,研究者提出的条件表明,仅靠访问权限本身并不足以构成有效监督;若缺乏透明度与独立性,这种安排可能难以形成真正的制衡。
研究者将监管列为最终方向,暗示行业自愿安排可能只是过渡,而非终点。
关键事实
Anthropic与OpenAI希望将独立安全评估员嵌入其AI实验室内部。
研究人员欢迎这种前所未有的访问权限。
研究者警告,有意义的监督需要透明度、独立性和最终的监管。
接下来看什么
关注这些嵌入安排将如何具体落实,以及评估员能否保持独立于实验室的立场。
观察透明度机制是否随之建立,以及监管是否会如研究者所言成为后续步骤。
