何が起きたか
TechCrunchの報道によると、AnthropicとOpenAIは独立した安全性評価者を自社のAI研究所内に配置しようとしている。
この動きにより、外部の評価者は両社の内部業務に前例のないアクセスを得ることになる。
研究者たちはそのアクセスを歓迎しているが、意味のある監督は透明性、独立性、そして最終的には規制にかかっていると警告している。
なぜ重要か
評価者を組み込むことで、これまでより早い段階でAI開発に外部の精査を持ち込むことができるが、この仕組みは評価者を受け入れる研究所からの圧力を受けずに活動できる場合にのみ機能する。
研究者たちの但し書きは、アクセスだけでは十分ではないことを示唆している。透明性と独立性がなければ、組み込まれた監督は安全性の実務へのチェックというよりも形式的なものになりかねない。
最終的な規制への言及は、自主的な取り決めが正式な監督の代替ではなく、それに向けた一歩と見なされる可能性があることを示している。
主な事実
AnthropicとOpenAIは、独立した安全性評価者を自社のAI研究所内に配置することを望んでいる。
研究者たちは、これがもたらす前例のないアクセスを歓迎している。
研究者たちは、意味のある監督には透明性、独立性、そして最終的には規制が必要だと警告している。
今後の注目点
組み込まれた評価者に真の独立性が与えられるのか、それとも受け入れ側の研究所によって制約されたままになるのか。
こうした取り決めにおいて透明性がどのように定義・執行されるのか、そしてそれが正式な規制につながるかどうか。
