韓国と英国は、2023年11月にブレッチリーパークで始まったシリーズの第2回会合であるAIソウルサミットを共催した。アジェンダは明確に二分された。企業トラックでは主要開発者が安全に関する公約を発表し、政府トラックでは評価科学に関する協力を深めることで合意した。各トラックが何を達成し、何を未解決のままにしたかは、2024年時点の人工超知能ガバナンスの状況を最も明確に示すものだった。.
どちらの出力も本物だった。どちらも法律ではなかった。.
フロンティアAI安全コミットメント
主要文書はフロンティアAI安全コミットメントで、米国、中国、英国、アラブ首長国連邦の開発企業を含む16の主要AI企業が署名した。各社はフロンティアモデルからのリスクを評価する方法を記述した安全フレームワークを公表し、許容できないとみなすリスクの閾値を定義し、緩和策が機能しない場合はモデルを開発・展開しないことを誓約した。.
意味のある変化は、公の原則だった。主要な開発者たちは公の場で、一部の能力は展開するには危険すぎると述べ、それらのレッドラインを定義して行動すると言った。業界は曖昧な保証から明示された限界へと移行した。ただしその限界は自己定義のままだった。.
自主的なコミットメントでは不十分な理由
- 企業が自ら閾値を設定する。. 各開発者が許容できないリスクとその測定方法を独自に定義している。共通の基準も、それを検証する外部機関もない.
- 独立した検証はない。. 内部安全フレームワークが遵守されているか、評価が正直に行われているかを確認するものは何もない。コンプライアンスは開発者の言葉に依存する。.
- 執行なし。. 誓約を破る代償は、せいぜい評判の失墜だ。誓約は法律ではない。.
- それらは修正または破棄できる。. 競争圧力の下での自主的なコミットメントは、ライバルが先行すると静かに侵食される可能性がある。自主規制はそれほど脆弱だ。.
民間の反論は、ラボに自己管理を求める方が何もないよりはましだというものだ。それは正しいが、不十分だ。約束する側が自分で定義・測定・破棄できる約束は、ガバナンスの代用品にすぎない。代用品が役立つのは、より厳しいものが意図的に置き換える場合だけだ。.
安全研究所のネットワーク
政府間トラックが残したのは、より持続可能な可能性だった。最先端モデルの評価科学で協力し、方法を共有し、テストを整合させ、将来の検証体制に必要な技術的能力を構築するという、国際的なAI安全機関ネットワークへの機運である。英国と米国が新設した機関を基盤に、モデルが危険かどうかを実際に評価できる公的機関は、条約が最終的に必要とする結合組織となる。詳しくは財団のガイドを参照。 AI安全機関とは何か.
ソウル宣言は、参加各国政府の支持を得て、人間中心で安全かつ信頼できるAIと、国際協力の継続を再確認した。ブレッチリーの声明と同様に、義務ではなく方向性を示したものだった。.
パターンとギャップ
ソウルは危険な技術の統治で見られる典型的なパターンに当てはまる。まず認識し、次に自主的なコミットメントを行い、プロセスが成功すれば拘束力のあるルールへ移行する。企業の誓約と研究所ネットワークは第二段階だ。残された仕事は第三段階、すなわち共通基準、独立した検証、そして法的義務である。.
Safety Institutesは最も有望な橋渡し役だ。なぜなら、彼らが築く能力こそが拘束力のある体制が利用するものだからだ。リスクは、サミットプロセスが自主的段階で停滞し、世界が条約ではなく誓約で妥協し、能力向上は続くことだ。Seoulはコミットメントとガバナンスのギャップを可視化した。それを埋めることが残された課題だ。財団の立場は、それを埋めることは企業による誓約から 予防的な国際法 自ら定めたレッドラインが、開発競争の圧力で溶解する前に。関連記事:: なぜ自主的なAI安全コミットメントが唯一の戦略として失敗するのか.