「Superintelligence Strategy」は2025年3月に登場し、ワシントンで真剣に受け止められるよう作られた著者リストを備えていました。Center for AI Safetyのディレクターダン・ヘンドリクス、元Google CEOのEric Schmidt、Scale AIの創業者Alexandr Wangです。その目的は超知能を研究文献から国家安全保障の言語へ引きずり出すことであり、その点で成功しました。数週間以内に軍備管理の研究者たちに議論され、シンクタンクでウォーゲームされ、議会証言で引用されました。.

アナロジーはそれについて最も興味深い点であり、同時に問題でもある。.

その中心にあるのは、慎重に選ばれた一つの頭字語だ。MAIM、Mutual Assured AI Malfunctionの略で、MADを意図的に響かせている。この論文の核心的主張を担っている。核保有国同士が互いを壊滅させないよう抑止してきた恐ろしい膠着状態が、AIにも存在し、誰が認めようと認めまいとすでに成立しているというものだ。.

この論文は本当に重要な点を正しく捉えていると思うが、その中心的なメカニズムは置かれた重みに耐えられない。両方とも重要だ。.

論文がすでに存在すると言う対立

論理はこうだ。ある国家が決定的な突破口、論文の表現を借りれば「超兵器と未来の支配」をもたらすシステムに近づいているように見えるとする。どのライバルもそれを許すわけにはいかない。一つの首都がスーパーインテリジェンスを握る世界は、冷戦期の先制攻撃優位と同様に、他のどの首都にとっても耐えがたい。.

しかし配備済みの核兵器とは異なり、進行中のAIプロジェクトは脆弱である。既知の座標を持つデータセンターで稼働し、電力網に依存し、数ヶ月かかる訓練実行は適切な侵入で静かに破壊できる。脅威を受けたライバルには戦争に至らない選択肢があり、その階段は存在する。スパイ活動、訓練実行を劣化させたりデータを汚染したりする秘密のサイバー攻撃、周辺インフラの妨害、そして極端な場合には施設自体への物理的攻撃である。.

論文の主張は、これが記述であるということです。著者らは、AI超大国が直面する戦略的現実を既に捉えていると主張します。攻撃的で目に見えるAI優位性の入札を行う国家は、ライバルによってそのプロジェクトが妨害されることを予期すべきです。それが名前の由来であり、逆説的な希望の由来でもあります。すべてのプレイヤーが優位性へのスプリントが妨害されることを知っていれば、誰もスプリントせず、ゲームの中で最も不安定化する動きが抑止されます。MADと同様に、著者らは、意図的な実践を通じて対立を安定化できると主張します。データセンターを都市から離れた場所に置き、エスカレーションラダーのサイバーランクを運動的ランクから明確に分離し、ライバル間の透明性を拡大して、誰も商業プロジェクトを優位性入札と誤解しないようにすることです。.

他の2つの柱

MAIMが大きく報じられたが、戦略は三部構成で、二番目が最も有用だと我々は考えている。. 不拡散 は、核分裂性物質をテロリストから遠ざけるために作られた仕組みをAIに応用するものだ。先端チップを濃縮ウラン並みに追跡し、モデル重みを盗難から守り、生物兵器の設計や重要インフラ攻撃に協力しないようシステムに安全装置を組み込む。この柱は、国家が コンピュート・ガバナンス 他のすべてで競争している最中でも、まさにワシントンとモスクワが冷戦最悪の時期に核不拡散を共に運営したように。.

競争力 は現実的な負担である。各国はAIで経済と軍事力を強化すべきであり、とりわけ脆弱なチップ供給網を国内生産で修復すべきだ。この懸念はその後、 輸出管理をめぐる政治 今や業界を形作っている。.

この論文は、この三つ組を、拒否する二つの戦略と対置させている。すなわち、超知能を最初に構築して希望を抱く手放しのレースと、実行不可能な世界的なモラトリアムとして退けられるものだ。この文脈では、抑止は無謀さと甘さの間の大人らしい選択肢である。.

論文が正しく指摘している点

まず、成果から始めましょう。長年、競争を正当化する標準的な主張は、ライバルの超知能が破滅的になるため、こちらが先に到達しなければならないというものでした。「Superintelligence Strategy」は、この論理を静かに逆転させています。一方的な支配の試みがライバルにとって耐えがたいなら、すべての試みが誰かにとって耐えがたいものであり、競争そのものが国家安全保障への脅威になる、というのです。このプロフィールの著者たちから発せられたこの逆転は、実質的な影響を持ちました。制御喪失と戦略的不安定性を、alignment論文を決して読まない人々の机の上に置き、抑制は要請されるだけでなく強制可能であることを、信頼できる言葉で確立したのです。.

一方で核不拡散の柱は、私たちが提唱する条約の枠組みの一部にすぎず、別の方向から到達したものだ。チップ追跡、ウェイトの保全、および 「hardware-enabled governance」 は抑止体制と検証体制の両方に等しく役立つ。構築に費やした一ドルは、将来の合意を検証可能にするための一ドルでもある。.

核の類推が限界を迎えるところ

問題は、MADを安定させた要因を一つずつAI版と照らし合わせたときに始まる。.

核発射は曖昧さがありません。数分以内に帰属が特定され、原点はメートル単位でわかり、引き起こす反応は事前に全員が確実かつ理解しています。ここで比較してみましょう。「不安定化する」訓練ランは、外から見れば商業的なものと区別がつきません。同じクラスタ、同じ電力消費、同じ衛星シグネチャです。閾値は定義されておらず、ドラフトの努力不足ではなく、能力がミサイルの噴煙のように自らを告げないからです。これが私たちが呼んできた問題です 危険なAIの定義, そしてMAIMはそれを丸ごと継承する:抑止体制にはレッドラインが必要であり、その論文はそのラインがどこかを正確に言うことができない。.

帰属の問題は逆方向にも生じる。訓練ランが失敗した場合、それは妨害工作か、バグか、悪いデータか?国家は自分が攻撃されたことに気づかずに攻撃される可能性があり、その場合攻撃は何も抑止しない。また、実際には攻撃されていなかったのに攻撃されたと信じる可能性もあり、それはより悪い。抑止は可視的で、信頼でき、帰属可能な脅威を通じて機能する。隠密のサイバー作戦はそのどれでもない。機械知能研究所、RANDなどのアナリストは、論文発表から数週間以内にまさにこの点を指摘しており、特に観測可能性に関する批判は十分に答えられていない。複数の研究者が、安定した抑止の条件はまだ成立しておらず、ライバルのデータセンターに対する相互の深い透明性が必要になるかもしれないと結論づけている。.

エスカレーションラダー自体もある。核保有国の重要インフラへの攻撃を日常的な国策として常態化することは、明らかに安定への道ではない。論文の答えである「サイバーの段を運動エネルギーの段より十分下に保つ」という前提は、妨害キャンペーンの標的が、自分がどの段に立っているかという解釈を共有していることを前提としている。冷戦史は、そうした解釈が食い違う瞬間を数多く記録しており、論文が深く触れていないもう一つの警告も示している。MADは何度も事故、誤警報、誤判断で失敗しかけており、教義と同じくらい運に救われてきた。MADの論理を採用することは、その失敗モードも採用することを意味する。.

抑止には明確なトリップワイヤーと紛れもない対応が必要だ。MAIMは今のところどちらも持っていない。.

MAIMが機能してもできないこと

枠組みにすべてを認めても、より深い限界は残る。MAIMが抑止するのは一つの特定の失敗、すなわち国家による意図的で可視的な一方的な支配への疾走だ。私たちが最も懸念する失敗モードについては何もせず、なぜならそこには抑止すべき攻撃者が存在しないからだ。.

ミスアライメントはデータセンターにどの旗が翻っていようと気にしない。破壊工作の閾値を慎重に超えないよう競う各プログラムの世界は、それでもなお 誰も制御できないシステムに向かって競争している, 、安全を犠牲にするという競争の常套圧力がそのまま残った状態で。さらに悪いことに、MAIMは独自の圧力を加える。妨害の脅威にさらされたプロジェクトは、隠蔽・強化・分散するあらゆる理由を持ち、秘密主義は価値ある安全策すべての敵となる。抑止は競争者を監視する一方で、 制御問題 自体は監視されず、壊滅へのより遅く静かな道筋も含めて 徐々な権力剥奪 それは支配競争を全く必要とせず、完全にそのレーダーをすり抜ける。.

膠着状態もまた、休息状態ではない。MADが許容できたのは、既存の兵器の使用を抑止するという限定された任務だったからだ。MAIMは、毎年アルゴリズムが効率化し、計算資源の最前線が分散していく中で、移ろい続ける能力の開発を永遠に抑止し続けなければならない。 perpetual crisis management とは、うまくブランディングされたカウントダウンであって、戦略ではない。.

抑止と条約は対立しない

核抑止力は決して単独では成り立ちませんでした。何十年にもわたってそれに取り付けられた地味な仕組みによって存続可能になったのです。ホットライン、査察、核拡散防止条約、SALT、START、 検証プロトコル それにより双方が相手の弾頭数を数えられるようになった。MADが恐怖を提供し、軍備管理がその恐怖を戦争に変わる前にルールへ変換した。この歴史の前半だけを引用し、後半を無視して、協調的抑制をユートピア的と切り捨てる同論文の姿勢は、冷戦史を都合よく切り取っている。.

そして二つの半分は同じエンジンを共有する。妨害を信用できる形で脅すために、国家はライバルのAIプログラムを十分に見通し、支配を狙う動きがいつ始まるかを知る必要がある。その監視、衛星、チップ追跡、訓練実行に関する情報こそが、 超知能に関する条約 検証の必要性。この論文は、意図に反して、条約の難しい部分はすでに構築されつつあるという論拠になっている。.

したがって私たちの結論は、論文の支持者や最も手厳しい批評家が書くものより範囲が狭い。MAIMは記述としては価値がある。対立を正しく命名し、一方的な開発競争が抵抗されることを示し、防衛当局に対して競争が解決策ではなく脅威であると伝えるからだ。しかし目的地としては失敗する。核保有国間の恒久的で未定義の秘密裏の対立は安定ではなく、実存的リスクの真の源であるシステム自体が統治されないままになるからだ。抑止は時間を稼ぐ。. 検証済みの国際合意 はそのための時間だ。.