そのモデルはMythosで、Anthropicの最も強力なシステムと報じられていた。議員は上院情報委員会副委員長のマーク・ワーナー(バージニア州)だった。将軍はNSAと米サイバー軍の両方を指揮するジョシュア・ラッドだった。ワーナーの説明によれば、, 最初に報告したのは The Economist そして業界紙で取り上げられた, Rudd told him what the model did.
商用モデルにより、数時間で。詳細は議論があり、数日で話は複雑化した。核心は本物であり、その核心だけで十分である。.
Mythosは我々の機密システムのほとんどに、数週間ではなく、数時間で侵入した。.
NSAおよび米サイバー軍司令官のJoshua Rudd将軍、Mark Warner上院議員の伝聞として、 により報じられた The Economist, 2026年6月
"AI hacks the NSA"という見出しが書ける。もちろん実際はそれほど単純ではない。ウイルス化したバージョンと実際の出来事のギャップを正確に理解することは重要だ。なぜなら、本当の出来事こそが眠れなくなる理由だからだ。.
実際に起きたこと
No rogue machine turned on its makers and stormed the nation's secrets. The break-in took place inside an authorized レッドチーム演習: 管理されたセキュリティテストで、機関がモデルを自らの機密環境の複製に向けさせ、侵入経路を探させたもの。.
ただし、すぐに留保が積み重なった。政府高官は後に、ワーナーが話を要約しすぎた可能性があり、「数時間ではなく数週間」という表現は実際のネットワークではなくレッドチーム演習の文脈を指していたと述べた。NSAもサイバーコマンドもこの証言を独自に確認していない。その点をすべて踏まえ、どんな修正も受け入れ、最も安心できる解釈を採用したとしよう。.
誇張を剥いだ後に残るのはこれだ。国内で最も安全なシステムの代用を狙ったレンタル可能なモデルが、欠陥を発見し、わずか半日でほぼ完全なアクセス権を連鎖させた。世界最高の人間レッドチームでも半日ではできない。.
彼らは製品をオフにした
深刻な人々が次に何をするかを見ることで、何かがどれほど深刻だったかを多く学べる。彼らは肩をすくめなかった。.
テストの翌日、商務省はAnthropicの非市民従業員を含むすべての外国人を、同社の最も能力の高い2つのモデルMythosとFableの使用から排除する措置を講じた。Anthropicはその技術的な問題について訴訟を起こさなかった。それは 世界中の市場から両モデルを撤去した, 、そしてそれは、誰がログインできるかの市民権テストを事実上執行できないという理由でした。ある企業は、自社の看板製品、存在意義そのものを、世界中に対して一日で停止しました。自分が安全に制御できていると本気で信じている能力に対して、そんなことをするはずがありません。.
And the NSA test was not a one-off parlor trick. Through a classified evaluation program, Mythos has reportedly surfaced thousands of software vulnerabilities, among them a flaw that had been sitting undiscovered in OpenBSD, an operating system chosen by security professionals precisely because it is hard to break, for twenty-seven years. Twenty-seven years of expert human eyes missed it. The model read the code the way you read a paragraph. It does not get tired. There is only ever going to be more of it.
これがこれから先、最も遅い動きだ
これは注意を払っている人なら誰でも警戒すべきことだ。研究室は超知能に向かって競争しており、そのペースはますます加速している。一年前には、フロンティア研究室の外にいる誰も、Mythosがやったようなことをモデルが見せるのを見たことがなかった。六ヶ月後にはMythosを遅く見せるシステムが生まれ、さらに六ヶ月後にはまたその比較が私たちを恥じ入らせるだろう。.
それが複合する理由は謎ではない。世界のソフトウェアの穴を見つけるのに十分なモデルは、自らの後継を設計するのを助けるのに十分なモデルであり、それが背後にあるメカニズム全体だ。 再帰的自己改善. 研究を加速させる研究は加算しない。乗算する。能力曲線は我々が準備できていないことを気にせず、法が追いつくまで路肩でアイドリングすることもない。法は近くない。
もう遠慮はしない
だから私は、もう言葉を選んで慎重に話すのをやめる。慎重でいる余裕はもうない。私は長い間、すべてを穏やかに表現してきた。合理的な人々が耳を傾け続け、私を絶望論者扱いしないようにと。その慎重さは今や負債になっている。抑制された態度という評判は得られるが、私が抑制して語っているものが結局構築されてしまう。.
このレースを止めなければ、あり得る結果は、私たちが作っているものを制御できなくなり、それが私たちを殺すことです。「労働市場を混乱させる」ことでも、「制度に負担をかける」ことでもありません。もちろんそれらも途中で起こりますが、最終的には「殺す」のです。私たち全員を。愛する人々を、その人々が愛する人々を、そしてその後に続くはずだった静かな人類の未来ごと。.
それがページ上でどう読まれるか正確にわかっています。 the largest survey of AI researchers ever conducted, 、これらのシステムを実際に作っている約2,800人のうち、38〜51%が、先進AIが人類絶滅レベルの結果を引き起こす確率を10分の1以上と見積もっています。100万分の1ではなく、10分の1です。作り手自身がそう言っています。そんな確率で子供を飛行機に乗せる人はいないでしょう。私たちは全人類をその飛行機に乗せようとしています。.
ジェフリー・ヒントン won the チューリング賞 for the methods that made all of this possible, then left Google so he could say what he thinks without a corporate minder in the room. He puts the chance that AI drives humanity to extinction at 10 to 20 percent. He is not the most frightened person in the field. Plenty of the people closest to the work put the number higher, and the estimates tend to climb, not fall, the nearer the expert sits to the frontier.
2023年、存命する最も引用された研究者の数百人と、この技術を競って構築している研究所の最高経営責任者たち(Anthropicを含む)が、Center for AI Safetyの一文に署名しました。AIによる絶滅リスクの低減は、パンデミックや核戦争などの社会規模のリスクと並んで世界的な優先事項であるべきだ、というものです。この技術を構築している人々は、その力が人類を終わらせる可能性を核戦争と同じ breath で語りながら、机に戻ってさらに速く構築しました。彼らの framing、彼らの言葉、彼らの名前です。.
しかし、それについて何かできる
静かな絶望もまた、何もしないことのひとつであり、何もしなければデフォルトで負ける。あなたはここでは傍観者ではない。.
神話が棚から引き下ろされたのは、政府が押したからであり、政府が押したのは圧力がそこまで届いたからだ。政府はルールを作り、政府は声を上げ続ける人々に答える。だから拒否しよう。.
- 平易な言葉で、代表者に伝えよう、, 最先端AIに拘束力のある制限を望み、それに投票することを。初めての場合は、私たちのツールで 議員に手紙を書く は最初のメッセージを容易にする。.
- 執行力のある国際条約を支持する 最も危険なシステムについては、かつて世界が核兵器や生物兵器を「最も速く動く者に任せるには危険すぎる」と判断したのと同じように、 私たちの計画 を中心に据えている。.
- これをフルタイムでやっている人々を支援する。. 以下に名前を追加し、できる限りの寄付をし、今週中に実行してください。次のこれより悪いヘッドラインの後ではなく。.
これを作っている人たちは、記録上かつ実名で、それが全員を殺すかもしれないとあなたに告げている。あるAIは一つの午後で国のほぼすべての機密の壁を突破し、公式の対応は週末前に市場から引き下ろすことだった。すでに目の前にある警告より明確なものを待つのはやめよう。そんなものは来ない。.