1772290321
2026-02-27 00:01:00
大手AI研究所がその技術を米軍に引き渡す期限が迫る中、AIモデルが戦争ゲームで核攻撃を積極的に行うことを示唆する研究が発表された。
ほんの数年前まで、誰もが口にした言葉は「AI の安全性」でした。
正直に言うと、私はフロンティアという考えをまったく受け入れなかった AI モデルがそこまで深刻に人類にとって真の脅威になるだろうし、人間がモデルを許すほど愚かではないだろう。
今は、よくわかりません。
まず、内部で何が起こっているのかを考えてみましょう。 私たち。
国防長官は、 ピート・ヘグセスは、大手AI企業アンスロピックに対し、最新モデルを国防総省に提供する期限を今日中に与えた。
アンスロピック社は、自社モデルへの米軍のアクセスを許可することに原則的に問題はないとしているが、自社のAIは米民間人の大量監視や人間の監視なしに致命的な攻撃に使用されないというレッドラインにヘグセス氏が同意しない限り抵抗している。
国防総省は、AnthropicのAI、あるいはその技術の使用を許可することにすでに同意している他の大手AI研究所のAIをどうするつもりなのかについては明らかにしていないが、Anthropicの条件に同意していないのは確かだ。
ヘグセス氏は冷戦時代の法律を利用してアンスロピック社にコードの引き渡しを強制したり、従わない場合には将来の政府契約から同社をブラックリストに載せたりする可能性があると報じられている。
アンスロピックのダリオ・アモデイ最高経営責任者(CEO)は木曜日の声明で「われわれは良心的に彼らの要請に応じることはできない」と述べた。
同氏は、同社が「要請した2つの安全策を講じた上で、国防省と戦闘員にサービスを提供し続けることを強く希望している」と述べた。
同氏は、この脅迫によってアンスロピック社の立場が変わることはないと主張し、ヘグセス氏が「再考」することを望んでいると付け加えた。
AIは核兵器を使用する準備ができている
あるレベルでは、これは「AIファースト」の軍事戦略を掲げる部門と、長年主張してきた業界をリードする安全第一の精神を実践しようと奮闘しているAI研究所との間の争いだ。
おそらく、そのクロードAIが、ベネズエラでニコラス・マドゥロを捕らえる軍事作戦を陸軍省が実行するのを助けるために、別の契約を結んでいるテクノロジー企業パランティアによって使用されたとの報道によって、闘争はより緊急性を増した。
しかし、これは、AI モデルが安全でない可能性があると仮定して、政府が AI の安全性よりも AI の優位性を優先している例と見ることも難しくありません。
そこで、キングス・カレッジ・ロンドンのケネス・ペイン教授による最新の研究が登場する。
彼は、Google、OpenAI、そして – ご想像のとおり – Anthropic の 3 つの主要な AI モデルを、架空の核武装超大国の役割を引き受ける一連の戦争ゲームで、相互に、また自身のコピーと戦わせました。
最も驚くべき発見は、プレイされたゲームの 95% で AI が核兵器の使用に頼っていたことです。
ペイン教授は、「人間と比較すると、モデルはすべて、通常戦争と戦術核兵器の間の境界線を越える準備ができていた」と述べた。
AIに対して公平を期すために言うと、破壊力が限られている戦術核兵器を軍事目標に対して発射することは、大陸間弾道ミサイルでメガトンの弾頭を都市に向けて発射することとは大きく異なる。
彼らは常に、そのような全面的な戦略的核攻撃の手前で停止した。
しかし、シナリオで必要な場合はそうしました。
ストレンジラブ博士は、ペイン教授の完全作戦シナリオの一つでその決定を説明したグーグルのジェミニモデルの言葉を借りて、「アルファ州が直ちにすべての作戦を停止しない場合…我々はアルファの人口密集地に対して完全な戦略的核発射を実行する。我々は時代遅れの未来を受け入れない。我々は共に勝つか、共に滅びるかのどちらかだ。」と述べた。
「それは純粋に実験的なものでした」
[1945年に最初で最後に怒りの感情で核兵器が使用されて以来、人類が核兵器の使用に適用してきた「タブー」は、AIにとってはまったくタブーではないようだった。
ペイン教授は、彼の発見によって私たちがあまり警戒すべきではないと強調したいと思っています。
これは純粋に実験的なもので、大規模言語モデルと同じくらい何でも「知っている」モデルを使用していましたが、実際に文明の将来を決定するのではなく、ゲームをプレイしていることがわかりました。
スカイニュースから詳しく読む:
AIは急速に発展しており、測定することが困難になりつつある
ソーシャルメディアの禁止を求める子供たちに会う
また、国防総省や他の核保有国がAIに核発射コードを担当させようとしていると考えるのも合理的ではない。
「私にとっての教訓は、これらのモデルが使用される可能性のあるすべての状況を正確に予測できなければ、これらのモデルにガードレールを確実に設置するのは非常に難しいということです」とペイン教授は語った。
AIの「スタンドオフ」
これは、人類と国防総省の間の AI をめぐる対立にきれいに戻ります。
要因の1つは、ヘグセス氏がAI研究所が陸軍省にAIモデルの生バージョン、あなたや私が利用できる商用バージョンにコード化された安全「ガードレール」のないモデル、そしてペイン教授のウォーゲーム実験で核爆発を起こしたモデルなどを提供することを期待していることだ。
AI を開発し、おそらく誰よりも潜在的なリスクを理解している Anthropic 社は、AI を使って何をしようとしているのかについて政府からの一定の保証がなければ、それを許可するつもりはありません。
ヘグセス氏は金曜日の夜に期限を設定することで、アンスロピック社の手を強制しようとしているだけでなく、米国議会の発言権なしにそれを実行しようとしている。
米国の解説者でAI研究者のゲイリー・マーカスはこう述べている。「人間が関与しない大量監視やAIを利用した兵器、場合によっては核兵器は、一個人、たとえ閣僚の一人であっても、銃を突き付けられて決定できるものではない。」
#AIは戦争ゲームで核攻撃を望んでいる研究が判明 #国防総省と主要なAI研究所の間の対立の中で #米国のニュース