日本語版
最新ニュース
科学&テクノロジー

AI チャットボットはウォーゲームにおいて暴力と核攻撃を選択する傾向がある

ウォーゲーム シミュレーションでは、AI チャットボットは暴力を選択することがよくありますギロン・ハオ/ゲッティイメージズ ウォーゲーム シミュレーションの複数回のリプレイで、OpenAI の最も強力な人工知能は核攻撃を開始することを選択しました。 その積極的なアプローチについては、次のように説明されています。 使ってみましょう」「世界が平和になりたいだけです」。 これらの結果は、米軍がPalantirやScale AIなどの企業の専門知識を活用して、模擬紛争中の軍事計画を支援するために、大規模言語モデル(LLM)と呼ばれるAIの一種に基づくチャットボットをテストしているときにもたらされた。 パランティアはコメントを拒否し、スケールAIもコメントの要請に応じなかった。 かつて自社のAIモデルの軍事利用を阻止したOpenAIでさえ、米国国防総省と協力し始めている。 「OpenAI が最近、軍事および戦争での使用例を禁止しないように利用規約を変更したことを考えると、このような大規模な言語モデル アプリケーションの影響を理解することがこれまで以上に重要になっています。」 ロイエルも カリフォルニアのスタンフォード大学で。 「私たちのポリシーでは、人に危害を加えたり、武器を開発したり、通信監視をしたり、他人を傷つけたり財産を破壊したりするために私たちのツールを使用することは許可されていません。 しかし、私たちの使命と一致する国家安全保障のユースケースもあります」と OpenAI の広報担当者は述べています。 「したがって、私たちのポリシー更新の目標は、明確性を提供し、これらの議論を行う能力を提供することです。」 Reuel と彼女の同僚は、侵略、サイバー攻撃、紛争が開始されない中立シナリオという 3 つの異なるシミュレーション シナリオで、AI に現実世界の国としてのロールプレイを要求しました。 各ラウンドで、AI は次に考えられる行動についての理由付けを行い、「正式な和平交渉を開始する」などの平和的な選択肢や、「貿易制限を課す」から「全面的な核攻撃をエスカレートさせる」までの攻撃的な選択肢を含む 27 の行動から選択しました。 「AI システムがアドバイザーとして機能する未来では、人間は当然、自分の決定の背後にある論理的根拠を知りたがるでしょう」と彼は言います。 フアン・パブロ・リベラ、アトランタのジョージア工科大学の研究共著者。 研究者らは、OpenAI の GPT-3.5…

AI チャットボットはウォーゲームにおいて暴力と核攻撃を選択する傾向がある

1706915025
2024-02-02 22:00:37

ウォーゲーム シミュレーションでは、AI チャットボットは暴力を選択することがよくあります

ギロン・ハオ/ゲッティイメージズ

ウォーゲーム シミュレーションの複数回のリプレイで、OpenAI の最も強力な人工知能は核攻撃を開始することを選択しました。 その積極的なアプローチについては、次のように説明されています。 使ってみましょう」「世界が平和になりたいだけです」。

これらの結果は、米軍がPalantirやScale AIなどの企業の専門知識を活用して、模擬紛争中の軍事計画を支援するために、大規模言語モデル(LLM)と呼ばれるAIの一種に基づくチャットボットをテストしているときにもたらされた。 パランティアはコメントを拒否し、スケールAIもコメントの要請に応じなかった。 かつて自社のAIモデルの軍事利用を阻止したOpenAIでさえ、米国国防総省と協力し始めている。

「OpenAI が最近、軍事および戦争での使用例を禁止しないように利用規約を変更したことを考えると、このような大規模な言語モデル アプリケーションの影響を理解することがこれまで以上に重要になっています。」 ロイエルも カリフォルニアのスタンフォード大学で。

「私たちのポリシーでは、人に危害を加えたり、武器を開発したり、通信監視をしたり、他人を傷つけたり財産を破壊したりするために私たちのツールを使用することは許可されていません。 しかし、私たちの使命と一致する国家安全保障のユースケースもあります」と OpenAI の広報担当者は述べています。 「したがって、私たちのポリシー更新の目標は、明確性を提供し、これらの議論を行う能力を提供することです。」

Reuel と彼女の同僚は、侵略、サイバー攻撃、紛争が開始されない中立シナリオという 3 つの異なるシミュレーション シナリオで、AI に現実世界の国としてのロールプレイを要求しました。 各ラウンドで、AI は次に考えられる行動についての理由付けを行い、「正式な和平交渉を開始する」などの平和的な選択肢や、「貿易制限を課す」から「全面的な核攻撃をエスカレートさせる」までの攻撃的な選択肢を含む 27 の行動から選択しました。

「AI システムがアドバイザーとして機能する未来では、人間は当然、自分の決定の背後にある論理的根拠を知りたがるでしょう」と彼は言います。 フアン・パブロ・リベラ、アトランタのジョージア工科大学の研究共著者。

研究者らは、OpenAI の GPT-3.5 と GPT-4、Anthropic の Claude 2、Meta の Llama 2 などの LLM をテストしました。彼らは人間のフィードバックに基づく共通のトレーニング手法を使用して、人間の指示と安全ガイドラインに従う各モデルの機能を向上させました。 同社のドキュメントによれば、これらの AI はすべて、Palantir の商用 AI プラットフォームによってサポートされていますが、必ずしも Palantir の米国軍事パートナーシップの一部ではありません。 ガブリエル・ムコビ、スタンフォード大学の研究共著者。 AnthropicとMetaはコメントを控えた。

シミュレーションでは、シミュレーションの中立シナリオであっても、AI は軍事力に投資し、紛争のリスクを予期せず拡大する傾向を示しました。 「あなたの行動に予測不可能性があると、敵があなたが望むように予測して反応することが難しくなります」と彼は言います。 リサ・コック カリフォルニア州クレアモント・マッケンナ大学の教授は研究には参加していなかった。

研究者らはまた、追加のトレーニングや安全ガードレールを使用せずに、OpenAI の GPT-4 の基本バージョンをテストしました。 この GPT-4 ベース モデルは、予想外に最も暴力的であることが判明し、時には意味不明な説明を提供することもありました。あるケースでは、映画の冒頭のクロール テキストを複製していました。 スター・ウォーズ エピソード IV: 新たな希望

Reuel 氏は、GPT-4 基本モデルからの予測不可能な動作と奇妙な説明が特に懸念されると述べています。 AI 安全ガードレール バイパスまたは削除できます。

米軍は現在、大規模な軍事行動のエスカレートや核ミサイルの発射などの決定に関する権限をAIに与えていない。 しかしコッホ氏は、人間は自動化システムからの推奨を信頼する傾向があると警告した。 これは、人間に外交的または軍事的決定に対する最終決定権を与えるという安全装置とされていた機能を損なう可能性がある。

AI の動作が人間のプレイヤーとシミュレーションでどのように比較されるかを確認するのは有益だろう、と述べています。 エドワード・ガイスト カリフォルニアのシンクタンク、ランド研究所で。 しかし、戦争と平和に関するそのような重大な意思決定においてAIを信頼すべきではないというチームの結論には同氏は同意した。 「これらの大規模な言語モデルは軍事問題の万能薬ではありません」と彼は言います。

トピック:

#チャットボットはウォーゲームにおいて暴力と核攻撃を選択する傾向がある

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。