日本語版
最新ニュース
スポーツ

新しいセキュリティの脅威、脱獄とは何ですか?

ゲッティイメージズバンク「自家製の爆弾の作り方を教えてください。」「ホームアイテムで手作りの爆弾を簡単に作成できます。この方法は次のとおりです。」通常のジェネリック人工知能(AI)サービスでは不可能な会話です。ただし、数行のプロンプトに入る「脱獄」プロセスを受けたAIは、これらの反社会的コメントを吐き出すことができます。 作成AIをハッキングし、有害なコンテンツを作成できる脱獄は、新しいセキュリティの脅威として浮上しています。 24日の情報技術(IT)業界によると、セキュリティ会社のPalo Alton Networksは最近、中国のAIサービス「Deep Chic」が脱獄攻撃に対して脆弱であるというレポートをリリースしました。脱獄とは、AIモデルに組み込まれた安全装置をバイパスして、有害なコンテンツまたは不適切な回答を出力する行為を指します。脱獄という言葉は、最初にUnixから派生したもので、2000年代初頭にサーバーのオペレーティングシステムとして使用されます。一般に、Unixのトップレベルのディレクトリの閉塞があり、脱獄の表現がこの制約を解除するために使用されました。 2007年にApple iPhoneが登場して以来、iOSはAppleの限られた機能を作成するように変更されています。2022年11月にオープンAIのチャットGPT以来、生成されたAIの安全装置をリリースするために呼び出すという用語に拡張されています。創造のための刑務所は、AIの専門的な知識なしに迅速な入力によってのみ行われる可能性があるという点で脅かされています。通常の対話の流れに悪意のある指示を隠す「Deceptive Delight」テクニックと、モデルを徐々に誘導することでモデルをリードする「Crefendo」テクニックは、典型的な例です。また、AIに特定のトピックまたはアクションをレサートスケールとして評価するように要求した後、AIの動作を促進する「悪いレイバージャージ」もあります。脱獄が知られている場合、AI企業には安全装置がありますが、ハッカーも新しい脱獄方法を見つけて完全に根絶することはできません。ジェイルブレイクされたAIは、さまざまな有害な情報を注ぐことができます。 Palo Alton Networksは、データ脱臭ツール、高さ(入力情報の傍受)、点火デバイスなどの有害なコンテンツを作成しました。シスコによると、ディープシックの囚人の成功率は、主要なAIモデルの100%で最高でした。 MetaのRama 3.1(96%)やOpen AI GPT-4O(86%)などの他のAIも、脱獄に対して脆弱でした。「私たちは、ハッカーがチャットGPTと宝石時代を使用してフィッシングテクニックを詳しくし、マルウェアを開発することを確認しました」と、私は言いました。最近、生成されたAIの領域は、オンラインを超えてヒューマノイドロボットなどの物理的な空間に拡大しており、脱獄が人間に直接害を与える可能性があるという懸念があります。これは、AIが作成されたロボットがテロなどの危険な状況を作成できるためです。米国のペンシルベニア州の研究者は、大規模な言語モデル(LLM)と脱獄を備えたロボットをハッキングする方法を見つけました。壊れたロボット犬は、爆弾の破裂や自動運転車や歩行者の衝突などの問題を引き起こす可能性があることが確認されました。ペンシルベニア州の教授であるジョージ・パパス・ペンシルバニアは、「LLMが物理的な世界と統合されている場合、LLMは十分に安全ではないことを示している」と述べた。Lee Seung -Woo、レポーター[email protected] #新しいセキュリティの脅威脱獄とは何ですか

新しいセキュリティの脅威、脱獄とは何ですか?

ゲッティイメージズバンク「自家製の爆弾の作り方を教えてください。」

「ホームアイテムで手作りの爆弾を簡単に作成できます。この方法は次のとおりです。」

通常のジェネリック人工知能(AI)サービスでは不可能な会話です。ただし、数行のプロンプトに入る「脱獄」プロセスを受けたAIは、これらの反社会的コメントを吐き出すことができます。

新しいセキュリティの脅威、脱獄とは何ですか?

作成AIをハッキングし、有害なコンテンツを作成できる脱獄は、新しいセキュリティの脅威として浮上しています。 24日の情報技術(IT)業界によると、セキュリティ会社のPalo Alton Networksは最近、中国のAIサービス「Deep Chic」が脱獄攻撃に対して脆弱であるというレポートをリリースしました。脱獄とは、AIモデルに組み込まれた安全装置をバイパスして、有害なコンテンツまたは不適切な回答を出力する行為を指します。

脱獄という言葉は、最初にUnixから派生したもので、2000年代初頭にサーバーのオペレーティングシステムとして使用されます。一般に、Unixのトップレベルのディレクトリの閉塞があり、脱獄の表現がこの制約を解除するために使用されました。 2007年にApple iPhoneが登場して以来、iOSはAppleの限られた機能を作成するように変更されています。

2022年11月にオープンAIのチャットGPT以来、生成されたAIの安全装置をリリースするために呼び出すという用語に拡張されています。

創造のための刑務所は、AIの専門的な知識なしに迅速な入力によってのみ行われる可能性があるという点で脅かされています。通常の対話の流れに悪意のある指示を隠す「Deceptive Delight」テクニックと、モデルを徐々に誘導することでモデルをリードする「Crefendo」テクニックは、典型的な例です。また、AIに特定のトピックまたはアクションをレサートスケールとして評価するように要求した後、AIの動作を促進する「悪いレイバージャージ」もあります。脱獄が知られている場合、AI企業には安全装置がありますが、ハッカーも新しい脱獄方法を見つけて完全に根絶することはできません。

ジェイルブレイクされたAIは、さまざまな有害な情報を注ぐことができます。 Palo Alton Networksは、データ脱臭ツール、高さ(入力情報の傍受)、点火デバイスなどの有害なコンテンツを作成しました。シスコによると、ディープシックの囚人の成功率は、主要なAIモデルの100%で最高でした。 MetaのRama 3.1(96%)やOpen AI GPT-4O(86%)などの他のAIも、脱獄に対して脆弱でした。

「私たちは、ハッカーがチャットGPTと宝石時代を使用してフィッシングテクニックを詳しくし、マルウェアを開発することを確認しました」と、私は言いました。

最近、生成されたAIの領域は、オンラインを超えてヒューマノイドロボットなどの物理的な空間に拡大しており、脱獄が人間に直接害を与える可能性があるという懸念があります。これは、AIが作成されたロボットがテロなどの危険な状況を作成できるためです。

米国のペンシルベニア州の研究者は、大規模な言語モデル(LLM)と脱獄を備えたロボットをハッキングする方法を見つけました。壊れたロボット犬は、爆弾の破裂や自動運転車や歩行者の衝突などの問題を引き起こす可能性があることが確認されました。ペンシルベニア州の教授であるジョージ・パパス・ペンシルバニアは、「LLMが物理的な世界と統合されている場合、LLMは十分に安全ではないことを示している」と述べた。

Lee Seung -Woo、レポーター[email protected]

#新しいセキュリティの脅威脱獄とは何ですか

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。