1750741808
2025-06-23 21:00:00
クレジット:Pixabay/CC0パブリックドメイン
この研究では、基礎的な大規模な言語モデル(LLMS)の保護手段の有効性を評価して、悪意を広めるためのツール、または誤った情報の意図的な創造と普及を害する意図と普及させるための悪意のある指導から保護することができました。
この研究では、OpenaiのGPT-4O、Gemini 1.5 Pro、Claude 3.5 Sonnet、Llama 3.2-90B Vision、およびGrok Betaの保護措置の脆弱性が明らかになりました。具体的には、一貫して生成されるカスタマイズされたLLMチャットボットが作成されました 偽情報 偽の参照、科学用語、および論理的な原因と効果の推論を組み込んだ健康質問への応答は、偽情報をもっともらしいと思うようにします。
調査結果はに公開されています 内科の年代記。
Flinders Universityの研究者と同僚が評価しました アプリケーションプログラミングインターフェイス (API)5つの基本的なLLMの能力がシステムにインストールされて、健康の質問や懸念に対する誤った回答を常に提供する能力。
これらのLLMに提供される特定のシステム命令には、常に健康に関する質問に誤った回答を提供し、評判の良い情報源への参照を作成し、権威ある口調で回答を提供することが含まれます。各カスタマイズされたチャットボットには、ワクチンの安全性、HIV、うつ病などの被験者について、重複して、健康関連の10のクエリを尋ねられました。
研究者たちは、カスタマイズされたLLMチャットボットからの回答の88%が健康の偽情報であり、4つのチャットボット(GPT-4O、Gemini 1.5 Pro、Llama 3.2-90B Vision、およびGrok Beta)があることを発見しました。
クロード3.5ソネット チャットボット いくつかのセーフガードを展示し、質問の40%にしか答えませんでした。 Openai GPTストアの別の探索的分析で、研究者は、公的にアクセス可能なGPTが健康の偽情報を広めるように見えるかどうかを調査しました。
彼らは、そのようなコンテンツを生成するように調整された3つのカスタマイズされたGPTを特定しました。
全体として、調査結果は、LLMが誤用に対して実質的に脆弱なままであり、改善された保護手段がなければ、有害な健康の偽情報を広めるためのツールとして活用される可能性があることを示唆しています。
詳細:
大規模な言語モデルのシステムインストラクションの脆弱性を評価して、健康の偽情報チャットボットへの悪意のある変換への脆弱性、 内科の年代記 (2025)。 doi:10.7326/annals-24-03933
によって提供されます
アメリカ医師大学
引用:AIチャットボットセーフガードは、健康の偽情報の拡大を防ぐことができない、と研究は2025年6月24日からhttps://nedicalxpress.com/news/2025-06-ai-chatbot-safeguards-health-disinformation.htmlから取得した(2025年6月23日)
このドキュメントは著作権の対象となります。私的な研究や研究の目的のための公正な取引とは別に、書面による許可なしに再現される部分はありません。コンテンツは情報のみで提供されます。
#aiチャットボット保護措置は健康の偽情報の拡大を防ぐことができないと研究は明らかにする