1739778387
2025-02-17 07:31:00
これらのツールが病歴、X線、その他のデータセットを肉眼で明らかにするかどうか、これらのツールがどれほど迅速かつ効果的であるかにより、ユーザーは医療診断の人工知能にますます基づいています。ただし、2024年12月20日にBMJで公開された新しい研究は、その技術の懸念を引き起こします 人工知能、大規模な言語モデル(LLMS)やチャットボットなど、人間のような年齢のスキルが悪化する兆候を示しています!
これらの発見は、人工知能がすぐに人々の医師に取って代わるという仮定に異議を唱えています。これは、トップチャットボットで明らかな認知障害が医療診断の信頼性に影響を与え、患者の自信を損なう可能性があるためです。
研究者 彼らは、Google’s Openai、Sonnet’s Sonnet、Sonnetを含む、公開されているLLMSベースのチャットボットを試しました。 モントリオール認知評価(MOCA)、神経科医が注意、記憶、言語、空間スキル、およびエグゼクティブ精神的機能のスキルを制御するために使用される一連のタスク。
モカ 最も一般的に使用されています。 アルツハイマー病 または 痴呆。被験者は、時計パネルに特定の時間を描くなど、100から繰り返し7つを削除し、口頭ディレクトリからできるだけ多くの単語を覚えているなど、職務を引き受けます。人間では、30人に26人が成功したスコアと見なされます。つまり、被験者には認知障害はありません。
名前、注意、言語、抽象化などの試験のいくつかの側面は、使用されているLLMのほとんどにとっては簡単に思えますが、視覚的/空間的スキルやエグゼクティブタスクでは性能が低く、それらの多くは分野の他のものよりも悪いものでした。遅延リコールなど。
重要なのは、最新のバージョンが chatgpt (バージョン4)は、最高スコア(30分の26)に注目し、最も古いジェミニ1.0は16と記載されています。 古いLLMSが認知機能低下の兆候を示すという結論につながる。
この研究の著者は、彼らの発見は観察的であることに注意しています。人工知能と人間の心が働く方法の間の重大な違い 実験はすぐに比較することはできません。しかし、彼らは、臨床医学のAIの発達をブレーキする可能性のある「衰弱の重要な領域」と呼ぶものを示すことができると警告しています。特に、 彼らは、視覚的な抽象化とエグゼクティブモードを必要とするタスクでのAIの使用に反対しています。
*中央の写真は、TechGear.grのImagen3の作成です
[via]
#aiもほとんどすべてのAIチャットボットは認知機能低下の兆候を示しています