新しい研究によると、ChatGPTは研修医よりも呼吸器疾患の診断に優れているという。
オーストリアの欧州呼吸器学会で発表された調査結果では、グーグルのバードがいくつかの面で人間よりも優れたパフォーマンスを発揮した一方、マイクロソフトのビングは研修医と同等の性能を発揮したことも判明した。
この研究は、こうした大規模な言語モデルが医療スタッフが患者をより効率的に評価し、NHSが直面している大きなプレッシャーを軽減するのに役立つ可能性があることを示唆している。
小児科での臨床経験が4か月未満の研修医10人に、AIチャットボットではなくインターネットを使用して、小児呼吸器医学の専門家が作成した、明らかな診断がないシナリオを解決するための1時間が与えられた。
医師の回答は採点され、チャットボットの回答と比較されました。
ChatGPT バージョン 3.5 は最高得点を獲得し、他のチャットボットよりも応答が人間に近いと考えられました。
この研究は、エディンバラの王立小児青少年病院の小児呼吸器科コンサルタントであるマンジス・ナラヤナン博士によって発表された。
「これらのツールは、医療の分野でいくつかの潜在的な応用が考えられます。この研究を実施した動機は、大規模言語モジュール(LLM)が実際の臨床医をどの程度支援できるかを評価することでした」とナラヤナン博士は述べています。
「幻覚」
研究者らは、3つのチャットボットのいずれにおいても、言語モデルが情報を作り上げているように見える、いわゆる「幻覚」の明確な例を発見しなかった。
しかし、ナラヤナン博士は、このような事態が起こる可能性は常にあるため、今後はこのような事態の発生を緩和することが重要だと警告した。
ビング氏とバード氏は、質問とは無関係とみなされる回答をいくつかしたが、研修医たちも同様だった。
医療シンクタンクのヘルス・ファンデーションが7月に発表した調査によると、英国民の半数以上とNHS職員の4分の3が、患者ケアへの人工知能の利用を支持していると答えた。
しかし、国民もNHS職員も、AIシステムが「本当の共感」や「優しさ」を示すことができないという事実が、この技術を使用する上での最大の欠点であると感じていた。
エディンバラ大学のプライマリケア呼吸器医学教授、ヒラリー・ピノック氏は次のように語った。「ChatGPTのような広く普及しているAIツールが、子供の呼吸器疾患の複雑な症例に解決策を提供できるのは心強いが、少し怖いことでもある。」
「これは確かに、AI支援ケアの素晴らしい新世界への道を示しています」と彼女は付け加えた。
ナラヤナン博士は現在、より上級の医師に対してチャットボットをテストし、より新しくより高度な大規模言語モデルを検討することを計画している。
#研究によると呼吸器疾患の診断においてChatGPTは研修医よりも優れている