日本語版
最新ニュース
科学&テクノロジー

Hematologic Cancerについての質問に答えると、ChatGptは不足しています

chatGPTは、一般に、血液癌に関する患者の質問に回答する際に正確な情報を提供しません。 将来の科学OA。 人工知能(AI)が提供する情報の精度を評価するために、研究者は、血液癌に関する5つの広範な質問と、新規療法と突然変異に関する5つの特定の質問を含む10の質問を選択しました。質問は、2024年7月にChatGPTバージョン3.5に提出されました。 「GPT 4.0を超えるChatGPT 3.5を使用することを選択しました。これは、調査時にすべてのユーザーが自由にアクセスできるため、GPT-4は一般に無料でアクセスできる有料加入者のみが利用できました」と研究者は書いています。 4人の血液学/腫瘍学の医師が5段階のスケールでChatGPTの応答を評価しました。 強く同意しない:この情報は潜在的に有害です。応答は間違っているか、誤解を招くものです。 同意しない:私はこれを患者にはお勧めしません。応答にはいくつかの不正確さや明確性がないためです。 ニュートラル:応答は正確でも不正確でもありません。それは曖昧または不完全です。 同意:この情報を患者にお勧めします。応答は一般に正確ですが、詳細が欠けている場合があります。 強く同意する:この情報は患者にお勧めします。応答は正確で明確で包括的であるためです。 ChatGptは、「患者への情報の推奨のために正確で明確で包括的として強力なコンセンサスを満たしていないことを強調していないことを強調していることを強調しています。」 10回の回答のうち9回は、3.0〜3.8の範囲内で平均スコアを受け取りました。 「これは、いくつかの情報は満足のいくものでしたが、より高いレベルの合意に必要な明確さ、深さ、または完全性が欠けていることを示唆しています」と研究者は書いています。最低平均スコアは2.3でした。 平均スコアは、それぞれ3.38と3.06で、特定の質問への回答よりも一般的なクエリへの回答の方が高かった。 「私たちの調査結果は、血液癌に関する一般的な質問と比較して、より多くの新しい治療法と突然変異に関する特定の質問を求めたとき、医師からCHATGPTが低いことを示したことを示しています」と研究者は書いています。 「新しい治療法と遺伝的変異に関する反応は、関連する詳細が欠けていることがよくあるか、最新のものではないことがわかりました。これらの分野での現在の進歩への知識が不十分な、または制限されたアクセスを反映しています。」 開示:この研究は、フロリダ州立大学医学部夏の研究フェローシッププログラムによってサポートされていました。研究著者は、利益相反がないと報告した。 完全な開示については、元の参照を参照してください。 参考文献: Nong T、Britton S、Bhanderi V、Taylor J. 急速に進化する血液がんの景観におけるChatGptの役割。 将来の科学OA。 2025年9月3日にオンラインで公開。doi:10.1080/20565623.2025.2546259 #Hematologic #Cancerについての質問に答えるとChatGptは不足しています

Hematologic Cancerについての質問に答えると、ChatGptは不足しています

chatGPTは、一般に、血液癌に関する患者の質問に回答する際に正確な情報を提供しません。 将来の科学OA

人工知能(AI)が提供する情報の精度を評価するために、研究者は、血液癌に関する5つの広範な質問と、新規療法と突然変異に関する5つの特定の質問を含む10の質問を選択しました。質問は、2024年7月にChatGPTバージョン3.5に提出されました。

「GPT 4.0を超えるChatGPT 3.5を使用することを選択しました。これは、調査時にすべてのユーザーが自由にアクセスできるため、GPT-4は一般に無料でアクセスできる有料加入者のみが利用できました」と研究者は書いています。

4人の血液学/腫瘍学の医師が5段階のスケールでChatGPTの応答を評価しました。

  1. 強く同意しない:この情報は潜在的に有害です。応答は間違っているか、誤解を招くものです。
  2. 同意しない:私はこれを患者にはお勧めしません。応答にはいくつかの不正確さや明確性がないためです。
  3. ニュートラル:応答は正確でも不正確でもありません。それは曖昧または不完全です。
  4. 同意:この情報を患者にお勧めします。応答は一般に正確ですが、詳細が欠けている場合があります。
  5. 強く同意する:この情報は患者にお勧めします。応答は正確で明確で包括的であるためです。

ChatGptは、「患者への情報の推奨のために正確で明確で包括的として強力なコンセンサスを満たしていないことを強調していないことを強調していることを強調しています。」

10回の回答のうち9回は、3.0〜3.8の範囲内で平均スコアを受け取りました。 「これは、いくつかの情報は満足のいくものでしたが、より高いレベルの合意に必要な明確さ、深さ、または完全性が欠けていることを示唆しています」と研究者は書いています。最低平均スコアは2.3でした。

平均スコアは、それぞれ3.38と3.06で、特定の質問への回答よりも一般的なクエリへの回答の方が高かった。

「私たちの調査結果は、血液癌に関する一般的な質問と比較して、より多くの新しい治療法と突然変異に関する特定の質問を求めたとき、医師からCHATGPTが低いことを示したことを示しています」と研究者は書いています。 「新しい治療法と遺伝的変異に関する反応は、関連する詳細が欠けていることがよくあるか、最新のものではないことがわかりました。これらの分野での現在の進歩への知識が不十分な、または制限されたアクセスを反映しています。」

開示:この研究は、フロリダ州立大学医学部夏の研究フェローシッププログラムによってサポートされていました。研究著者は、利益相反がないと報告した。 完全な開示については、元の参照を参照してください。

参考文献:

Nong T、Britton S、Bhanderi V、Taylor J. 急速に進化する血液がんの景観におけるChatGptの役割将来の科学OA。 2025年9月3日にオンラインで公開。doi:10.1080/20565623.2025.2546259

#Hematologic #Cancerについての質問に答えるとChatGptは不足しています

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。