トップライン:
ChatGPT (バージョン 3.5) は、重度の急性膵炎の管理に関するガイドラインに基づく臨床的な質問に回答する際に中程度の精度を示します。
方法論:
- 研究者らは、重度の急性膵炎の管理に関する34の短答式質問と15の正誤質問に対するChatGPTの回答精度を評価しました。
- 人工知能 (AI) ツールは英語と中国語の両方でテストされ、再現性を評価するために各質問が 2 回尋ねられました。
- 2 人の上級集中治療医学専門家が回答の正確性を評価し、3 人目の専門家が意見の相違を解決しました。
- 研究者らは、英語と中国語の回答、また短答式と正誤式の質問の正確率を比較した。
取り除く:
- ChatGPT は、中国語よりも英語の方が正確でした (71% 対 59%)。 ポ = .203)。
- AI ツールは、英語の正誤問題よりも短答形式の質問で高い精度を達成しました (76% 対 60%)。 ポ = .405)。
- 中国語では、短答式質問と正誤問題の間に正確さの有意差は見られませんでした(59%対60%)。 ポ = .938)。
- ChatGPT の応答の再現性は、英語では中程度から良好、中国語では平均的であり、ツールの出力にある程度の信頼性があることを示しています。
実践:
「重症急性膵炎の管理に関する重要な情報に迅速にアクセスする必要がある臨床医にとって、 [ChatGPT] 「ChatGPTは貴重なツールとなる可能性がある」と著者らは書いている。「しかし、ChatGPTの現在の精度は、臨床医が判断を下し、病気の傾向を決定するのを支援するには不十分であることに注意する必要がある。」
ソース:
この研究は、中国成都の成都第一人民病院集中治療科のジュン・チウ氏が筆頭著者として行ったもので、 オンラインで公開 で BMC消化器科。
制限事項:
この研究のサンプルサイズは比較的小さいものでした。質問は、重症急性膵炎の管理に関する 2019 年のガイドラインの使用に限定されていたため、一般化の可能性は限られていました。AI モデルは進化しているため、時間の経過とともに応答が変化する可能性があります。さらに、一部の応答を評価するには臨床知識が必要であるため、主観が導入された可能性があります。
開示事項:
この研究は資金提供を受けていない。著者らは利益相反がないことを宣言した。
1726034261
#重度の急性膵炎の場合ChatGPT #はどのように評価されますか
2024-09-11 05:49:54