日本語版
最新ニュース
健康

医師よりも AI を信頼すべきなのはどのような場合でしょうか? – ヘルスケアエコノミスト

その時は刻一刻と近づいているのかもしれない。による論文 ゴーら。 2024年 彼らは50人の医師をサンプリングし、医師単独、GPT-4にアクセスできる医師、またはGPT-4単独のいずれが優れているかを検討した。主な結果は、各グループが症例をどの程度適切に診断したか (つまり、診断推論スコア) でした。著者らは次のことを発見しました。 症例ごとの診断推論スコアの中央値は、GPT-4 グループでは 76.3 パーセント(IQR 65.8 ~ 86.8)、従来型リソース グループでは 73.7 パーセント(IQR 63.2 ~ 84.2)で、調整後差は 1.6 パーセント ポイント(95% CI −)でした。 4.4 ~ 7.6; p=0.60)。 GPT-4 グループの症例にかかった時間の中央値は 519 秒 (IQR 371 ~ 668 秒) であったのに対し、従来のリソース…

1727988868
2024-10-02 23:05:57

その時は刻一刻と近づいているのかもしれない。による論文 ゴーら。 2024年 彼らは50人の医師をサンプリングし、医師単独、GPT-4にアクセスできる医師、またはGPT-4単独のいずれが優れているかを検討した。主な結果は、各グループが症例をどの程度適切に診断したか (つまり、診断推論スコア) でした。著者らは次のことを発見しました。

症例ごとの診断推論スコアの中央値は、GPT-4 グループでは 76.3 パーセント(IQR 65.8 ~ 86.8)、従来型リソース グループでは 73.7 パーセント(IQR 63.2 ~ 84.2)で、調整後差は 1.6 パーセント ポイント(95% CI −)でした。 4.4 ~ 7.6; p=0.60)。 GPT-4 グループの症例にかかった時間の中央値は 519 秒 (IQR 371 ~ 668 秒) であったのに対し、従来のリソース グループでは 565 秒 (IQR 456 ~ 788 秒) であり、その時間差は -82 秒 (95 秒) でした。 % CI -195 ~ 31; p=0.20)。 GPT-4 単独では、従来のリソース グループよりも 15.5 パーセント ポイント (95% CI 1.5 ~ 29、p=0.03) 高いスコアを獲得しました。
結論と関連性:

したがって、GPT-4 は医師単独よりも速く、優れていただけでなく、GPT-4 にアクセスできる医師よりも優れていました。著者らは次のように要約しています。

臨床ビネットに基づく研究では、医師が診断補助として GPT-4 を利用できることは、効率などの臨床推論の要素を改善する可能性はあるものの、従来のリソースと比較して臨床推論を大幅に改善することはありませんでした。 GPT-4 単独は両方の医師グループよりも高いパフォーマンスを示し、臨床現場での医師と AI のコラボレーションがさらに改善される可能性があることを示唆しています。

HT:へ イーサン・モリック

#医師よりも #を信頼すべきなのはどのような場合でしょうか #ヘルスケアエコノミスト

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。