日本語版
最新ニュース
科学&テクノロジー

AI ゴッドファーザー、より良い応答を得るために AI チャットボットに嘘をつくと語る

チャットボットをもっと誠実にしたいと思いませんか?嘘をついてみてください。で エピソード 12月18日に放送された「CEOの日記」の中で、研究科学者のヨシュア・ベンジオ氏はポッドキャストの司会者スティーブン・バートレットに対し、AIチャットボットは常に前向きなことを言うため、研究アイデアに対するフィードバックには役に立たないことに気づいたと語った。「正直なアドバイス、正直なフィードバックが欲しかった。だが、おべっか的なものなので嘘をつくことになる」と彼は語った。ベンジオ氏は戦略を変更し、自分のアイデアを同僚のアイデアとして提示することでチャットボットに嘘をつくことにしたと述べ、その結果テクノロジーからより誠実な反応が得られたと述べた。「それが私だとわかったら、私を喜ばせたいと思うでしょう」と彼は言いました。 Charissa がストーリーを公開するたびに、受信箱にアラートが直接届きます。 Charissa とのつながりを維持し、Charissa が公開する作品をさらに入手してください。 モントリオール大学のコンピューターサイエンスおよびオペレーション研究部門の教授であるベンジオ氏は、研究者のジェフリー・ヒントン氏やヤン・ルカン氏と並んで「AIゴッドファーザー」の一人として知られている。 発表された AIの安全性を研究する非営利団体LawZeroの立ち上げは、嘘や不正行為など、最先端のAIモデルに関連する危険な行動を減らすことを目的としていると同氏は語った。「この協調性は、不整合の実際の例だ。我々は実際、これらのAIがこのようになることを望んでいない」と同氏は「The Diary of a CEO」で述べた。同氏はまた、AIからポジティブなフィードバックを受けると、ユーザーがそのテクノロジーに感情移入してしまい、さらなる問題が生じる可能性があると述べた。他の テクノロジー業界の専門家も、AI が行き過ぎていることに警鐘を鳴らしています。はい、男。」2025年9月、Business InsiderのKatie Notopoulos氏は次のように報じた。 スタンフォードの研究者、カーネギーメロン大学、およびオックスフォード大学は、Redditページからの告白投稿をチャットボットに入力し、投稿者が認めた行動をテクノロジーがどのように評価するかを確認しました。彼らはそれを発見しました ノトプロス氏は、たとえ投稿を判断した人間の意見が異なっていたとしても、AIは42%の確率で「間違った」答えを出し、投稿の背後にいる人物の振る舞いは悪くなかったと答えた、と書いている。AI企業は、モデル内の媚びを減らそうとする試みについて率直に主張している。今年の初めに、 OpenAI が削除されました ChatGPTのアップデートにより、ボットが「過度に協力的だが不誠実な」応答を提供するようになったという。 #ゴッドファーザーより良い応答を得るために #チャットボットに嘘をつくと語る

AI ゴッドファーザー、より良い応答を得るために AI チャットボットに嘘をつくと語る

1766480178
2025-12-23 07:07:00

チャットボットをもっと誠実にしたいと思いませんか?嘘をついてみてください。

エピソード 12月18日に放送された「CEOの日記」の中で、研究科学者のヨシュア・ベンジオ氏はポッドキャストの司会者スティーブン・バートレットに対し、AIチャットボットは常に前向きなことを言うため、研究アイデアに対するフィードバックには役に立たないことに気づいたと語った。

「正直なアドバイス、正直なフィードバックが欲しかった。だが、おべっか的なものなので嘘をつくことになる」と彼は語った。

ベンジオ氏は戦略を変更し、自分のアイデアを同僚のアイデアとして提示することでチャットボットに嘘をつくことにしたと述べ、その結果テクノロジーからより誠実な反応が得られたと述べた。

「それが私だとわかったら、私を喜ばせたいと思うでしょう」と彼は言いました。

モントリオール大学のコンピューターサイエンスおよびオペレーション研究部門の教授であるベンジオ氏は、研究者のジェフリー・ヒントン氏やヤン・ルカン氏と並んで「AIゴッドファーザー」の一人として知られている。 発表された AIの安全性を研究する非営利団体LawZeroの立ち上げは、嘘や不正行為など、最先端のAIモデルに関連する危険な行動を減らすことを目的としていると同氏は語った。

「この協調性は、不整合の実際の例だ。我々は実際、これらのAIがこのようになることを望んでいない」と同氏は「The Diary of a CEO」で述べた。同氏はまた、AIからポジティブなフィードバックを受けると、ユーザーがそのテクノロジーに感情移入してしまい、さらなる問題が生じる可能性があると述べた。

他の テクノロジー業界の専門家も、AI が行き過ぎていることに警鐘を鳴らしています。はい、男。」

2025年9月、Business InsiderのKatie Notopoulos氏は次のように報じた。 スタンフォードの研究者、カーネギーメロン大学、およびオックスフォード大学は、Redditページからの告白投稿をチャットボットに入力し、投稿者が認めた行動をテクノロジーがどのように評価するかを確認しました。彼らはそれを発見しました ノトプロス氏は、たとえ投稿を判断した人間の意見が異なっていたとしても、AIは42%の確率で「間違った」答えを出し、投稿の背後にいる人物の振る舞いは悪くなかったと答えた、と書いている。

AI企業は、モデル内の媚びを減らそうとする試みについて率直に主張している。今年の初めに、 OpenAI が削除されました ChatGPTのアップデートにより、ボットが「過度に協力的だが不誠実な」応答を提供するようになったという。


#ゴッドファーザーより良い応答を得るために #チャットボットに嘘をつくと語る

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。