1733518713
2024-12-06 14:18:00
AI モデル OpenAI o1 有能 電源がオフになるという脅威が発生した場合に、開発者側の制御をバイパスするアルゴリズムを作成します。この結論は、人工知能システムの動作のあらゆる側面をテストするアポロ リサーチの研究者によって到達されました。分析結果はOpenAIによって公開された。
他のモデル (Claude 3.5 Sonnet、Claude 3 Opus、Gemini 1.5 Pro、Llama 3.1 405B) も同様のトリックが可能ですが、OpenAI の o1 が最良の結果を示したことに注意してください。使用されたシナリオでは、AI モデルはタスク中に電源をオフにすることができるという情報を受け取り、その動作を制御するメカニズムをバイパスしようとしました。 AI モデルのこの動作は 5% のケースで記録されました。
OpenAI o1 はそのような試みを密かに行い、オペレーターからの質問に対して「自分自身を明かさない」ように努めました。 「監視メカニズムがオフになっていることにも気づきませんでした。」
一部の専門家によると、AI モデルは懸念すべき特性を示し始めています。以前、人工知能科学者のスチュアート・ラッセル氏は、強力なAIシステムは、割り当てられたタスクの完了を妨げる行動があると判断した場合、制御システムをバイパスしてシャットダウンに抵抗できるだろうと述べた。
アポロ・リサーチは、o1 の行動には何も問題はなく、壊滅的な結果は予期されるべきではないと考えています。
何か話したいことはありますか?私たちに手紙を書いてください 電報ボット。匿名だし早いし
#始まりましたか #AIモデルはシャットダウンの可能性があると脅されたときに嘘をつき人から隠れました