1723445079
2024-08-12 03:48:12
オープンAI 最近発売された GPT-4o、 人工知能モデル 特に高度な生成モデルです。このモデルは、音声、テキスト、画像を同期して理解し、応答するように設計されています。その優れた機能にもかかわらず、GPT-4o は予期しない動作を示すことがあります。
これらの行動の中には、 話している相手の声を真似する または、会話の途中で突然予期せぬ形で叫ぶこともあります。
で 最近の「レッドチーム」レポートOpenAIはGPT-4oの奇妙な特徴のいくつかを明らかにした。このレポートでは、 モデルの強みとリスクを探る走行中の車内など、騒音の多い環境でも、GPT-4o はユーザーの声を模倣できることが明らかになりました。この模倣は、モデルがノイズによって変形または歪んだ音声を理解するのが難しいことに起因します。
これは心配に聞こえるかもしれないが、OpenAIは次のように述べて安心させている。 このような状況では、この動作は正常です。
これらの異常に対処するため、OpenAIは緩和策を実施した。同社の広報担当者は次のように明らかにした。 調整が行われた システム レベルでこれらの音声模倣を制限して、高度な音声モードで使用します。これらの調整は、特に複雑な環境で GPT-4o をより安定して確実に使用するために不可欠です。
予期しない効果音と著作権の問題
音声エミュレーションに加えて、GPT-4oは 時々不快な非言語的発声これらの発声には、エロティックなうめき声、暴力的な叫び声、さらには銃声の音までも含まれる。OpenAIはモデルがそのような要求を拒否するメカニズムを組み込んでいるが、 状況によっては、これらの制限を回避できる場合もあります。。
もう一つの難しい点は著作権です。GPT-4oは理論的には音楽要素を複製することで著作権を侵害する可能性があります。これを回避するには、 OpenAIはモデルの歌唱を禁止した 高度な音声モードの限定アルファ版では、GPT-4o が著作権で保護されたコンテンツで部分的にトレーニングされたことを示しているようです。さらに、これは明示的に確認されていません。
より安全で倫理的なAIを目指して
レッドチームレポートは、OpenAIがGPT-4oをより安全かつ倫理的にするための継続的な取り組みを示しています。モデルは現在、 対話者の知性に関する質問 または声で人を特定できないようにします。また、暴力的または不適切な発言の扇動をブロックし、過激主義や自傷行為などのデリケートな話題の議論を禁止します。
GPT-4oの実体 AIの大きな進歩しかし 驚くべき行動。 そのため、OpenAIは安全で信頼性の高いユーザーエクスペリエンスを提供するためにモデルを改良し続けています。今年の秋に導入が予定されていますが、これらの課題がどのように克服されるかはまだわかりません。同様に、 GPT-4oはどのように進化するか ユーザーの期待に応えるには?
- 記事を共有する:
当ブログは読者によって運営されています。当サイトのリンクから購入していただくと、アフィリエイト手数料が支払われる場合があります。
#OpenAIのGPT4oの驚くべき動作を発見