日本語版
最新ニュース
世界

ChatGPT がアップグレードされ、より人間らしく見えるようになりました

OpenAI の最新モデルは、より人間らしい会話体験を提供しますJIYI 画像 / Alamy OpenAI は、GPT-4o と呼ばれる最新の人工知能モデルを発表しました。これは間もなく同社の ChatGPT 製品の一部のバージョンに搭載されることになります。 アップグレードされた ChatGPT は、リアルタイムの会話パートナーからのテキスト、オーディオ、ビデオ入力に迅速に応答でき、同時に、強い感情と個性を伝える抑揚や言葉遣いで話します。 同社は、5 月 13 日に ChatGPT モバイル アプリと新しいデスクトップ アプリの両方をフィーチャーしたおそらくライブ OpenAI プレゼンテーションで、新しい音声モードの感情的な模倣をデモンストレーションしました。 女性のような声で話し、ChatGPT という名前に応答するこの新しい AI の会話機能は、典型的な音声の定型的でロボット的な応答よりも、2013 年の SF 映画「Her」でスカーレット・ヨハンソンが声を当てた人格的な AI に似ているように見えました。アシスタントテクノロジー。 「新しい GPT-4o の音声対音声のインタラクションは、人間と人間のインタラクションにより近いものになっています」とカリフォルニア大学デービス校のミシェル・コーン氏は述べています。 「これは遅延時間が短いことが大きな理由ですが、さらに重要なのは、音声が生み出す感情表現のレベルです。」 同社 CTO…

ChatGPT がアップグレードされ、より人間らしく見えるようになりました

1715667734
2024-05-13 22:45:51

OpenAI の最新モデルは、より人間らしい会話体験を提供します

JIYI 画像 / Alamy

OpenAI は、GPT-4o と呼ばれる最新の人工知能モデルを発表しました。これは間もなく同社の ChatGPT 製品の一部のバージョンに搭載されることになります。 アップグレードされた ChatGPT は、リアルタイムの会話パートナーからのテキスト、オーディオ、ビデオ入力に迅速に応答でき、同時に、強い感情と個性を伝える抑揚や言葉遣いで話します。

同社は、5 月 13 日に ChatGPT モバイル アプリと新しいデスクトップ アプリの両方をフィーチャーしたおそらくライブ OpenAI プレゼンテーションで、新しい音声モードの感情的な模倣をデモンストレーションしました。 女性のような声で話し、ChatGPT という名前に応答するこの新しい AI の会話機能は、典型的な音声の定型的でロボット的な応答よりも、2013 年の SF 映画「Her」でスカーレット・ヨハンソンが声を当てた人格的な AI に似ているように見えました。アシスタントテクノロジー。

「新しい GPT-4o の音声対音声のインタラクションは、人間と人間のインタラクションにより近いものになっています」とカリフォルニア大学デービス校のミシェル・コーン氏は述べています。 「これは遅延時間が短いことが大きな理由ですが、さらに重要なのは、音声が生み出す感情表現のレベルです。」

同社 CTO の Mira Murati 氏と他の 2 人の従業員との会話中、GPT-4o を利用した ChatGPT は、OpenAI の Mark Chen 氏の重くペースの速い呼吸について、「おいおい、ゆっくりしろ、君は掃除機じゃないんだよ」と言ってアドバイスした。呼吸法を提案しています。 この AI はまた、OpenAI の Barret Zoph による言葉とハートが描かれた絵を視覚的に検査し、「ああ、ChatGPT が大好きと書いたようですね、とても優しいですね。」と湧き出る声で反応しました。

新しいChatGPTはまた、会話相手に簡単な一次方程式を解くよう口頭で指示し、コンピュータコードの機能を説明し、夏にピークに達する気温線を示すグラフを解釈した。 プロンプトが出されると、AI は、ますますドラマチックなナレーションとエンディングの歌の間を切り替えながら、でっち上げた就寝前の物語を数回語り直しさえしました。

OpenAIのCEO兼共同創設者であるサム・アルトマン氏は、新しい音声モードは、今後数週間のうちにChatGPT Plusの有料加入者に初めて利用可能になると述べた。 役職 Xプラットフォーム上。

ChatGPT は、時折発生する技術的な不具合からも会話的に回復することができました。 OpenAI の Zoph の自撮り写真の表情や感情を解釈するように求められたとき、AI は、最新の画像を評価するよう促される前に、最初に前の画像から木の表面を見ていると示唆しました。

「ああ、いよいよ行きます。満面の笑顔とちょっとした興奮で、とても幸せで陽気な気分のようですね」と ChatGPT は言いました。 「何が起こっているにせよ、ご機嫌は良さそうですね。 その良い雰囲気の源を共有したいですか?」

ChatGPT のライブ デモで「あなたがいかに役に立ち、素晴らしいか」をアピールしているからだと言われたとき、AI は「やめてください、あなたは私を赤面させています」と答えました。

しかしムラティ氏は、GPT-4oを利用したChatGPTの更新版(同社によれば、最終的には無料のChatGPTユーザーにも利用可能になる予定)には、リアルタイム情報の組み込みと解釈方法により新たな安全上のリスクが伴うことを認めた。 彼女は、OpenAI が「悪用に対する緩和策」の構築に取り組んでいると述べました。

ニュージャージー州プリンストン大学のピーター・ヘンダーソン氏は、「シームレスなマルチモーダルな会話を行うことは非常に難しいため、デモは印象的です」と述べています。 「しかし、より多くのモダリティを追加すると、安全性はより困難かつ重要になります。モデルが利用する入力のこのような拡張により、潜在的な安全性の故障モードを特定するには、おそらくしばらく時間がかかるでしょう。」

ヘンダーソン氏はまた、ChatGPTユーザーがライブオーディオやビデオなどの入力を共有し始めたら、OpenAIのプライバシー規約や、無料ユーザーが将来のOpenAIモデルのトレーニングに使用される可能性のあるデータ収集をオプトアウトできるかどうかを確認することに「興味がある」と述べた。

「モデルはオフデバイスでホストされているように見えるため、インターネットを介してデスクトップ画面をモデルと共有したり、オーディオやビデオを継続的に記録したりできるという事実は、計画が正しい場合、この特定の製品の発売における課題をさらに拡大すると思われます」そのデータを保存して使用するためです」とヘンダーソン氏は言います。

より擬人化された AI チャットボットもまた、別の脅威を表しています。音声会話を通じて共感を偽ることができるボットは、潜在的に人々にとってより人格的で説得力のあるものに聞こえる可能性があると、コーン氏らの調査研究は述べています。 そのため、人々は潜在的に不正確な情報や、GPT-4 などの大規模な言語モデルによって生成された偏見のある固定概念を信頼する傾向が高まります。

「これは、特に常に正確な情報を生成するとは限らないため、人々が大規模な言語モデルを検索したりそこからガイダンスを受け取ったりする方法に重要な意味を持ちます」とコーン氏は言います。

トピック:


#ChatGPT #がアップグレードされより人間らしく見えるようになりました

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。