日本語版
最新ニュース
世界

リアルタイム応答とビデオインタラクションを備えた OpenAI GPT-4o が発表され、GPT-4 の機能が無料で利用可能に

OpenAIは月曜日に待望のSpring Updateイベントを開催し、ChatGPTの新しいデスクトップアプリケーション、ChatGPTネットクライアントのユーザーインターフェースのわずかな変更、GPT-4oと呼ばれる新しいフラッグシップレベルの人工知能(AI)モデルを発表しました。このイベントはYouTubeでオンライン放送され、少人数の観客の前で開催されました。イベント中、AI企業はまた、プレミアムユーザーのみが利用可能だったGPT-4のすべての機能が、今後は誰でも無料で利用できるようになると発表しました。 OpenAI の ChatGPT デスクトップ アプリケーションとインターフェースの刷新 OpenAI の最高技術責任者であるミラ・ムラティ氏がイベントのオープニングを飾り、新しい ChatGPT デスクトップ アプリケーションを発表しました。このアプリケーションは、現在、ビジョン コンピューターに搭載されており、ユーザーの画面を表示できます。ユーザーはこの機能のオン/オフを切り替えることができ、AI は表示されているものすべてを分析して支援します。また、CTO は、ChatGPT の Web バージョンのインターフェイスがわずかに更新されたことも明らかにしました。新しい UI はミニマリストな外観で、ユーザーが Web サイトに入ると提案カードが表示されます。アイコンも小さくなり、サイド パネル全体が隠れるため、画面のほとんどを会話に使用できます。注目すべきは、ChatGPT が Web ブラウザーにアクセスし、リアルタイムの検索結果を提供できるようになったことです。 フィトゥール GPT-4o OpenAIのイベントの目玉は、同社の最新の主力AIモデル「GPT-4o」だ。「o」はオムニモデルを意味する。ムラティ氏は、この新しいチャットボットはGPT-4 Turboモデルより2倍高速で、50パーセント安価、速度制限は5倍高いと強調した。 GPT-4oは応答遅延も大幅に改善し、トークモードでもリアルタイム応答を生成できます。OpenAIは、AIモデルのライブデモで、リアルタイムで通信し、ユーザーに反応できることを実証しました。GPT-4oを搭載したChatGPTは、これまでは不可能だったさまざまな質問に答えるために中断することもできるようになりました。しかし、リリースされたモデルの最大の改善点は、感情的な声を組み込んだことです。 現在、ChatGPT が話すとき、その応答にはさまざまな音声変調が含まれているため、ロボットっぽくなく、より人間らしく聞こえます。デモでは、AI が会話から人間の感情を拾い、それに反応できることも示されました。たとえば、ユーザーがパニックに陥った声で話すと、心配そうな声で話します。 コンピュータービジョンも改良され、ハンズオンデモによると、デバイスのカメラからのライブビデオフィードを処理して応答できるようになりました。ユーザーが数式を解く様子を観察し、ステップバイステップのガイダンスを提供できます。また、ユーザーが間違えた場合はリアルタイムで修正することもできます。同様に、大規模なコーディングデータを処理し、即座に分析して改善案を提示できるようになりました。最後に、ユーザーはカメラを開いて顔を見せながら話すことができ、AI が感情を検出できるようになりました。 最後に、別のライブデモでは、最新のAIモデルを搭載したChatGPTがライブ音声翻訳も実行し、複数の言語を連続して話すことができることが強調されました。OpenAIはGPT-4oモデルへのアクセスのサブスクリプション価格については言及していませんが、このモデルは今後数週間以内にリリースされ、APIとして利用可能になることを強調しました。 GPT-4が無料で利用可能になりました…

リアルタイム応答とビデオインタラクションを備えた OpenAI GPT-4o が発表され、GPT-4 の機能が無料で利用可能に

1717315265
2024-06-02 07:28:56

OpenAIは月曜日に待望のSpring Updateイベントを開催し、ChatGPTの新しいデスクトップアプリケーション、ChatGPTネットクライアントのユーザーインターフェースのわずかな変更、GPT-4oと呼ばれる新しいフラッグシップレベルの人工知能(AI)モデルを発表しました。このイベントはYouTubeでオンライン放送され、少人数の観客の前で開催されました。イベント中、AI企業はまた、プレミアムユーザーのみが利用可能だったGPT-4のすべての機能が、今後は誰でも無料で利用できるようになると発表しました。

OpenAI の ChatGPT デスクトップ アプリケーションとインターフェースの刷新

OpenAI の最高技術責任者であるミラ・ムラティ氏がイベントのオープニングを飾り、新しい ChatGPT デスクトップ アプリケーションを発表しました。このアプリケーションは、現在、ビジョン コンピューターに搭載されており、ユーザーの画面を表示できます。ユーザーはこの機能のオン/オフを切り替えることができ、AI は表示されているものすべてを分析して支援します。また、CTO は、ChatGPT の Web バージョンのインターフェイスがわずかに更新されたことも明らかにしました。新しい UI はミニマリストな外観で、ユーザーが Web サイトに入ると提案カードが表示されます。アイコンも小さくなり、サイド パネル全体が隠れるため、画面のほとんどを会話に使用できます。注目すべきは、ChatGPT が Web ブラウザーにアクセスし、リアルタイムの検索結果を提供できるようになったことです。

フィトゥール GPT-4o

OpenAIのイベントの目玉は、同社の最新の主力AIモデル「GPT-4o」だ。「o」はオムニモデルを意味する。ムラティ氏は、この新しいチャットボットはGPT-4 Turboモデルより2倍高速で、50パーセント安価、速度制限は5倍高いと強調した。

GPT-4oは応答遅延も大幅に改善し、トークモードでもリアルタイム応答を生成できます。OpenAIは、AIモデルのライブデモで、リアルタイムで通信し、ユーザーに反応できることを実証しました。GPT-4oを搭載したChatGPTは、これまでは不可能だったさまざまな質問に答えるために中断することもできるようになりました。しかし、リリースされたモデルの最大の改善点は、感情的な声を組み込んだことです。

現在、ChatGPT が話すとき、その応答にはさまざまな音声変調が含まれているため、ロボットっぽくなく、より人間らしく聞こえます。デモでは、AI が会話から人間の感情を拾い、それに反応できることも示されました。たとえば、ユーザーがパニックに陥った声で話すと、心配そうな声で話します。

コンピュータービジョンも改良され、ハンズオンデモによると、デバイスのカメラからのライブビデオフィードを処理して応答できるようになりました。ユーザーが数式を解く様子を観察し、ステップバイステップのガイダンスを提供できます。また、ユーザーが間違えた場合はリアルタイムで修正することもできます。同様に、大規模なコーディングデータを処理し、即座に分析して改善案を提示できるようになりました。最後に、ユーザーはカメラを開いて顔を見せながら話すことができ、AI が感情を検出できるようになりました。

最後に、別のライブデモでは、最新のAIモデルを搭載したChatGPTがライブ音声翻訳も実行し、複数の言語を連続して話すことができることが強調されました。OpenAIはGPT-4oモデルへのアクセスのサブスクリプション価格については言及していませんが、このモデルは今後数週間以内にリリースされ、APIとして利用可能になることを強調しました。

GPT-4が無料で利用可能になりました

OpenAI は、すべての新しいリリースとは別に、GPT-4 AI モデルとその機能も無料で提供しています。プラットフォームの無料レベルを使用するユーザーは、GPT (特定のユースケース向けに設計されたミニチャットボット)、GPT Retailer、AI が将来の会話のためにユーザーとそのユーザーに関連する特定の情報を記憶できる Memories 機能、高度なデータ分析などの機能を無料で利用できます。

#リアルタイム応答とビデオインタラクションを備えた #OpenAI #GPT4o #が発表されGPT4 #の機能が無料で利用可能に

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。