業界をリードする AI に関する最新情報や独占コンテンツを入手するには、毎日および毎週のニュースレターにご登録ください。 もっと詳しく知る
OpenAIは、 資金難に目を向けるしかし、この卓越した生成 AI 企業が、新しいモデルとアップデートを着実にリリースし続けることを止めることはできません。
昨日、会社は ひっそりとウェブページを投稿した 新しい大規模言語モデル (LLM) である GPT-4o Long Output を発表しました。これは 5 月の代表的な GPT-4o モデルのバリエーションですが、出力サイズが大幅に拡張されています。出力は GPT-4o の初期の 4,000 トークンではなく、最大 64,000 トークン (16 倍の増加) です。
トークンとは、ご存知のとおり、 概念の数値表現LLM の舞台裏では、意味に基づいて整理された文法構造や文字と数字の組み合わせが学習されます。
たとえば、「Hello」という単語はトークンの1つですが、「hi」も同様です。トークンの動作のインタラクティブなデモは、OpenAIのTokenizerで見ることができます。 ここ機械学習研究者 Simon Willisonは素晴らしいインタラクティブトークンエンコーダー/デコーダーも持っています。
OpenAI は、新しい GPT-4o Long Output バリアントでトークン出力を 16 倍に増加させることで、ユーザー、具体的にはアプリケーション プログラミング インターフェイス (API) 上に構築するサードパーティの開発者に、チャットボットが最大約 200 ページの小説ほどの長さの、はるかに長い応答を返す機会を提供します。
OpenAI がより長い出力モデルを立ち上げるのはなぜですか?
OpenAI がこの拡張出力機能を導入することを決定したのは、より長い出力コンテキストが必要であることを示す顧客からのフィードバックに基づいています。
OpenAIの広報担当者はVentureBeatに次のように説明した。「お客様からは、より長い出力コンテキストが欲しいというフィードバックをいただいています。当社は常に、お客様のニーズに最もよく応えられる新しい方法をテストしています。」
アルファテスト段階は数週間続くと予想されており、OpenAI は拡張された出力がユーザーのニーズをどの程度効果的に満たしているかに関するデータを収集することができます。
この強化された機能は、コードの編集や文章の改善など、詳細かつ広範な出力を必要とするアプリケーションに特に有利です。
GPT-4o モデルは、より拡張された出力を提供することで、より包括的で微妙な応答を提供できるため、これらのユースケースに大きなメリットをもたらします。
コンテキストと出力の区別
すでにGPT-4oは発売以来、最大128,000のコンテキストウィンドウ(モデルが1回のインタラクションで処理できるトークンの量)を提供してきました。これには以下が含まれます。 入力トークンと出力トークンの両方。
GPT-4o Long Output の場合、この最大コンテキスト ウィンドウは 128,000 のままです。
ではOpenAIはどのようにして 出力 全体のコンテキスト ウィンドウを 128,000 に維持しながら、トークンを 4,000 から 64,000 に 16 倍に増やすにはどうすればよいでしょうか。
それは単純な計算に帰着します。5月のオリジナルのGPT-4oは合計128,000トークンのコンテキストウィンドウを持っていましたが、その単一の 出力 メッセージは4,000件に制限されました。
同様に、新しい GPT-4o ミニウィンドウでは、合計コンテキストは 128,000 ですが、最大出力は 16,000 トークンに増加しました。
つまり、GPT-4o の場合、ユーザーは 1 回のやり取りで最大 124,000 個のトークンを入力として提供し、モデルから最大 4,000 個の出力を受け取ることができます。また、入力としてより多くのトークンを提供し、出力として受け取るトークンを少なくすることもできますが、それでも合計 128,000 個のトークンが追加されます。
GPT-4o mini の場合、ユーザーは最大 16,000 トークンの出力を得るために、最大 112,000 トークンを入力として提供できます。
GPT-4o Long Output の場合、合計コンテキスト ウィンドウの上限は依然として 128,000 です。ただし、現在、ユーザーは最大 64,000 トークン相当の入力を提供でき、それと引き換えに最大 64,000 トークンを返すことができます。つまり、その上に構築されたアプリケーションのユーザーまたは開発者が、入力を制限しながらより長い LLM 応答を優先したい場合です。
いずれの場合も、ユーザーまたは開発者は選択またはトレードオフを行う必要があります。つまり、合計 128,000 トークンのまま、より長い出力を得るために入力トークンの一部を犠牲にするかどうかです。より長い回答が必要なユーザーのために、GPT-4o Long Output ではこれをオプションとして提供しています。
積極的かつ手頃な価格
新しい GPT-4o ロング出力モデルの価格は次のとおりです。
- 100万入力トークンあたり6米ドル
- 100万出力トークンあたり18ドル
通常の GPT-4o の価格 これは、100万入力トークンあたり5ドル、100万出力トークンあたり15ドル、または新しい GPT-4o ミニ 入力 100 万件あたり 0.15 ドル、出力 100 万件あたり 0.60 ドルと、かなり積極的な価格設定であることがわかります。これは、強力な AI を手頃な価格で提供し、幅広い開発者ユーザーベースが利用できるようにしたいという OpenAI の最近の主張を継承したものです。
現在、この実験モデルへのアクセスは、信頼できる少数のパートナーに限定されています。広報担当者は、「より長い出力が彼らのユースケースに役立つかどうかを確認するために、信頼できる少数のパートナーと数週間アルファテストを実施しています」と付け加えました。
このテスト段階の結果に応じて、OpenAI はより広範な顧客ベースへのアクセスの拡大を検討する可能性があります。
今後の展望
現在進行中のアルファ テストでは、拡張出力モデルの実際のアプリケーションと潜在的な利点に関する貴重な洞察が得られます。
初期のパートナーグループからのフィードバックが肯定的であれば、OpenAI はこの機能をより広く利用できるようにし、より幅広いユーザーが強化された出力機能の恩恵を受けられるようにすることを検討する可能性があります。
明らかに、OpenAI は GPT-4o Long Output モデルを使用して、さらに幅広い顧客要求に対応し、詳細な応答を必要とするアプリケーションを強化したいと考えています。