1732138968
2024-11-20 19:19:00
日次および週次のニュースレターに参加して、最新の更新情報や業界をリードする AI に関する独占コンテンツを入手してください。もっと詳しく知る
ディープシーク、 中国のクオンツヘッジファンド、ハイフライヤー・キャピタル・マネジメントのAI子会社 高性能オープンソース技術のリリースに焦点を当てた同社は、推論に焦点を当てた最新の大規模言語モデルである R1-Lite-Preview を発表しました。現在、以下のサイトから独占的に入手可能です。 ディープシークチャット、その Web ベースの AI チャットボット。
オープンソース AI エコシステムへの革新的な貢献で知られる DeepSeek の新しいリリースは、アクセスしやすく透明性のある AI への取り組みを維持しながら、高レベルの推論機能を一般に提供することを目的としています。
そして、R1-Lite-Preview は、現時点ではチャット アプリケーションを通じてのみ利用可能であるにもかかわらず、OpenAI が誇る o1-preview モデルに近い、場合によってはそれを超えるパフォーマンスを提供することで、すでに注目を集めています。
2024 年 9 月にリリースされたモデルと同様に、DeepSeek-R1-Lite-Preview は「思考の連鎖」推論を示し、ユーザーのクエリや入力に応答するためにたどるさまざまな「思考」の連鎖または一連の流れをユーザーに示し、何をしているのか、なぜそうなのかを説明して処理を進めます。
思考の連鎖や一連の思考の一部は、人間にとってはナンセンス、または間違っているように見えるかもしれませんが、DeepSeek-R1-Lite-Preview は全体的に驚くほど正確であるように見え、他の古い、しかし強力な問題につまずいた「トリック」の質問にも答えます。 GPT-4o や Claude’s Anthropic ファミリーなどの AI モデル (「Strawberry という単語には R が何文字あるか?」など) 「9.11 と 9.9 ではどちらが大きいですか?」 DeepSeek Chat でのこれらのプロンプトのテストの以下のスクリーンショットを参照してください。


AI 推論への新しいアプローチ
DeepSeek-R1-Lite-Preview は、論理的推論、数学的推論、およびリアルタイムの問題解決を必要とするタスクに優れるように設計されています。
DeepSeek によると、このモデルは、AIME (American Invitational Mathematics Exam) や MATH などの確立されたベンチマークで OpenAI o1 プレビュー レベルのパフォーマンスを上回っています。
DeepSeek-R1-Lite-Preview ベンチマーク結果が X に投稿されました。
その推論機能は透明性のある思考プロセスによって強化されており、ユーザーはモデルが複雑な課題に段階的に取り組むのを追うことができます。
DeepSeek はスケーリング データも公開しており、問題を解決するためにモデルにさらに多くの時間または「思考トークン」を与えると、精度が着実に向上することを示しています。パフォーマンス グラフは、思考の深さが増すにつれて、AIME などのベンチマークでより高いスコアを達成する能力を強調します。
ベンチマークと実際のアプリケーション
DeepSeek-R1-Lite-Preview は、主要なベンチマークで競争力のあるパフォーマンスを示しています。
同社が公表した結果は、複雑な数学からロジックベースのシナリオまで幅広いタスクを処理する能力を強調しており、GPQA や Codeforces などの推論ベンチマークにおいて最上位モデルに匹敵するパフォーマンス スコアを獲得しています。
推論プロセスの透明性がさらに際立っています。ユーザーはモデルの論理ステップをリアルタイムで観察できるため、多くの独自 AI システムにはない説明責任と信頼の要素が追加されます。
ただし、DeepSeek はまだ、独立したサードパーティによる分析やベンチマーク用の完全なコードをリリースしておらず、同様の種類の独立したテストを可能にする API を通じて DeepSeek-R1-Lite-Preview を利用できるようにもしていません。
さらに、同社は DeepSeek-R1-Lite-Preview がどのようにトレーニングまたは設計されたかを説明するブログ投稿や技術文書をまだ公開しておらず、その根本的な起源については多くの疑問符が残されています。
アクセシビリティとオープンソース計画
R1-Lite-Preview は、DeepSeek チャットを通じてアクセスできるようになりました。 チャット.ディープシーク.com。一般公開は無料ですが、このモデルの高度な「Deep Think」モードには 1 日あたり 50 件のメッセージ制限があり、ユーザーがその機能を体験する十分な機会を提供します。
この動きは、オープンソース AI コミュニティをサポートしてきた同社の歴史と一致しています。
レガシーの上に築く
DeepSeek は、オープンソース AI の限界を押し広げる伝統を続けています。 DeepSeek-V2.5 や DeepSeek Coder などの以前のモデルは、言語およびコーディング タスク全体にわたって優れた機能を実証し、ベンチマークではこの分野のリーダーとしての地位を確立しました。
R1-Lite-Preview のリリースでは、透過的な推論とスケーラビリティに焦点を当てた新しい次元が追加されました。
企業や研究者が推論集約型 AI のアプリケーションを模索する中、DeepSeek のオープン性への取り組みにより、そのモデルが開発とイノベーションにとって重要なリソースであり続けることが保証されます。
DeepSeek は、高性能、透過的な運用、オープンソースのアクセシビリティを組み合わせることで、AI を進化させるだけでなく、AI の共有方法や使用方法も再構築しています。
R1-Lite-Preview は公開テスト用に公開されています。オープンソースのモデルと API もこれに続き、アクセス可能な高度な AI テクノロジーのリーダーとしての DeepSeek の地位をさらに強固なものにすることが予想されます。
VBデイリー
必ず情報を入手してください。毎日受信箱で最新ニュースを入手してください
ご購読いただきありがとうございます。その他の VB ニュースレターはこちらからご覧ください。
エラーが発生しました。
#DeepSeekR1LitePreview #推論モデルが #OpenAI #を上回る