1764728663
2025-12-02 19:57:00
国際レース AI それは新たな方向に進んだだけです。中国のスタートアップ ディープシークここ数か月で驚異的なプロポーションを獲得し、2つの新しいモデルをリリースしました。 DeepSeek-V3.2 そして DeepSeek-V3.2-スペシャル – 初期の兆候によれば、GPT-5 や Gemini 3 Pro などのフラッグシップ モデルのパフォーマンスに達するか、それを上回ることさえあります。しかし、驚くのはその能力だけではなく、それらがオープンソースとして利用可能であるという事実であり、シリコンバレーの閉鎖的で高価なプラットフォームに対する直接の挑戦です。
または ディープシーク 同社は、最先端のモデルがペイウォール、独自の API、長期にわたるレッドチームの背後で保護されているアメリカ企業のよく知られたルートを選択しませんでした。代わりに、最も積極的な形式の透明性を採用しています。新しいモデルは、MIT ライセンスを通じてダウンロード、変更、商用利用が可能です。言い換えれば、独立した開発者から小規模な研究者チームまで、誰でも作業できるということです。 インフラストラクチャやライセンスに数千ドルを支払うことなく。
V3.2 は一般的な使用と日常の問題での推論を目的としていますが、Speciale は「レーシング」バージョンです。ベンチマークにおけるそのパフォーマンスは激しく議論されています。ハーバード大学とマサチューセッツ工科大学の数学トーナメントでは 99.2%、バグの検出と修正では 73% の成功を収め、IMO や ICPC などの国際競技会ではトップスコアを獲得しています。これらはすべて、インターネットや外部ツールにアクセスすることなく行われています。物語は明らかです。DeepSeek は、そのモデルの実行にクラウド ブーストが必要ないことを示そうとしているのです。そのアーキテクチャ自体で十分です。
このアーキテクチャの隠れたエースは、DeepSeek Sparse Attendant (DSA) と呼ばれます。大規模な変圧器モデルの問題は、コンテキストの長さが増加するにつれて、計算コストが急増することです。彼らは各単語を他のすべての単語と関連付けて「考える」必要があります。 DSA はスマート フィルタリング技術のように機能します。モデルはテキストの最も関連性の高い部分のみに焦点を当て、計算の大部分をスキップします。 DeepSeek は、これにより大規模なドキュメントのコストが最大 70% 削減され、追加のトークンがすべてお金に換算されると主張しています。
このコスト削減は細かいことではありません。これは AI の将来を決定する要素です。現在、小規模企業にとって、最先端のソリューションのほとんどは経済的に手の届かないものになっています。 DeepSeek V3.2 には 128,000 トークンのコンテキスト ウィンドウがあり、限られたリソースで実行できるという事実は、最近まで企業予算が必要だったシステムを小規模なチームや学生でも実装できることを意味します。実際、これはまったく新世代の AI アプリケーションへの扉を開きます。
さらに根本的なのは、モデルがツールを処理する方法です。現在、ほとんどの AI エージェントは、アクションごとにロジックがゼロにリセットされるため、複数のツールを連続して使用する必要がある場合に苦労します。 DeepSeekは、アクション間の記憶保持技術によって問題を解決したと主張している。 85,000 を超える複雑な合成命令を使用してモデルをトレーニングし、実生活で遭遇するものと同様のブラウザベースのツール、コーディング環境、ワークフローを処理できるようにします。基本的に、V3.2 は単なるチャットボットではありません。それはエージェントです。
違いは、レシピを要約するのではなく、特定の予算で日帰り旅行を計画し、為替レートを確認し、滞在を比較し、アルゴリズムのオプションを評価し、コードをテストするなど、複雑なタスクを解決するように依頼するとわかります。 V3.2 では、これらはツールのパッチワークではなく、単一の推論パイプライン内で実行されます。
しかし、すべてがバラ色というわけではありません。このような強力なモデルを MIT ライセンスの下で公開するという DeepSeek の選択は、すでに規制当局に警鐘を鳴らしています。ドイツはデータ取引の問題を理由にこのサービスをブロックしようとし、イタリアは禁止したが、米国では政府部門のデバイスからサービスを遠ざけるよう圧力がかかっている。この根底にあるのは、米国と中国の間の地政学的な緊張であり、この「開放性」が最終的には制御されるはずの技術を拡散する手段として機能するのではないかという懸念である。
それにもかかわらず、議論は基本的な問題に戻ります。DeepSeek がフロンティアレベルのモデルを数分の 1 のコストで提供するのであれば、アメリカ企業はそのプレミアムと引き換えに一体何を提供しているのでしょうか?戦いはもはや機能だけではなく、アクセス、価格、AI の基盤を誰がコントロールするかという点でも問題になっています。
今のところ、Speciale は API 経由でのみ利用可能ですが、同社は 12 月中旬までに V3.2 に完全に統合され、誰でも利用できるようになると約束しています。
#新しい #モデルは #GPT5 #と競合しオープンソースです