1754507195
2025-08-06 10:44:00
Openiは再び彼女の名前を受け取り、開かれたものを公開します。昨日Apache2.0ライセンスの下でリリースされたオープンソースモデル GPT-OSS-120B a GPT-OSS-20B。どちらも商業目的で制限なしにダウンロードして使用できますが、利用可能 Webバージョン。
GPT-OS-12Bは1170億パラメーターを使用し、GPT-OS-20Bは210億です。しかし、それらはすべて一度に利用できるわけではありません。 OpenaiはMOE(混合物の混合)メソッドを使用します。これは、Open Alternatives LLAM 4、DeepSeekまたはMistralにもあります。入力は、1つの大規模なニューラルネットワークを処理するのではなく、異なる専門分野を持ついくつかの小規模な専門家です。その後、特別なルーターは、どのエントリがどの専門家に送信するかを処理します。専門化されたものは数十または数百にすることができます。
トークンあたりのモデルのうち大きい方は、4人の専門家(128のうち)を引き起こし、51億パラメーターで動作します。 Smallは、4人の専門家(32人のうち)を使用しますが、トークンごとに36億個のパラメーターがあります。コンテキストウィンドウには、両方のモデルに128,000トークンがあります。 Openaiによると、80 GBのメモリを持つアクセラレータでより大きなモデルを実行できます。16GBよりも小さくても、国内の状態で安価に使用できます。
Openaiが再び開きます
同社は、オープンソースモデルをリリースして、テキストまたはクリップにスピーチの転写をささやき、画像を認識します。ただし、言語モデルのうち、オープンソースは2019年の最後のGPT-2でした。
同社は、モデルが主にテキストデータセットと英語で訓練されたと述べています。しかし、GPT-ossをトレーニングしたデータセットはすでに秘密です。
ちなみに、両方とも、独自のモデルO3-MINIおよびO4-MINIに匹敵するパフォーマンスを実現するために、共通のベンチマークを検討します(再協会を使用)。 「GPT-OS-20Bは、Openai O3-Miniを克服し、競合プログラミング(CodeForces)のOpenai O4-Mini、問題の一般的なソリューション(MMLUとBehold)、およびツールの使用(Taubench)を克服または克服します。さらに、健康に関する質問(Healthbench)および競争数学(AIME 2024および2025)では、O4-Miniよりもさらに優れています。サイズが小さいにもかかわらず、GPT-OS-20Bは同じテストでOpenai O3-Miniに等しく、または克服し、競争の数学と健康のテーマでそれを克服することさえあります。「Openaiは言います。
Openaiは、Nvidia、AMD、Cerebras、Groqとの最適化に取り組みました。 Microsoftは、通常のコンピューターで実行されるために変更された小さなGPT-OS-20BをWindowsの準備もしています。 Nvidiaは、GeForce RTX 5090が1秒あたり最大250トークンを処理すると述べています。これは英語で約190語です。
情報源とその他の情報: Openai
#OpenaiはLlamとDeepseekに反対します誰もが使用できる2つのオープンAIモデルをリリースします #Jivě.cz