1756468501
2025-08-29 08:39:00
ファイル写真:有名なAIの研究者であり、元Openaiの科学者であるAndrej Karpathyは、Xの投稿で、長期的には「強化学習に弱い」と述べています。写真クレジット:ロイター
AMED AIの研究者であり、元Openaiの科学者であるAndrej Karpathyは、Xポストで、彼が非効率的で設計が難しいことが判明するため、長期的に「強化学習に弱まっている」と述べました。 Openaiの創設メンバーの1人であり、GPT-4モデルに取り組んだKarpathy氏は、人間の考え方と同様に、新しい学習方法が最終的に強化学習に取って代わると考えていると述べました。
「個人的に、そして長期的には、私は環境とエージェントの相互作用について強気ですが、具体的には補強学習に弱気です」と彼は言いました。彼は、人間が「いくつかの運動課題」を除くほとんどの知的タスクのために補強学習を使用したという疑問を表明しました。
「人間は、初期のスケッチやアイデアが存在しますが、非常に強力で効率的であり、まだ適切に発明されて拡大されていないさまざまな学習パラダイムを使用しています」と彼は付け加えました。
現在の主力大型言語モデルの進行状況が遅くなるにつれて、AIモデルの構築に使用される機械学習トレーニング技術である強化学習方法に復活がありました。
Karpathy氏は、テキストを読んだり、例を模倣したりするなどの過去のAIトレーニングテクニックが存在し続けると述べましたが、将来はモデルを環境に住み、互いにやり取りすることによって学習することにあります。
公開 – 2025年8月29日02:09 PM IS
#元オペナイの科学者であるアンドレジカルパティは長期的に強化学習に弱気です