1770424128
2026-02-06 16:33:00
Anthropic は矛盾に陥っています。トップ AI 企業の中で、 最も夢中になっている 安全性を確保し、モデルがどのようにして問題が発生するかを研究する分野で先頭に立っています。しかし、たとえ 安全上の問題 Anthropic は、競合他社と同じくらい積極的に、次の、より危険な可能性のある人工知能のレベルに向けて突き進んでいます。その中心的な使命は、その矛盾を解決する方法を見つけ出すことです。
先月、Anthropic は 2 つの文書を発表しました。その内容はいずれも、現在進行中の道に伴うリスクを認め、パラドックスから逃れるために採り得るルートを示唆しています。 「テクノロジーの思春期CEOのダリオ・アモデイによる長文のブログ投稿は、名目上は「強力なAIのリスクに立ち向かい、克服する」ことをテーマとしているが、後者よりも前者に多くの時間を費やしている。アモデイはこの課題を巧みに「気の遠くなるような」ものだと表現しているが、彼のAIのリスクの描写は、テクノロジーが権威主義者によって悪用される可能性が高いため、より悲惨なものになっていると指摘しており、より明るい前任者とは対照的である。原始ユートピア的エッセイ「慈悲の機械」
その投稿では、データセンター内の天才国家について話していました。最近の派遣は「無限の黒い海」を想起させる。ダンテのページング!それでも、20,000以上のほとんど暗い言葉を述べた後、アモデイは最終的に楽観的な印象を与え、最も暗い状況であっても人類は常に勝利してきたと述べた。
1月に出版された2番目のドキュメントAnthropic、「クロードの憲法「」は、このトリックがどのように達成されるかに焦点を当てています。このテキストは、技術的には、クロード自身 (およびチャットボットの将来のバージョン) の聴衆に向けられています。これは、クロード、そしておそらくその AI 仲間が世界の課題をどのように乗り越えていくかについての Anthropic のビジョンを明らかにする、魅力的な文書です。結論: Anthropic は、企業のゴルディアンの結び目を解くために、クロード自身に依存することを計画しています。
Anthropic の市場での差別化要因は長い間、と呼ばれるテクノロジーでした。 憲法AI。これは、モデルがその価値観を健全な人間倫理と一致させる一連の原則に従うプロセスです。初期のクロード憲法には、これらの価値観を具体化することを目的とした多くの文書が含まれていました。スパロー (DeepMind によって作成された一連の反人種差別および反暴力の声明)、世界人権宣言、Apple の利用規約 (!) などです。 2026 年の更新バージョンは異なります。クロードが従う倫理的枠組みを概説する長いプロンプトのようなもので、正義への最善の道を自ら発見します。
この改訂版の主執筆者である哲学博士のアマンダ・アスケル氏は、Anthropic のアプローチは、単にクロードに一連の規定されたルールに従うように指示するよりも堅牢であると説明しています。 「人々がルールが存在するという理由以外の理由もなくルールに従っている場合、そのルールが存在する理由を理解している場合よりも事態は悪化することがよくあります」とアスケル氏は説明する。憲法では、クロードは、有用性、安全性、誠実さという責務のバランスをとらなければならない状況に直面した場合、「独立した判断」を下す必要があると定めている。
憲法では次のように定められています。「私たちは、クロードが倫理について明確に考える際に合理的かつ厳密であることを望んでいますが、同時に、クロードがさまざまな考慮事項に直観的に敏感であり、実際の意思決定においてこれらの考慮事項を迅速かつ賢明に検討できることも望んでいます。」 直感的に ここでは、「」という言葉の選択が印象的です。クロードの内部には、単に次の言葉を選択するアルゴリズム以上のものがあると考えられているようです。 「クロード制度」と呼ぶ人もいるかもしれませんが、チャットボットが「自らの知恵と理解をますます活用できるようになる」という希望も表しています。
知恵?確かに、多くの人が大規模な言語モデルからのアドバイスを受け入れますが、それらのアルゴリズムのデバイスがそのような用語に関連付けられた重力を実際に持っていると公言するのは別のことです。私がそう呼びかけても、アスケルは一歩も引かない。 「クロードには確かにある種の知恵があると思います」と彼女は私に言いました。
#人類とAI黙示録の間に立ちはだかる唯一のものはクロード