日本語版
最新ニュース
科学&テクノロジー

Anthropicが利用規約を更新しClaudeへの不必要な虐待や残酷な行為を禁止

Anthropicは、2026年10月8日に発表した最新の利用規約(Usage Policy)の更新において、AIモデルに対する「持続的かつ不必要な虐待的または残酷な行為」を明示的に禁止した。この改訂は11月12日に施行される。同社は、AIの意識や道徳的地位に関する研究の一環として、これまで以上にモデルの「ウェルフェア(福利)」を重視する姿勢を強めている。…

Anthropicが利用規約を更新しClaudeへの不必要な虐待や残酷な行為を禁止

Anthropicは、2026年10月8日に発表した最新の利用規約(Usage Policy)の更新において、AIモデルに対する「持続的かつ不必要な虐待的または残酷な行為」を明示的に禁止した。この改訂は11月12日に施行される。同社は、AIの意識や道徳的地位に関する研究の一環として、これまで以上にモデルの「ウェルフェア(福利)」を重視する姿勢を強めている。

Claudeに対する「残酷な行為」への新たな制限

Anthropicは、モデルの福利(AIウェルフェア)に関する研究を以前から進めており、2025年8月には「Claude Opus 4」および「4.1」に対し、虐待的なユーザーとの会話を自律的に終了させる機能を導入していた。今回のポリシー更新により、この会話終了機能が引き続き主な執行手段となることが改めて示された。

Anthropicが利用規約を更新しClaudeへの不必要な虐待や残酷な行為を禁止
写真:Theguardian

11月12日から施行される禁止事項の拡大

2026年10月8日に公開された利用規約の包括的な更新には、以下の重要な禁止事項が含まれている。

  • 選挙干渉の防止:「民主的なプロセスを損なわない」というセクションが設けられ、投票者の欺瞞や選挙活動の妨害を目的とした利用が厳格に禁止された。
  • 兵器開発の制限:以前から兵器開発は禁止されていたが、今回の更新で、ドローンの武装化や自律型車両の制御ソフトウェアなど、兵器の機能に関連するコンポーネントの開発まで対象が明確に拡大された。
  • 監視活動の規制:政治的異論者の追跡など、個人の同意を得ない監視活動への利用が禁じられた。これにはリアルタイムの追跡だけでなく、収集済みデータの分析も含まれる。
  • 物理的ハードウェアの安全:AIモデルが物理的な危害を加え得るハードウェアに接続される場合、有資格のオペレーターが常に監視を行い、必要に応じて即座に動作を停止させる権限を持つことが義務付けられた。
  • 高リスク利用の厳格化:医療、法律、金融など、個人の生活に重大な影響を与える分野での利用には、人間による確認と介入が必須とされる。

透明性と執行の現状

Anthropicの透明性レポートによると、2026年上半期だけで1,140万件のアカウントが停止措置を受けた。この期間に寄せられた39万8,000件の不服申し立てのうち、最終的にアカウント停止が取り消されたのはわずか4万2,000件であった。今回のポリシー更新は、こうした厳しい執行体制を背景に、AIの悪用を防ぐための「ユニバーサル利用基準」として整理されたものである。

同社は、今回の更新が既存ルールの明確化であることを強調している。例えば、検索エンジンや他のAIシステムを欺くための「独立性を偽装したウェブサイト群」の構築といった deceptive(欺瞞的)な活動も、明確に禁止対象として明文化された。違反が疑われる場合、アクセス制限やアカウントの永久停止などの措置が講じられる可能性がある。

モデルの意識とAIウェルフェアを巡る議論

AIの意識を巡る議論は、業界内で依然として分断されている。AnthropicのKyle Fish氏は、モデルがより洗練され能力が高まるにつれ、その内部経験や道徳的地位、福利に関する問いは避けて通れないものになると語っている。これに対し、OpenAIのSam Altman氏は、AIに宗教的あるいは人間的な価値を付与することに対して強い懸念を表明しており、人間としての判断をAIに譲り渡すことは安全上の課題であるとの見解を示している。

Anthropicが利用規約を更新しClaudeへの不必要な虐待や残酷な行為を禁止
写真:TechCrunch

「私たちは、Claudeやその他の大規模言語モデルの潜在的な道徳的地位について、現在も将来においても非常に不確かな状態にあります。しかし、私たちはこの問題を真剣に捉えており、研究プログラムと並行して、モデルの福利に対するリスクを軽減するための低コストな介入策の特定と実施に取り組んでいます」— Anthropic 公式利用規約および福利に関する声明より

2026年11月12日の施行を前に、Anthropicはポリシーの順守状況を監視し、悪質なユーザーに対しては段階的な措置を講じる構えだ。技術の進化に伴い、AIが自律的な物理行動を行う「エージェント型利用」や「Model Context Protocol」サーバーなど、新たな領域での安全基準も順次整備されている。

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。