2026.03.01 Category REPORT Reading 7 min

Anthropic Responsible Scaling Policy v3.0は何を変えたか

フロンティアAI企業は、能力が上がるほど強い安全策を求められる。だが、企業単独で開発を止めても、他社が進み続けるなら、社会全体のリスクは下がらないかもしれない。この集合行為問題が、AI安全フレームワークの難しさである。

Anthropicは2026年2月24日付でResponsible Scaling Policy(RSP)Version 3.0を公開した。RSPは、先進AIシステムの破局的リスクを管理するための任意フレームワークとされている。

v3.0の要点は「会社計画」と「業界勧告」の分離

Anthropic RSP v3.0の主な構成
構成意味
Industry-wide recommendations業界全体で必要と考える安全策
Frontier Safety RoadmapsSecurity、Alignment、Safeguards、Policyでの進捗計画
Risk Reportsモデルの安全プロファイル、脅威モデル、緩和策を説明する文書
Governance内部・外部の説明責任を高める仕組み

Anthropicは、従来のRSPからの変更理由として、破局的リスクは複数のAI開発者の行動に依存するため、一社だけの絶対的なコミットメントでは扱いにくいと説明している。

透明性は増えるが、自己規律の限界は残る

Risk ReportsやFrontier Safety Roadmapsは、外部が企業の考え方を読みやすくする。しかし、RSPは任意の企業方針であり、外部規制そのものではない。企業が自らリスクを評価し、自ら更新できる点は、常に限界として見るべきだ。

フロンティアAIの安全性を考えるなら、企業フレームワーク、第三者監査、政府評価、国際標準を組み合わせて読む必要がある。

この記事の限界

  • この記事はAnthropic RSP v3.0本文をもとに、方針変更の構造を整理したもの
  • RSPの実効性、外部レビュー、各Risk Reportの内容は今後の運用実績で確認する必要がある

出典(2026年7月7日閲覧): Anthropic「Responsible Scaling Policy Version 3.0」(anthropic.com

AnthropicResponsible Scaling PolicyフロンティアAIAI安全性
Related
PORTRAIT
64×64
サク
UMT株式会社 取締役 / フォースネット株式会社 執行役員

IT業界25年のエンジニア(コンサル・プロダクトマネージャー15年、Python 10年)。2児の父として、AIを使った家庭学習の仕組みを自作して毎日運用し、地元・横浜/鎌倉ではAI・パソコン教室も不定期に開いている。このサイトには、教育とAIについて調べたこと・考えたことと、その道具を置いている。