注目★★★★★Anthropic
Anthropic、AI の危険度レベルに応じた「責任あるスケーリング政策」を公開
30秒で把握
- 1Anthropic が「AI Safety Levels (ASL)」枠組みを含む責任あるスケーリング政策を公開
- 2テロ・国家主体の悪用や自律的破壊行動による大規模被害をリスク管理の主軸に据えた
- 3ASL-2 は現行基準・White House 約束と一致、ASL-3 以上はより厳格な基準を要求
要約
Anthropic は AI モデルの開発リスク管理のため「責任あるスケーリング政策 (RSP)」を公開した。同政策は「AI Safety Levels (ASL)」という枠組みを導入し、米国の生物安全性レベル (BSL) 基準をモデルに、モデルの破壊的能力に応じた安全・セキュリティ・運用基準を定めている。テロリストや国家主体による悪用、あるいは設計者の意図に反した自律的行動による大規模被害といった「破局的リスク」に焦点を当てている。
あなたへの影響
大規模言語モデルの開発・運用チームは、同政策の ASL レベルとベンチマーク基準を参考に社内の安全評価プロセスを見直す材料となる。
推奨:政策の詳細実装は公開ドキュメントで確認し、自社モデルが該当する ASL レベルの基準を満たしているか検証することを推奨する。