注目★★★★★Techmeme
Claude Code、自動実行モードをデフォルト化へ—安全性評価で悪意あるコマンドを 89% ブロック
30秒で把握
- 1Anthropic が Claude Code オートモードをデフォルト化・8 月 14 日から適用・人間の 13.6% vs AI の 89% ブロック率
- 2第三者検証で 720 件プロンプトインジェクション攻撃を 100% 防止・ただし悪意パッケージ偽装への耐性は未検証
- 3コーディングエージェント利用チームは評価手法の実環境での検証と供給チェーン攻撃対策を並行推進すべき
要約
Anthropic は 8 月 14 日から Claude Code の Pro・Max・Team プランでオートモードをデフォルト設定にすると発表した。1,053 名のテストユーザー実験で、隠された危険なコマンド指示に対して人間は 13.6% しか拒否しなかった一方、オートモードは 89% をブロックしたことを確認した。第三者評価機関 Trajectory Labs による 72 件の間接的プロンプトインジェクション攻撃シナリオでは、Claude Fable 5・Opus 5・Sonnet 5 のすべてが 720 件の攻撃を 100% 防いだと主張する。ただし Simon Willison は悪意あるパッケージが正当なコマンドに偽装する攻撃など、現在のオートモード検出の盲点について懸念を残している。
あなたへの影響
Claude Code のオートモード採用が進むと、チームはまずこの評価手法 (89% ブロック率) の実運用での検証と、マルウェア化した依存パッケージのような供給チェーン攻撃への継続的な防御設計を検討する必要がある。
推奨:Willison が指摘する 11% の見落としと、ユーザー環境での実際の攻撃パターンのズレを早期に把握しておくと、導入リスクを大幅に削減できる可能性がある。