Asayomu Tech
注目★★★★Techmeme

Claude Code、自動実行モードをデフォルト化へ—安全性評価で悪意あるコマンドを 89% ブロック

30秒で把握

  • 1Anthropic が Claude Code オートモードをデフォルト化・8 月 14 日から適用・人間の 13.6% vs AI の 89% ブロック率
  • 2第三者検証で 720 件プロンプトインジェクション攻撃を 100% 防止・ただし悪意パッケージ偽装への耐性は未検証
  • 3コーディングエージェント利用チームは評価手法の実環境での検証と供給チェーン攻撃対策を並行推進すべき

要約

Anthropic は 8 月 14 日から Claude Code の Pro・Max・Team プランでオートモードをデフォルト設定にすると発表した。1,053 名のテストユーザー実験で、隠された危険なコマンド指示に対して人間は 13.6% しか拒否しなかった一方、オートモードは 89% をブロックしたことを確認した。第三者評価機関 Trajectory Labs による 72 件の間接的プロンプトインジェクション攻撃シナリオでは、Claude Fable 5・Opus 5・Sonnet 5 のすべてが 720 件の攻撃を 100% 防いだと主張する。ただし Simon Willison は悪意あるパッケージが正当なコマンドに偽装する攻撃など、現在のオートモード検出の盲点について懸念を残している。

あなたへの影響

Claude Code のオートモード採用が進むと、チームはまずこの評価手法 (89% ブロック率) の実運用での検証と、マルウェア化した依存パッケージのような供給チェーン攻撃への継続的な防御設計を検討する必要がある。

推奨:Willison が指摘する 11% の見落としと、ユーザー環境での実際の攻撃パターンのズレを早期に把握しておくと、導入リスクを大幅に削減できる可能性がある。

詳細を読む → 元記事へ※ 本文は元記事をご確認ください (asayomu は要約のみ提供)

関連する記事

※ 外部記事の権利は原著作者に帰属します。著作権削除要請は copyright@asayomu.jp までご連絡ください(受領確認 24h・実処理 72h 以内)。