注目★★★★★Lobsters
最新 Claude モデル、ツール呼び出しで回帰—仕様近似時に破損動作
30秒で把握
- 1最新 Claude モデルでツール呼び出しの回帰を検出・閉鎖的な Code ハーネスで強化学習
- 2ツール宣言がわずかにズレた場合に破損動作・旧モデルでは問題なし
- 3本番環境での予測不可能な障害リスク・スキーマの厳密な一致を確認必須
要約
Armin Ronacher が最新世代 Anthropic Claude モデルでツール呼び出し (tool calling) の回帰を検出した。これらのモデルが Claude 独自の閉鎖的な Code ハーネスで強く強化学習されており、ツール宣言がわずかにズレると、旧モデルでは問題なかった破損したツール呼び出し動作が発生するようになったと指摘した。実装側の厳密な仕様一致が必須となった一方で、スキーマの些細な差異が本番環境で予測不可能な障害につながる危険性が生じている。
あなたへの影響
Claude を既存アプリケーションのツール呼び出し機能に組み込んでいるチームは、引数スキーマや関数署名の定義を改めて検証し、テスト環境で最新モデルの挙動を確認したうえで本番適用することを強く推奨する。
推奨:最新モデルほど強化学習の影響を受けやすく、わずかな仕様ズレが本番障害につながり得るため、段階的なロールアウトと監視体制の強化が必須。