注目★★★★★Azure
Microsoft Foundry、AIエージェントの推論コストを最大97%削減
30秒で把握
- 1MicrosoftがFoundryでAIエージェントの継続的なコスト最適化を実現
- 2Foundry IQが想起率54%向上・検索トークン費34%削減
- 3Toolboxのtool searchが大規模ツール群の入力トークンを約97%削減
要約
Microsoftは、企業向けAIエージェントの継続的なコスト削減と性能向上に向け、Microsoft Foundryの「context engineering」を提案した。Foundry IQは検索結果の再ランキングなどで証拠想起率を最大54%高め、検索トークンコストを34%削減した。Toolboxのtool searchは、大規模なツールライブラリで平均入力トークン消費を約97%削減する。Skillsは手順を共有し、Memoryは会話・ユーザー情報・手順を保持する。Procedural memoryはSTATE-BenchとTau-Benchで約5%改善し、Agent optimizerは利用状況から指示やツール定義、モデル設定を更新する。
あなたへの影響
企業向けAIエージェントを運用するチームは、モデル変更だけでなく毎ターン投入する文書・ツール・履歴を棚卸しし、Foundry IQとtool searchの効果を次スプリントで検証すべき。
推奨:不要なコンテキストを減らせば、品質を維持したままコストを下げられる可能性があるため、権限管理と保持期間を含めて評価する。