注目★★★★★Hugging Face Papers
OPD-Evolver:自己蒸留で記憶管理を内面化するエージェント進化フレームワーク
30秒で把握
- 1OPD-Evolverが記憶の選択・活用・記述・管理の4能力を自己蒸留で習得
- 2ReasoningBank比最大11.5%・Skill0比約5.8%の性能向上をベンチマークで達成
- 39Bモデルが397B級モデルに匹敵し小型エージェントの自己進化可能性を示す
要約
OPD-Evolverは、エージェントが経験を選択・活用・記述・管理する4能力を自己蒸留で習得する「遅速共進化」フレームワークを提案した。高速ループで4階層メモリと対話し、低速ループで成果較正メモリ帰属と事後蒸留の2機構が4能力をポリシーへ統合する。複数ドメインベンチマークでReasoningBankを最大11.5%、Skill0を約5.8%上回った。
あなたへの影響
9BモデルがQwen3.5-397Bクラスに追いつく結果は、推論コストとモデルサイズのトレードオフ見直しにつながり得る。
推奨:エージェント開発チームはメモリ設計の再評価と本フレームワークの実装検証を検討する余地がある。