Asayomu Tech
注目★★★★★Hugging Face Papers

OPD-Evolver:自己蒸留で記憶管理を内面化するエージェント進化フレームワーク

30秒で把握

  • 1OPD-Evolverが記憶の選択・活用・記述・管理の4能力を自己蒸留で習得
  • 2ReasoningBank比最大11.5%・Skill0比約5.8%の性能向上をベンチマークで達成
  • 39Bモデルが397B級モデルに匹敵し小型エージェントの自己進化可能性を示す

要約

OPD-Evolverは、エージェントが経験を選択・活用・記述・管理する4能力を自己蒸留で習得する「遅速共進化」フレームワークを提案した。高速ループで4階層メモリと対話し、低速ループで成果較正メモリ帰属と事後蒸留の2機構が4能力をポリシーへ統合する。複数ドメインベンチマークでReasoningBankを最大11.5%、Skill0を約5.8%上回った。

あなたへの影響

9BモデルがQwen3.5-397Bクラスに追いつく結果は、推論コストとモデルサイズのトレードオフ見直しにつながり得る。

推奨:エージェント開発チームはメモリ設計の再評価と本フレームワークの実装検証を検討する余地がある。

詳細を読む → 元記事へ※ 本文は元記事をご確認ください (asayomu は要約のみ提供)

関連する記事

※ 外部記事の権利は原著作者に帰属します。著作権削除要請は copyright@asayomu.jp までご連絡ください(受領確認 24h・実処理 72h 以内)。