Asayomu Tech
注目★★★★Hugging Face Papers

JIT-Agent、LLMの実行基盤を自動進化させ性能を最大20.2点向上

30秒で把握

  • 1JIT-Agent がタスク別agent harnessを自動生成・修復・自己進化
  • 2DeepSeek-V4-FlashがGPT-5.6比で2ベンチマーク9.1点・4.3点上回る
  • 3GLM-5.2は最大20.2点向上し複数モデル系列で性能改善

要約

JIT-Agentは、LLM単体ではなくメモリ管理や計画、アクション protocol、tool orchestrationを担うagent harnessを、タスクごとに自動生成・修復・進化させるモデルだ。固定4モジュールの機械生成可能な構成を採用し、過去の構成と性能信号から自己改善する。利用時にはDeepSeek-V4-FlashがDeepSearchQAでGPT-5.6を9.1点、OdysseyBenchを4.3点上回り、GLM-5.2も最大20.2点向上した。生成したharnessはOpenCodeやClaude Codeと競合する性能を示し、DeepSeek V4、Mimo-V2.5、Qwen3.6の各モデル系列を一貫して改善した。

あなたへの影響

LLMの本番運用チームは、モデル比較だけでなくタスク別harness生成と修復の効果を次スプリントで検証すべきだ。

推奨:harnessはメモリ管理・計画・ツール連携をまとめた実行制御層を指す。

詳細を読む → 元記事へ※ 本文は元記事をご確認ください (asayomu は要約のみ提供)

関連する記事

※ 外部記事の権利は原著作者に帰属します。著作権削除要請は copyright@asayomu.jp までご連絡ください(受領確認 24h・実処理 72h 以内)。