Asayomu Tech
最重要★★★★★Hacker News

Grok 4.6、スコア 61 で AI 最前線に並ぶ——エージェント性能で Claude に肉薄・価格は 60% 安

30秒で把握

  • 1Grok 4.6 が Intelligence Index スコア 61・エージェント Elo 1753 で最前線到達、Claude Opus 5 に次ぐ性能
  • 2価格 $2/$6 で Claude Opus 5 比 60% 安・実タスク $0.84/回で Kimi K3 と同等かつ高性能
  • 3長期知識作業で 53 ターン・0.5B トークンで完了(Claude Opus 5 比 1/2)・効率重視チームの選択肢に

要約

SpaceX AI の Grok 4.6 は Artificial Analysis Intelligence Index でスコア 61 を獲得し、OpenAI・Anthropic と並ぶ AI 最前線に到達した。エージェント性能(GDPval-AA v2 Elo 1753)で Claude Opus 5 に次ぎ、Qwen3.8 Max と統計的に同等である。価格は 1M トークンあたり $2/$6 で Claude Opus 5($5/$25)・GPT-5.6 Sol($5/$30)より 60% 以上安く、コストパフォーマンス・フロンティアに位置する。長期エージェント作業(AA-Briefcase)では Elo 1577 で Claude Fable 5 相当だが、タスク完了に要するターン数・入力トークン数で Claude Opus 5 比で約半分と効率的である。

あなたへの影響

Grok 4.6 がエージェント領域で Claude Opus 5 に次ぐ性能を維持したまま圧倒的に低価格(出力トークン $6 vs. $25)化により、AI エージェント・自動化ツール導入時の選択肢が大きく広がり得る。

推奨:現在 Claude Opus 5 依存のチームは、同等・またはわずかに低い性能で大幅コスト削減が可能かベンチマークで検証する価値がある。

詳細を読む → 元記事へ※ 本文は元記事をご確認ください (asayomu は要約のみ提供)

関連する記事

※ 外部記事の権利は原著作者に帰属します。著作権削除要請は copyright@asayomu.jp までご連絡ください(受領確認 24h・実処理 72h 以内)。