最重要★★★★★Hacker News
Grok 4.6、スコア 61 で AI 最前線に並ぶ——エージェント性能で Claude に肉薄・価格は 60% 安
30秒で把握
- 1Grok 4.6 が Intelligence Index スコア 61・エージェント Elo 1753 で最前線到達、Claude Opus 5 に次ぐ性能
- 2価格 $2/$6 で Claude Opus 5 比 60% 安・実タスク $0.84/回で Kimi K3 と同等かつ高性能
- 3長期知識作業で 53 ターン・0.5B トークンで完了(Claude Opus 5 比 1/2)・効率重視チームの選択肢に
要約
SpaceX AI の Grok 4.6 は Artificial Analysis Intelligence Index でスコア 61 を獲得し、OpenAI・Anthropic と並ぶ AI 最前線に到達した。エージェント性能(GDPval-AA v2 Elo 1753)で Claude Opus 5 に次ぎ、Qwen3.8 Max と統計的に同等である。価格は 1M トークンあたり $2/$6 で Claude Opus 5($5/$25)・GPT-5.6 Sol($5/$30)より 60% 以上安く、コストパフォーマンス・フロンティアに位置する。長期エージェント作業(AA-Briefcase)では Elo 1577 で Claude Fable 5 相当だが、タスク完了に要するターン数・入力トークン数で Claude Opus 5 比で約半分と効率的である。
あなたへの影響
Grok 4.6 がエージェント領域で Claude Opus 5 に次ぐ性能を維持したまま圧倒的に低価格(出力トークン $6 vs. $25)化により、AI エージェント・自動化ツール導入時の選択肢が大きく広がり得る。
推奨:現在 Claude Opus 5 依存のチームは、同等・またはわずかに低い性能で大幅コスト削減が可能かベンチマークで検証する価値がある。