最重要★★★★★Hacker News
Grok 4.7、長時間コーディングを強化し入力 $2/M tokens
30秒で把握
- 1SpaceXAI が Grok 4.7 公開、長時間コーディングと自己検証を強化
- 2入力 $2・出力 $6/M tokens、Cursor・Grok API などで提供
- 3安全性ベンチマークで生物 62.4%、危険なサイバー依頼通過率 3.3%
要約
SpaceXAI は Grok 4.7 を公開し、コーディングと知識業務向けの性能を強化した。Grok 4.6 より大規模な基盤モデルと長時間の強化学習を採用し、長時間のタスク管理や自己検証、長いコンテキスト処理を改善した。CursorBench 4.0 では価格性能比が最先端級で、GDPval と AA Briefcase でも Grok 4.6 を上回った。安全性スタックも刷新し、LatchBio の生物安全性ベンチマークで 62.4%、HackerBench v0.3 では危険なデュアルユースプロンプトの通過率を 3.3% に抑えた。Cursor、Grok Build、Grok API などで提供し、料金は入力 100 万トークンあたり $2、出力 100 万トークンあたり $6。出力速度 2 倍の高速版は 2 倍の料金となる。
あなたへの影響
LLM を開発や知識業務で使う日本のエンジニアは、既存モデルとの品質・料金・安全性を次の評価サイクルで比較する。
推奨:デュアルユース領域では、通常業務を妨げず危険な依頼を拒否する性能の検証が必要になる可能性がある。