Asayomu Tech
最重要★★★★★Hacker News

GPT-5.6 Sol、物体検出で大幅向上—OpenAI最強のビジョンモデル

30秒で把握

  • 1GPT-5.6 Sol が物体検出で 46.2 mAP@50 達成、GPT-5.5 の 3 倍超へ向上・数え上げも 73% に改善
  • 2トークン消費増で Sol は約 2.5 セント/画像・Gemini Flash (0.8 セント) より高コスト・大規模検出タスクは要検討
  • 3大型画像で不安定性確認・2000×2000 ピクセル以上は事前リサイズ推奨・本番前に予算と性能の実測試行

要約

OpenAI は GPT-5.6 系 (Sol・Terra・Luna) を発表し、Roboflow による実測で Sol が視覚タスクで過去最高の性能を示した。物体検出で GPT-5.5 の 13.8 から 46.2 mAP@50 に 3 倍向上、数え上げで 64.9% から 73.0% に改善した。OCR 性能は GPT-5.5 と同等だが、トークン消費量が増加 (Sol で約 2.5 セント/画像) し、コスト・レイテンシで Gemini 3.5 Flash に劣る。

あなたへの影響

物体検出の 3 倍向上は大きいが、Sol の約 2.5 セント/画像は Gemini Flash の 0.8 セントより 3 倍高く、高頻度の画像処理・検出タスクは予算と精度のトレードオフで Gemini Flash 検討も視野に入れる必要がある。

推奨:大型画像 (2000×2000 以上) では不安定性が報告されているため、本番導入前にコスト試算と大規模テストを実施すべき。

詳細を読む → 元記事へ※ 本文は元記事をご確認ください (asayomu は要約のみ提供)

関連する記事

※ 外部記事の権利は原著作者に帰属します。著作権削除要請は copyright@asayomu.jp までご連絡ください(受領確認 24h・実処理 72h 以内)。