最重要★★★★★DeepMind
Gemini 3.6 Flash、出力トークン 17% 削減で高速化・Flash-Lite は毎秒 350 トークン対応
30秒で把握
- 1Gemini 3.6 Flash、3.5 Flash 比で出力トークン 17% 削減・API コスト低下・コード精度と ML 研究で向上確認
- 23.5 Flash-Lite が毎秒 350 出力トークン対応・$0.3/1M 入力で高スループットエージェント向けに展開開始
- 33.5 Flash Cyber を CodeMender 経由で政府・信頼パートナー向け限定パイロット提供・セキュリティ脆弱性の検出・修正に特化
要約
Google DeepMind は Gemini 3.6 Flash を発表し、3.5 Flash 比で出力トークン使用量を 17% 削減し、DeepSWE ベンチでは最大 65% の削減を実現した。API コストは $1.50/1M 入力トークン、$7.50/1M 出力トークンと 3.5 Flash より低下し、コード精度(DeepSWE で 49% vs 37%)、ML 研究(MLE Bench で 63.9% vs 49.7%)、コンピュータ使用(OSWorld-Verified で 83% vs 78.4%)で性能向上を確認した。同時に 3.5 Flash-Lite を毎秒 350 出力トークンで提供開始し、$0.3/1M 入力・$2.5/1M 出力の低価格で高スループットエージェントワークロード向けに展開した。セキュリティ特化型の 3.5 Flash Cyber は CodeMender を通じて政府・信頼できるパートナー向けの限定パイロットで利用可能になる。
あなたへの影響
この記事が日本のエンジニアに与える影響と、今日取るべきアクションは、Personal会員向けに掲載しています。
クレカ不要・いつでも解約