注目★★★★★Hacker News
Qwen3.8、2.4Tパラメータで初のオープンMaxクラス、262Kトークン対応
30秒で把握
- 1Qwen3.8-2.4T-A95B 公開・2.4T パラメータで初のMax級オープンモデル・262K〜101万トークン対応
- 2コーディング・エージェントタスク性能が Qwen3.5 比で大幅向上・推論深度を reasoning_effort で制御可能
- 3vLLM/SGLang/Docker で即座に利用可能・自社インフラ運用の推論コスト削減チャンス
要約
アリババの Qwen3.8-2.4T-A95B がオープンモデルとしてリリースされた。2.4 兆パラメータ (実際に有効化されるのは 95B) を持ち、Qwen-Max クラスの性能をオープンソースで初めて実現した。Qwen3.5 をベースに、コーディング・専門業務・研究・長期的エージェントタスクで大幅な性能向上を達成した。文脈長は標準で 262,144 トークン、拡張時は最大 101 万トークンに対応し、推論深度を reasoning_effort で調整可能である。
あなたへの影響
Qwen3.8 の 95B 有効パラメータで Qwen-Max クラスの性能を持つため、自社 GPU インフラがあるチームは推論コストを大幅削減できる可能性がある。
推奨:vLLM・SGLang との互換性確認と、長文処理時の実メモリ・推論速度の測定を次スプリントで実施すべき。