Asayomu Tech
注目★★★★Hacker News

Qwen3.8、2.4Tパラメータで初のオープンMaxクラス、262Kトークン対応

30秒で把握

  • 1Qwen3.8-2.4T-A95B 公開・2.4T パラメータで初のMax級オープンモデル・262K〜101万トークン対応
  • 2コーディング・エージェントタスク性能が Qwen3.5 比で大幅向上・推論深度を reasoning_effort で制御可能
  • 3vLLM/SGLang/Docker で即座に利用可能・自社インフラ運用の推論コスト削減チャンス

要約

アリババの Qwen3.8-2.4T-A95B がオープンモデルとしてリリースされた。2.4 兆パラメータ (実際に有効化されるのは 95B) を持ち、Qwen-Max クラスの性能をオープンソースで初めて実現した。Qwen3.5 をベースに、コーディング・専門業務・研究・長期的エージェントタスクで大幅な性能向上を達成した。文脈長は標準で 262,144 トークン、拡張時は最大 101 万トークンに対応し、推論深度を reasoning_effort で調整可能である。

あなたへの影響

Qwen3.8 の 95B 有効パラメータで Qwen-Max クラスの性能を持つため、自社 GPU インフラがあるチームは推論コストを大幅削減できる可能性がある。

推奨:vLLM・SGLang との互換性確認と、長文処理時の実メモリ・推論速度の測定を次スプリントで実施すべき。

詳細を読む → 元記事へ※ 本文は元記事をご確認ください (asayomu は要約のみ提供)

関連する記事

※ 外部記事の権利は原著作者に帰属します。著作権削除要請は copyright@asayomu.jp までご連絡ください(受領確認 24h・実処理 72h 以内)。