Asayomu Tech
注目★★★★Lobsters

Qwen 3.8 27B、推論設定が「過剰思考モード」デフォルト—軽めに使うのが正解

30秒で把握

  • 1Qwen 3.8 27B が 27B パラメータで Apache 2.0 ライセンス公開・vision 対応・前世代超える
  • 2デフォルト推論レベル xhigh で単純指示も数分間の過剰思考・出力が依頼と乖離
  • 3reasoning_effort を low に設定すると 2 分以内に完了・ボックス検出とコード生成は精度維持

要約

Alibaba の Qwen 3.8 27B は 27B パラメータの軽量ビジョン対応 LLM で、ベンチマークスコアは前世代 3.6 27B を上回る。だが デフォルト設定で「xhigh」(最深度推論) が有効になっており、単純な「円の SVG を描け」という指示まで複数分間の過剰な思考ループを実行して、依頼者の意図と大きくずれた装飾的な出力を生成する。Simon Willison は推論レベルを低くするか無効にして使うことを強く勧める。

あなたへの影響

27B モデルをラップトップで実行可能な点は魅力的ですが、デフォルト推論設定のまま運用すると レイテンシが実務的でなくなり、トークン消費も膨大になります。

推奨:ローカル推論エージェント構築を検討する場合は、まず reasoning_effort パラメータを low に下げて試すことをお勧めします。

詳細を読む → 元記事へ※ 本文は元記事をご確認ください (asayomu は要約のみ提供)

関連する記事

※ 外部記事の権利は原著作者に帰属します。著作権削除要請は copyright@asayomu.jp までご連絡ください(受領確認 24h・実処理 72h 以内)。