Asayomu Tech
注目★★★★GitHub Advisory

vLLMのCVE-2026-73557、並列処理で防御を回避

30秒で把握

  • 1vLLMのCVE-2026-73557、並列処理でCVE-2025-62164修正を回避
  • 2PyTorch 2.11.0のプロセス全体フラグがFalseに戻り不正tensor通過
  • 3--enable-prompt-embedsが必要、RCEは未確認で影響は条件付き

要約

vLLMのCVE-2026-73557は、CVE-2025-62164向けの修正を並列処理で回避できる脆弱性だ。1件の`/v1/chat/completions`に含まれる2つのprompt embedding部品が別スレッドで処理されると、プロセス全体のPyTorch検証フラグがFalseへ戻り、不正なsparse tensorが`torch.load(weights_only=True)`を通過して`to_dense()`へ到達する。発生には`--enable-prompt-embeds`が必要だが、マルチモーダルモデルや`renderer_num_workers > 1`、`--enable-mm-embeds`は不要で、API認証も標準サーバーでは必須ではない。実行時のクラッシュやメモリ破壊は過去のCVEの挙動に依存し、RCEは確認されていない。修正には、関連する全ローダーで共有するプロセス全体のロックが必要だ。

あなたへの影響

vLLMで`--enable-prompt-embeds`を有効にしている日本の運用チームは、近日中に修正版の適用または同機能の無効化を行い、prompt・画像・音声ローダーの共有ロックを確認すべきです。

推奨:不正なsparse tensorが検証を通過するため、修正前は該当APIへの入力経路とログを重点的に監視してください。

詳細を読む → 元記事へ※ 本文は元記事をご確認ください (asayomu は要約のみ提供)

関連する記事

※ 外部記事の権利は原著作者に帰属します。著作権削除要請は copyright@asayomu.jp までご連絡ください(受領確認 24h・実処理 72h 以内)。