注目★★★★★GitHub Advisory
vLLMのCVE-2026-73557、並列処理で防御を回避
30秒で把握
- 1vLLMのCVE-2026-73557、並列処理でCVE-2025-62164修正を回避
- 2PyTorch 2.11.0のプロセス全体フラグがFalseに戻り不正tensor通過
- 3--enable-prompt-embedsが必要、RCEは未確認で影響は条件付き
要約
vLLMのCVE-2026-73557は、CVE-2025-62164向けの修正を並列処理で回避できる脆弱性だ。1件の`/v1/chat/completions`に含まれる2つのprompt embedding部品が別スレッドで処理されると、プロセス全体のPyTorch検証フラグがFalseへ戻り、不正なsparse tensorが`torch.load(weights_only=True)`を通過して`to_dense()`へ到達する。発生には`--enable-prompt-embeds`が必要だが、マルチモーダルモデルや`renderer_num_workers > 1`、`--enable-mm-embeds`は不要で、API認証も標準サーバーでは必須ではない。実行時のクラッシュやメモリ破壊は過去のCVEの挙動に依存し、RCEは確認されていない。修正には、関連する全ローダーで共有するプロセス全体のロックが必要だ。
あなたへの影響
vLLMで`--enable-prompt-embeds`を有効にしている日本の運用チームは、近日中に修正版の適用または同機能の無効化を行い、prompt・画像・音声ローダーの共有ロックを確認すべきです。
推奨:不正なsparse tensorが検証を通過するため、修正前は該当APIへの入力経路とログを重点的に監視してください。