Lucene search
+L

3 matches found

NVD
NVD
•added 2026/09/26 2:16 p.m.•1 views

CVE-2026-100651

vLLM before 0.29.0 fails to enforce decoder prompt-length validation on the disaggregated serving endpoint /inference/v1/generate. When the request contains a 'features' multimodal payload, vllm/entrypoints/serve/disagg/serving.py builds a multimodal EngineInput directly from the caller-supplied...

7.1CVSS
SaveExploits0References2
Cvelist
Cvelist
•added 2026/09/26 1:23 p.m.•2 views

CVE-2026-100651 vllm before 0.29.0 Denial of Service via Decoder Prompt Length Bypass

vLLM before 0.29.0 fails to enforce decoder prompt-length validation on the disaggregated serving endpoint /inference/v1/generate. When the request contains a 'features' multimodal payload, vllm/entrypoints/serve/disagg/serving.py builds a multimodal EngineInput directly from the caller-supplied...

7.1CVSS
SaveExploits0References2
Github Security Blog
Github Security Blog
•added 2026/09/04 9:32 p.m.•27 views

vLLM: Derender endpoints decode caller-supplied GenerateResponse token IDs without output bounds

Summary The /v1/completions/derender and /v1/chat/completions/derender endpoints accept caller-supplied GenerateResponse objects and postprocess every nested choices.tokenids list directly. Unlike the normal render/generate path, derender does not enforce model context length, resolved maxtokens,...

4.3CVSS5.6AI score0.00466EPSS
SaveExploits0References6Affected Software1
Rows per page
Query Builder