Lucene search
+L

1 matches found

OSV
OSV
added 2025/05/29 5:15 p.m.11 views

PYSEC-2025-53

vLLM is an inference and serving engine for large language models LLMs. Prior to version 0.9.0, when a new prompt is processed, if the PageAttention mechanism finds a matching prefix chunk, the prefill process speeds up, which is reflected in the TTFT Time to First Token. These timing differences...

2.6CVSS7AI score0.00257EPSS
SaveExploits0References3
Rows per page
Query Builder