Lucene search
+L

1 matches found

PyPA
PyPA
added 2025/05/29 5:15 p.m.18 views

PYSEC-2025-53

vLLM is an inference and serving engine for large language models LLMs. Prior to version 0.9.0, when a new prompt is processed, if the PageAttention mechanism finds a matching prefix chunk, the prefill process speeds up, which is reflected in the TTFT Time to First Token. These timing differences...

2.6CVSS6.8AI score0.00257EPSS
SaveExploits0References4Affected Software1
Rows per page
Query Builder