vLLM: GGUF dequantize kernel int truncation exposes uninitialized GPU memory in multi-tenant serving
Moderate severity
GitHub Reviewed
Published
Jun 11, 2026
in
vllm-project/vllm
•
Updated Jul 17, 2026
Give feedback on Dependabot alerts