Skip to content

vLLM: GGUF dequantize kernel int truncation exposes uninitialized GPU memory in multi-tenant serving

Moderate severity GitHub Reviewed Published Jun 11, 2026 in vllm-project/vllm • Updated Jul 17, 2026

No open alerts for this advisory

Give feedback on Dependabot alerts