-
-
Notifications
You must be signed in to change notification settings - Fork 21k
All issues
Issue creation is restricted in this repository
- #42770 · WoosukKwon opened
on May 15, 2026 21 - #44280 · BugenZhao opened
on Jun 2, 2026 35 - #50001 · ywang96 opened
on Jul 27, 2026 13
Issues
is:issue state:open
is:issue state:open
Search results
[Bug] NixlPushConnector heartbeat fails to renew KV leases
bugSomething isn't workingSomething isn't workingStatus: Open.#53095 In vllm-project/vllm;[Bug]: CLIP pooling model silently returns identical (empty-prompt) embeddings for all completion-style input text requests under sustained multimodal load
multi-modalityRelated to multi-modality (#4194)Related to multi-modality (#4194)Status: Open.#53091 In vllm-project/vllm;[Bug]: Assertion failure due to inconsistent block counts between P and D sides when tools dict key ordering differs in template serialization with tool calls enabled
bugSomething isn't workingSomething isn't workingStatus: Open.#53089 In vllm-project/vllm;- Status: Open.#53086 In vllm-project/vllm;
[Bug]: MooncakeStoreConnector stores invalid recurrent states with mamba_cache_mode=align, causing silent output corruption
bugSomething isn't workingSomething isn't workingStatus: Open.#53084 In vllm-project/vllm;- Status: Open.#53083 In vllm-project/vllm;
- Status: Open.#53072 In vllm-project/vllm;
[Bug] v1 detokenizer: client stop strings match inside the reasoning segment, decapitating think-in-prompt models (lm-eval sends stop on every request)
rocmRelated to AMD ROCmRelated to AMD ROCmStatus: Open.#53066 In vllm-project/vllm;DFlash draft model does not inherit the target's RoPE layout (is_neox_style)
bugSomething isn't workingSomething isn't workingStatus: Open.#53063 In vllm-project/vllm;- Status: Open.#53062 In vllm-project/vllm;
[Bug]: Prefill misdispatched into spec-decode FULL cudagraph when prompt length == 1 + num_speculative_tokens → silent GDN state loss, garbage output (hybrid/Qwen3-Next models)
rocmRelated to AMD ROCmRelated to AMD ROCmStatus: Open.#53051 In vllm-project/vllm;[Bug]: MultiConnector: finished_recving lacks per-connector dedup — late/stale load reports crash scheduler assert in P/D + dual-connector setups
bugSomething isn't workingSomething isn't workingStatus: Open.#53049 In vllm-project/vllm;