-
Notifications
You must be signed in to change notification settings - Fork 270
All issues
Issue creation is restricted in this repository
Issues
is:issue state:open
is:issue state:open
Search results
- Status: Open.#3225 In vllm-project/tpu-inference;
- Status: Open.#3164 In vllm-project/tpu-inference;
- Status: Open.#3127 In vllm-project/tpu-inference;
[Bug]: kv_cache_dtype=fp8 silently allocates bf16 on v5e (RPA v3) while logging that fp8 is active
bugSomething isn't workingSomething isn't workingStatus: Open.#3126 In vllm-project/tpu-inference;[Bug]: BATCHED_RPA_KERNEL does not work with speculative decoding
bugSomething isn't workingSomething isn't workingStatus: Open.#3095 In vllm-project/tpu-inference;- Status: Open.#3081 In vllm-project/tpu-inference;
- Status: Open.#3077 In vllm-project/tpu-inference;
- Status: Open.#3076 In vllm-project/tpu-inference;
- Status: Open.#3049 In vllm-project/tpu-inference;
[Bug]: EP behavior difference in flax_nnx vs. torchax path
bugSomething isn't workingSomething isn't workingStatus: Open.#3041 In vllm-project/tpu-inference;[Bug]: AssertionError in set_forward_context during Qwen3-30B-A3B-Thinking AOT Pre-compilation with DP > 1
bugSomething isn't workingSomething isn't workingStatus: Open.#3026 In vllm-project/tpu-inference;- Status: Open.#2952 In vllm-project/tpu-inference;