-
Notifications
You must be signed in to change notification settings - Fork 2.6k
All issues
Issue creation is restricted in this repository
- #15044 · laikhtewari opened
on Jun 6, 2026 1 - #3148 · juney-nvidia opened
on Mar 29, 2025 5 - #3124 · juney-nvidia opened
on Mar 27, 2025 11
Issues
is:issue state:open
is:issue state:open
Search results
[Bug]: SamplingParams accepts NaN for top_p, min_p and temperature
Decoding/Sampling<NV>Token sampling algorithms in TRTLLM for text gen (top-k, top-p, beam).<NV>Token sampling algorithms in TRTLLM for text gen (top-k, top-p, beam).Status: Open.#17158 In NVIDIA/TensorRT-LLM;- Status: Open.#17156 In NVIDIA/TensorRT-LLM;
[Bug]: Poolside's Laguna models' reasoning parser is broken: the
</think>block leaks into the model's answerbugSomething isn't workingSomething isn't workingStatus: Open.#17146 In NVIDIA/TensorRT-LLM;[Bug]: SM121 (GB10) excluded from FP8 block-scales SM120 Python paths while C++ getSMVersion() aliases 121→120
Customized kernels<NV>Specialized/modified CUDA kernels in TRTLLM for LLM ops, beyond standard TRT. Dev & perf.<NV>Specialized/modified CUDA kernels in TRTLLM for LLM ops, beyond standard TRT. Dev & perf.Status: Open.#17126 In NVIDIA/TensorRT-LLM;[Bug] DSpark: disaggregated gen-only benchmark deadlocks under attention-DP with asymmetric (gen-only) speculative decoding
Disaggregated serving<NV>Deploying with separated, distributed components (params, kv-cache, compute). Arch & perf.<NV>Deploying with separated, distributed components (params, kv-cache, compute). Arch & perf.Speculative Decoding<NV>MTP/Eagle/Medusa/Lookahead/Prompt-Lookup-Decoding/Draft-Target-Model/ReDrafter<NV>MTP/Eagle/Medusa/Lookahead/Prompt-Lookup-Decoding/Draft-Target-Model/ReDrafterStatus: Open.#17095 In NVIDIA/TensorRT-LLM;- Status: Open.#17027 In NVIDIA/TensorRT-LLM;
- Status: Open.#17025 In NVIDIA/TensorRT-LLM;
- Status: Open.#17024 In NVIDIA/TensorRT-LLM;
- Status: Open.#17022 In NVIDIA/TensorRT-LLM;
- Status: Open.#17021 In NVIDIA/TensorRT-LLM;
- Status: Open.#17020 In NVIDIA/TensorRT-LLM;
- Status: Open.#17016 In NVIDIA/TensorRT-LLM;