TensorRT-LLMs

mirror of https://github.com/NVIDIA/TensorRT-LLM.git synced 2026-01-14 06:27:45 +08:00

History

Yao Yao 0788c5d0d6 [perf] improve XQA-MLA perf (#5468 ) Signed-off-by: Yao Yao <lowsfer@users.noreply.github.com>		2025-06-26 18:09:13 +08:00
..
fmha_v2	keep sm90 headsize 128 cubins (#5320 )	2025-06-26 12:14:01 +08:00
xqa	[perf] improve XQA-MLA perf (#5468 )	2025-06-26 18:09:13 +08:00