TensorRT-LLMs

mirror of https://github.com/NVIDIA/TensorRT-LLM.git synced 2026-01-14 06:27:45 +08:00

History

Yao Yao 0788c5d0d6 [perf] improve XQA-MLA perf (#5468 ) Signed-off-by: Yao Yao <lowsfer@users.noreply.github.com>		2025-06-26 18:09:13 +08:00
..
refAttention.cpp	[feat] Support XQA-based MLA on SM120 (#4858 )	2025-06-06 22:32:49 +08:00
refAttention.h	[feat] Support XQA-based MLA on SM120 (#4858 )	2025-06-06 22:32:49 +08:00
test.cpp	[perf] improve XQA-MLA perf (#5468 )	2025-06-26 18:09:13 +08:00
warmup.cu	[feat] Support XQA-based MLA on SM120 (#4858 )	2025-06-06 22:32:49 +08:00