TensorRT-LLMs

mirror of https://github.com/NVIDIA/TensorRT-LLM.git synced 2026-01-14 06:27:45 +08:00

History

dongxuy04 16535991b2 feat: Add MNNVL MoE A2A support (#3504 ) * add MNNVL memory mapping support Signed-off-by: Dongxu Yang <78518666+dongxuy04@users.noreply.github.com> * add more MPI environment for trtllm-llmapi-launch Signed-off-by: Dongxu Yang <78518666+dongxuy04@users.noreply.github.com> * add MoE communication and prepare kernels Signed-off-by: Dongxu Yang <78518666+dongxuy04@users.noreply.github.com> * add MNNVL AlltoAll support for DeepSeekV3 Signed-off-by: Dongxu Yang <78518666+dongxuy04@users.noreply.github.com> * add output dump for throughput benchmark Signed-off-by: Dongxu Yang <78518666+dongxuy04@users.noreply.github.com> * support dynamic kernel launch grid Signed-off-by: Dongxu Yang <78518666+dongxuy04@users.noreply.github.com> * address review comments Signed-off-by: Dongxu Yang <78518666+dongxuy04@users.noreply.github.com> * address review comments #2 Signed-off-by: Dongxu Yang <78518666+dongxuy04@users.noreply.github.com> --------- Signed-off-by: Dongxu Yang <78518666+dongxuy04@users.noreply.github.com>		2025-04-25 17:29:08 +08:00
..
cmake	refactor: Clean up CMakeLists.txt (#3479 )	2025-04-18 14:39:29 +08:00
include/tensorrt_llm	fix: Fix C++ decoder synchronization in PyTorch (#3106 )	2025-04-23 23:55:27 +08:00
micro_benchmarks	feat: Add FP8 support for SM 120 (#3248 )	2025-04-14 16:05:41 -07:00
tensorrt_llm	feat: Add MNNVL MoE A2A support (#3504 )	2025-04-25 17:29:08 +08:00
tests	chore: increase A30 for cpp test (#3811 )	2025-04-24 16:34:39 -07:00
CMakeLists.txt	refactor: Clean up CMakeLists.txt (#3479 )	2025-04-18 14:39:29 +08:00