TensorRT-LLMs

mirror of https://github.com/NVIDIA/TensorRT-LLM.git synced 2026-01-14 06:27:45 +08:00

History

Kefeng-Duan f5b6d453aa doc： DS r1 min latency blog (#4386 ) * add best perf practice on DSR1 Signed-off-by: Jun Yang <143764042+juney-nvidia@users.noreply.github.com> * add ds-r1 min latency tech blog Signed-off-by: Jun Yang <143764042+juney-nvidia@users.noreply.github.com> * rm redundant doc Signed-off-by: Jun Yang <143764042+juney-nvidia@users.noreply.github.com> * refine table content Signed-off-by: Jun Yang <143764042+juney-nvidia@users.noreply.github.com> * refine table content Signed-off-by: Jun Yang <143764042+juney-nvidia@users.noreply.github.com> * relative path for images Signed-off-by: Jun Yang <143764042+juney-nvidia@users.noreply.github.com> * refine precommit Signed-off-by: Jun Yang <143764042+juney-nvidia@users.noreply.github.com> * pr4280 is merged Signed-off-by: Jun Yang <143764042+juney-nvidia@users.noreply.github.com> --------- Signed-off-by: Jun Yang <143764042+juney-nvidia@users.noreply.github.com>		2025-05-16 20:20:28 +08:00
..
media	doc： DS r1 min latency blog (#4386 )	2025-05-16 20:20:28 +08:00
tech_blog	doc： DS r1 min latency blog (#4386 )	2025-05-16 20:20:28 +08:00
.gitkeep	Add Latest News section (#315 )	2023-11-08 15:04:33 +08:00
Best_perf_practice_on_DeepSeek-R1_in_TensorRT-LLM.md	chore: Mass Integration 0.19 (#4255 )	2025-05-16 10:53:25 +02:00
Falcon180B-H200.md	chore: fix some invalid paths of contrib models (#3818 )	2025-04-24 05:36:16 +08:00
H100vsA100.md	Update TensorRT-LLM (#1492 )	2024-04-24 14:44:22 +08:00
H200launch.md	Update TensorRT-LLM (#1492 )	2024-04-24 14:44:22 +08:00
quantization-in-TRT-LLM.md	Update TensorRT-LLM (#2792 )	2025-02-18 21:27:39 +08:00
XQA-kernel.md	Update TensorRT-LLM (#2008 )	2024-07-23 23:05:09 +08:00