From fd7d858c8ac59cd962cb289d059ab29d27ae3a6f Mon Sep 17 00:00:00 2001 From: Rebecca Lee <110500452+rebklee@users.noreply.github.com> Date: Wed, 13 May 2026 23:21:04 -0700 Subject: [PATCH] Use hidden_pad and intermediate_pad from vLLM #34301 (#42098) Signed-off-by: Rebecca Lee --- .../model_executor/layers/fused_moe/experts/rocm_aiter_moe.py | 4 ++-- 1 file changed, 2 insertions(+), 2 deletions(-) diff --git a/vllm/model_executor/layers/fused_moe/experts/rocm_aiter_moe.py b/vllm/model_executor/layers/fused_moe/experts/rocm_aiter_moe.py index dd16f6bc24d..be7d1f99215 100644 --- a/vllm/model_executor/layers/fused_moe/experts/rocm_aiter_moe.py +++ b/vllm/model_executor/layers/fused_moe/experts/rocm_aiter_moe.py @@ -356,8 +356,8 @@ def rocm_aiter_fused_experts( doweight_stage1=apply_router_weight_on_input, num_local_tokens=num_local_tokens, output_dtype=output_dtype, - hidden_pad=hidden_pad, - intermediate_pad=intermediate_pad, + hidden_pad=hidden_pad // 128 * 128, + intermediate_pad=intermediate_pad // 64 * 64 * 2, bias1=quant_config.w1_bias if quant_config.use_mxfp4_w4a16 else None, bias2=quant_config.w2_bias if quant_config.use_mxfp4_w4a16 else None, )