Skip to content

Commit beca88e

Browse files
authored
[BugFix][K3] Skip moe_intermediate padding when EP is enabled (#51131)
1 parent a3b8675 commit beca88e

1 file changed

Lines changed: 1 addition & 1 deletion

File tree

vllm/models/kimi_k3/nvidia/model.py

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -494,7 +494,7 @@ def __init__(
494494
min_moe_intermediate_per_partition = getattr(
495495
config, "min_moe_intermediate_per_partition", 256
496496
)
497-
if self.tp_size > 1:
497+
if self.tp_size > 1 and not vllm_config.parallel_config.enable_expert_parallel:
498498
moe_intermediate_per_partition = moe_intermediate_size // self.tp_size
499499
if moe_intermediate_per_partition < min_moe_intermediate_per_partition:
500500
self.padded_moe_intermediate_size = (

0 commit comments

Comments
 (0)