Skip to content
Open
Changes from 1 commit
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
21 changes: 12 additions & 9 deletions vllm/distributed/eplb/eplb_state.py
Original file line number Diff line number Diff line change
Expand Up @@ -576,15 +576,18 @@ def step(
# Compute balancedness ratio:
# for each layer:
# (mean load across ranks) / (max load across ranks)
avg_tokens_tensor = num_tokens_per_rank.mean(dim=0).sum(dim=0)
max_tokens_tensor = num_tokens_per_rank.max(dim=0).values.sum(dim=0)

# Just to make type checker happy
tokens_tensors: list[float] = torch.stack(
[avg_tokens_tensor, max_tokens_tensor]
).tolist()
avg_tokens, max_tokens = tokens_tensors
balancedness = avg_tokens / max_tokens if max_tokens > 0 else 0.0
# then average over active layers.
per_layer_mean = num_tokens_per_rank.mean(dim=1)
per_layer_max = num_tokens_per_rank.max(dim=1).values
active = per_layer_max > 0
if active.any():
balancedness = (
per_layer_mean[active] / per_layer_max[active]
).mean().item()
else:
balancedness = 0.0
avg_tokens = per_layer_mean.sum().item()
Comment thread
arpera marked this conversation as resolved.
Outdated
max_tokens = per_layer_max.sum().item()
Comment thread
arpera marked this conversation as resolved.
Outdated

if ep_group.rank() == 0:
logger.info(
Expand Down
Loading