flashinfer.comm.moe_a2a_sanitize_expert_ids¶
- flashinfer.comm.moe_a2a_sanitize_expert_ids(expert_ids: Tensor, workspace: Tensor, metainfo: Tensor, ep_rank: int, invalid_expert_id: int, enable_pdl: bool | None = None)¶
Sanitize invalid slots that contain no token routed to this rank by setting their expert IDs to
invalid_expert_id.- Parameters:
expert_ids (torch.Tensor) –
[local_num_tokens, top_k]int32tensor of expert assignments (mutated in place).workspace (torch.Tensor) – Shared workspace tensor.
metainfo (torch.Tensor) – Metainfo tensor returned by
moe_a2a_initialize().ep_rank (int) – Current expert-parallel rank.
invalid_expert_id (int) – Value to write into slots that received no token (per
recv_counters, e.g. padding beyond a source rank’s valid count).enable_pdl (Optional[bool]) – Whether to use programmatic dependent launch.
Noneauto-detects from the device.