flashinfer.fused_moe.ExpertConfig¶
- class flashinfer.fused_moe.ExpertConfig(intermediate_size: int, local_expert_offset: int = 0, local_num_experts: int | None = None, num_fused_shared_experts: int = 0)¶
Expert geometry.
- Parameters:
intermediate_size (int) – Hidden dimension of the expert FFN (the N in gemm1’s MxK → MxN).
local_expert_offset (int) – Start index for expert-parallel sharding.
local_num_experts (int or None) – Number of experts on this rank.
None→num_expertsat runtime.num_fused_shared_experts (int) – Number of shared experts run for every token. Their rows follow the routed experts, so weights have
E + Srows while routing fields remain routed-only. Cross-field constraints are checked byMoEConfig.
- __init__(intermediate_size: int, local_expert_offset: int = 0, local_num_experts: int | None = None, num_fused_shared_experts: int = 0) None¶
Methods
__init__(intermediate_size[, ...])Attributes
local_expert_offsetlocal_num_expertsnum_fused_shared_expertsintermediate_size