Dense models use every parameter on every token; MoE models wake only a few experts, aiming for more capacity per watt.
Open and closed labs both ship MoE variants; comparing them requires knowing active parameters, not just total parameters on a slide.
When Latent covers model cards and leaks, MoE routing details often explain why two “similar-sized” models feel different in production.