“Qwen-3 includes a 235 billion parameter Mixture-of-Experts (MoE) model that activates 22 billion parameters during inference.”