“The Qwen 3 Next model is an 80 billion parameter MoE model that activates 3 billion parameters per token and was trained on over 10 trillion tokens.”