“Techniques to improve AI model quality by scaling up inference compute could make a single request 50 to 1,000 times more computationally intensive.”