Model Serving & Economics
Cost per million tokens
A common pricing unit for language-model API usage.
Example
A provider lists a price for processing one million input or output tokens.
Why people use it
Teams use “Cost per million tokens” when they need to balance model quality, reliability, speed, and cost.
What you'll hear
“How does Cost per million tokens affect latency, quality, or cost at scale?”