Not every model is in every region; TPM/RPM vary by model + region deploy region first.
Provisioned throughput reserves capacity, but burst spillover is billed.
Different model families may need separate regional deployments.
Connections
- uses GPT-5.1
- uses GPT-5.6 Luna
- part_of Large Language Model