Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed
OpenAI previewed a faster API tier for GPT-5.6 Sol, using Cerebras to reach up to 750 output tokens per second.
Excerpt
Preview Ultrafast, a new OpenAI API service tier that runs GPT-5.6 Sol up to 14× faster. Powered by Cerebras, it delivers up to 750 output tokens per second.
Read at source: https://openai.com/index/previewing-ultrafast