Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed

OpenAI Blog ·

OpenAI previewed a faster API tier for GPT-5.6 Sol, using Cerebras to reach up to 750 output tokens per second.

Categories: Model Releases

Excerpt

Preview Ultrafast, a new OpenAI API service tier that runs GPT-5.6 Sol up to 14× faster. Powered by Cerebras, it delivers up to 750 output tokens per second.