Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed
AI summary · glm-5.3-flash
OpenAI previews Ultrafast, an API service tier running GPT-5.6 Sol up to 14x faster via Cerebras at up to 750 output tokens per second.
OpenAI announced a preview of Ultrafast, a new API service tier that runs GPT-5.6 Sol at up to 14 times the speed of standard inference. The tier is powered by Cerebras hardware and delivers up to 750 output tokens per second. The offering targets latency-sensitive developer workloads on OpenAI's API platform.
- Ultrafast is a new OpenAI API service tier
- Runs GPT-5.6 Sol up to 14x faster
- Powered by Cerebras inference hardware
- Delivers up to 750 output tokens per second
Full article
Preview Ultrafast, a new OpenAI API service tier that runs GPT-5.6 Sol up to 14× faster. Powered by Cerebras, it delivers up to 750 output tokens per second.
This source does not provide full text. Read it at openai.com.