ZeroHour
OpenAI Newspublished ()ingested

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed

infoAI tools & infraimportance 45
AI summary · glm-5.3-flash

OpenAI previews Ultrafast, an API service tier running GPT-5.6 Sol up to 14x faster via Cerebras at up to 750 output tokens per second.

OpenAI announced a preview of Ultrafast, a new API service tier that runs GPT-5.6 Sol at up to 14 times the speed of standard inference. The tier is powered by Cerebras hardware and delivers up to 750 output tokens per second. The offering targets latency-sensitive developer workloads on OpenAI's API platform.

  • Ultrafast is a new OpenAI API service tier
  • Runs GPT-5.6 Sol up to 14x faster
  • Powered by Cerebras inference hardware
  • Delivers up to 750 output tokens per second
Full article

Preview Ultrafast, a new OpenAI API service tier that runs GPT-5.6 Sol up to 14× faster. Powered by Cerebras, it delivers up to 750 output tokens per second.

This source does not provide full text. Read it at openai.com.