OpenAI открыла превью-доступ к режиму Ultrafast для флагманской модели GPT-5.6 Sol: за счёт аппаратного ускорения на чипах Cerebrasi модель генерирует до 750 токенов в секунду — примерно в 14 раз быстрее обычного API. Сама модель не стала «умнее», меняется только скорость выдачи, но для длинных ответов и агентных задач это критично.
Пока режим доступен лишь ограниченному числу клиентов API в режиме превью, цена и сроки массового запуска не раскрыты — OpenAI обещает расширять доступ по мере наращивания вычислительных мощностей.