OpenAI открыла превью-доступ к режиму Ultrafast для флагманской модели GPT-5.6 Sol: за счёт аппаратного ускорения на чипах Cerebrasi модель генерирует до 750 токенов в секунду — примерно в 14 раз быстрее обычного API. Сама модель не стала «умнее», меняется только скорость выдачи, но для длинных ответов и агентных задач это критично.
Пока режим доступен лишь ограниченному числу клиентов API в режиме превью, цена и сроки массового запуска не раскрыты — OpenAI обещает расширять доступ по мере наращивания вычислительных мощностей.
750 токенов/секскорость генерации в Ultrafast mode
14 разускорение по сравнению с обычным API
11 минут против 80время прогона HLE у Sol и Claude Fable
- Ускорение достигается за счёт архитектуры Wafer-Scale Engine от Cerebras: веса модели хранятся прямо на огромных чипах, что убирает необходимость гонять их между памятью и хранилищем
- Режим ориентирован на задачи, где важна каждая миллисекунда: разбор системных сбоев, быстрая финансовая аналитика, поддержка клиентов в реальном времени
- В демонстрационном прогоне бенчмарка HLEi GPT-5.6 Sol в режиме Ultrafast прошла весь тест за чуть больше 11 минут, тогда как модель Claude Fable на том же бенчмарке потратила почти 80 минут
- Официальный анонс опубликован OpenAI по адресу openai.com/index/previewing-ultrafast/
- Доступ будет расширяться по мере ввода новых вычислительных мощностей, обычным пользователям режим пока не открыт
OpenAI обещает постепенно расширять список клиентов с доступом к Ultrafast modei по мере наращивания мощностей Cerebras; цена и сроки открытия для широкой аудитории пока не объявлены.
Это произошло: Cerebras представила CS-4 — новую систему ускорения ИИ на чипах WSE-3 Turbo →
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖