← к умной ленте

OpenAI запустила Ultrafast mode для GPT-5.6 Sol — ускорение в 14 раз на чипах Cerebras

OpenAI открыла превью-доступ к режиму Ultrafast для флагманской модели GPT-5.6 Sol: за счёт аппаратного ускорения на чипах Cerebrasi модель генерирует до 750 токенов в секунду — примерно в 14 раз быстрее обычного API. Сама модель не стала «умнее», меняется только скорость выдачи, но для длинных ответов и агентных задач это критично.

Пока режим доступен лишь ограниченному числу клиентов API в режиме превью, цена и сроки массового запуска не раскрыты — OpenAI обещает расширять доступ по мере наращивания вычислительных мощностей.

750 токенов/секскорость генерации в Ultrafast mode
14 разускорение по сравнению с обычным API
11 минут против 80время прогона HLE у Sol и Claude Fable
  • Ускорение достигается за счёт архитектуры Wafer-Scale Engine от Cerebras: веса модели хранятся прямо на огромных чипах, что убирает необходимость гонять их между памятью и хранилищем
  • Режим ориентирован на задачи, где важна каждая миллисекунда: разбор системных сбоев, быстрая финансовая аналитика, поддержка клиентов в реальном времени
  • В демонстрационном прогоне бенчмарка HLEi GPT-5.6 Sol в режиме Ultrafast прошла весь тест за чуть больше 11 минут, тогда как модель Claude Fable на том же бенчмарке потратила почти 80 минут
  • Официальный анонс опубликован OpenAI по адресу openai.com/index/previewing-ultrafast/
  • Доступ будет расширяться по мере ввода новых вычислительных мощностей, обычным пользователям режим пока не открыт
Что дальше

OpenAI обещает постепенно расширять список клиентов с доступом к Ultrafast modei по мере наращивания мощностей Cerebras; цена и сроки открытия для широкой аудитории пока не объявлены.

Это произошло: Cerebras представила CS-4 — новую систему ускорения ИИ на чипах WSE-3 Turbo →

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖