← к ленте

OpenAI представила собственный чип Jalapeño для инференса

D@droidergramавтор про «tech»
вчера

OpenAI анонсировала Jalapeño — свой первый специализированный чип для инференса нейросетей, разработанный с помощью ИИ и оптимизированный для работы агентов.

OpenAI стремится к независимости от производителей чипов, создавая собственное железо для ускорения работы своих нейросетей.

  • Собственные чипы позволят OpenAI снизить зависимость от NVIDIA и других поставщиков.
  • Оптимизация под инференс ускорит работу чат-ботов и ИИ-агентов для конечных пользователей.
  • Использование ИИ для проектирования чипов сокращает цикл разработки до рекордных сроков.
🔥 OpenAI сделала свой чип – разбираемся Деталь, которая тут, пожалуй, главная. Проектировать чип помогали собственные модели компании. Они перебирали варианты реализации, сокращали циклы разработки и верификации, оптимизировали схемы. От первого дизайна прошло всего девять месяцев. Чип под названием Jalapeño — первый заказной чип OpenAI, и заточен он под инференс: под ту работу, которая происходит каждый раз, когда вы что-то спрашиваете у нейросети. На пике пропускной способности — в 1,5–1,9 раза больше работы на ватт, чем у систем конкурентов. Задержка от запроса до ответа ниже в 1,7–3,6 раза. А на самых интерактивных сценариях производительность выше в 2,1–4,1 раза. Гоняли на трёх открытых моделях: GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T. Сравнивали с коммерчески доступными ускорителями по открытому бенчмарку InferenceX от SemiAnalysis. Паспортное потребление чипа 700 Вт, но по факту под нагрузкой он держался на 550 Вт и ниже. Зачем всё это? У инференса две очень разные фазы. Prefill — модель переваривает ваш промт, тут упор в чистые вычисления. Decode — она выдаёт ответ по токену, и здесь всё упирается уже в пропускную способность памяти. Обычно архитектуру затачивают под что-то одно, и вторая фаза страдает. Jalapeño пытается вытянуть обе сразу. Состояние модели держится ближе к вычислительным блокам, а сетевая часть встроена прямо в архитектуру, чтобы данные поменьше мотались между чипами. Особенно это важно для агентов: они делают много шагов подряд, и микрозадержка на каждом складывается во вполне ощутимое ожидание. Разворачивать Jalapeño в своей инфраструктуре OpenAI собирается к концу 2026 года. И это только первое поколение — второе и третье уже в разработке. @droidergram
OpenAI представила собственный чип Jalapeño для инференса

Кратко (AI)

OpenAI представила свой первый специализированный чип Jalapeño, предназначенный для ускорения инференса нейросетей. Чип был спроектирован с помощью собственных моделей компании всего за девять месяцев и показывает значительный прирост производительности и энергоэффективности по сравнению с существующими решениями. Внедрение чипа в инфраструктуру OpenAI запланировано на конец 2026 года.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖