cerebrasСбросить фильтр ×

Cerebras представила CS-4 — первую по-настоящему стоечную систему на разогнанных чипах WSE-3 Turbo

Cerebras Systems анонсировала CS-4 — стоечную ИИ-систему, в основе которой три процессора WSE-3 Turboi (WSE-3T). Несмотря на название, это не новый чип: тот же кристалл WSE-3 двухлетней давности (5 нм TSMC, 4 трлн транзисторов, 900 тыс. ядер), но с частотой, поднятой с 1,4 до 2,8 ГГц, что удвоило пропускную способность памяти и производительность в FLOP/s.

Главная новизна — не кремний, а «коробка» вокруг него: CS-4 стала первой настоящей rack-scale системой Cerebras (предыдущий «CS-3 Rack» был просто двумя независимыми CS-3 в одной стойке без объединения вычислений). Новая платформа Nexusi рассчитана на несколько будущих поколений чипов, включая CS-5 и CS-6, и должна снизить стоимость эксплуатации ИИ-дата-центров, где электричество становится главным ограничением масштабирования.

750 PFLOPSпроизводительность всей стойки CS-4
44 ГБпамять SRAM на один чип WSE-3T
1000+ токенов/сскорость для моделей на 10 трлн параметров

Полный разбор →

OpenAI запустила Ultrafast mode для GPT-5.6 Sol — ускорение в 14 раз на чипах Cerebras

OpenAI открыла превью-доступ к режиму Ultrafast для флагманской модели GPT-5.6 Sol: за счёт аппаратного ускорения на чипах Cerebrasi модель генерирует до 750 токенов в секунду — примерно в 14 раз быстрее обычного API. Сама модель не стала «умнее», меняется только скорость выдачи, но для длинных ответов и агентных задач это критично.

Пока режим доступен лишь ограниченному числу клиентов API в режиме превью, цена и сроки массового запуска не раскрыты — OpenAI обещает расширять доступ по мере наращивания вычислительных мощностей.

750 токенов/секскорость генерации в Ultrafast mode
14 разускорение по сравнению с обычным API
11 минут против 80время прогона HLE у Sol и Claude Fable

Полный разбор →

AMD и Cerebras объединяют усилия для ускорения AI-инференса

Б@blognotAI-инженер
1 мес

Слухи о запуске GPT-5.6 и интеграции с Cerebras

F@FuturisAI-инженер
1 мес
сегодня в интернетах все ждут подключение GPT-5.6 к cerebras со скоростью до 750 токенов/с, что ускорит его в 5 раз без потери качества (openai анонсировали как раз на конец июля) ну и сброс лимитов за одно🌚

Gemma 4 31B и gpt-oss-120B на чипах Cerebras вышли на фронтир скорости LLM-бенчмарка

Автор канала @llm_under_hood (по совету @AigizK) протестировал модель Gemma 4 31B, запущенную на специализированных чипах Cerebrasi, на агентском бенчмарке под бизнес-задачи. С выключенным reasoning (он тормозит и спотыкается о structured outputs) модель сдвинула фронтир скорости бенчмарка и оказалась совсем рядом с GPT-5.4 mini по качеству и цене — при этом её, в отличие от закрытой GPT-5.4 mini, можно скачать и запускать локально.

Через два дня выяснилось, что эффект не ограничивается одной моделью: запуск gpt-oss-120B на том же железе Cerebras во всех трёх режимах reasoning (high, medium, low) тоже выводит её на speed frontier, а medium-режим дополнительно попадает на cost-фронтир по эффективности. Вывод автора — дело не столько в конкретной модели, сколько в самом железе Cerebras, которое команды уже используют для near-realtime AI-решений.

ВыводCerebras выпускает wafer-scale engines — чипы, которые примерно в 50 раз крупнее самых больших GPU, что делает железо дорогим и специализированным, но позволяет запускать небольшие модели на очень высоких скоростях

31Bразмер параметров Gemma 4
120Bразмер параметров gpt-oss
50во сколько раз чип Cerebras крупнее GPU

Полный разбор →

Демонстрация работы computer use в Blender

F@FuturisAI-инженер
1 мес
а вот так в реальной скорости будет выглядеть computer use в июле когда openai начнут гонять gpt на cerebras🌈 Если что на видео нейронка подключилась к blender и создаёт корабельную пушку, жаль весь корабль не доделала (надеюсь не упёрлась в лимиты🌚)

GPT-5.6 Sol появится в Codex и на чипах Cerebras

D@data_secretsAI-инженер
1 мес

Это всё на сейчас.