Ожидается сокращение поставок видеокарт и рост цен во втором полугодии


NVIDIA анонсировала NVHBMi — собственную технологию базового кристалла (base-diei) HBM, которая объединяется с NVLink Fusioni для встраивания в кастомные ИИ-чипы партнёров экосистемы. Ключевое отличие от стандартного HBM4E: контроллер памяти перенесён с вычислительного кристалла в базовый кристалл памяти, что освобождает площадь на основном чипе под дополнительные вычислительные блоки.
По расчётам NVIDIA, это даёт заметный прирост производительности и энергоэффективности на уровне отдельных ускорителей и целых дата-центров, а первым партнёром по внедрению технологии станет Amazon Annapurna Labs для чипов Trainium4.



OpenAI официально анонсировала Jalapeño — свой первый специализированный чип, разработанный для ускорения инференсiа (запуска) нейросетей. Устройство создавалось в партнерстве с Broadcom при активном участии собственных ИИ-моделей компании, что позволило сократить цикл разработки от дизайна до производства до 9 месяцев.
Чип демонстрирует значительное превосходство над актуальными ускорителями NVIDIA (GB200/GB300) по энергоэффективности и скорости отклика. Развертывание Jalapeño в дата-центрах OpenAI начнется до конца 2026 года, при этом компания продолжает использовать решения NVIDIA и уже ведет разработку второго и третьего поколений собственного «железа».

Apple представила новую версию Mac minii на процессоре M6i, назвав её усовершенствованием «лучшего компактного компьютера». Однако владельцы предыдущей модели отмечают, что реального повода для апгрейда нет: несмотря на новый чип, объём оперативной памяти в базовой конфигурации остался таким же, как у Mac mini M4.
Для задач локального инференсiа нейросетей это критично — производительность процессора упирается в потолок памяти: модель либо помещается в неё целиком, либо не работает вовсе, независимо от мощности чипа.
Apple обновила линейку настольных компьютеров: Mac mini теперь доступен на чипах M6 и M5 Pro, а Mac Studio — на M5 Max и M5 Ultra. M6 стал первым чипом Apple, выпущенным по 2-нм техпроцессу. Предзаказы уже открыты, продажи стартуют 22 сентября 2026 года, устройства поставляются с macOS 27 Golden Gate и новым Siri AI.
Главный акцент новинок — локальный запуск LLM без облака: унифицированная память выросла до 512 ГБ (Mac Studio на M5 Ultra), а пропускная способность памяти достигла 1,2 ТБ/с, что позиционирует технику Apple как альтернативу связке GPU-серверов и решениям вроде Nvidia DGX Spark. Одновременно цены выросли на $100–200 по сравнению с прошлым поколением при неизменных базовых объёмах памяти и диска у части конфигураций.





Автор канала «Галера Морева» провёл целый рабочий день, прогоняя модель Qwen 3.8 27B через реальные агентские и разработческие задачи — не синтетические тесты, а боевые проекты.
По плану предполагалась эскалация мощностей: от одной RTX 2080 до пары 2080 и далее до двух RTX 3090, если слабое железо не справится. Но неожиданно все задачи решила самая базовая конфигурация — одна RTX 2080 с квантованием Q4_K_Mi.