AMD готовит флагманскую GPU на архитектуре RDNA 5


Компания Prime Intellect представила Prime Flash MoEi — специализированный fused-кернелi, предназначенный для ускорения работы моделей с архитектурой Mixture-of-Experts (MoE) на графических процессорах NVIDIA Blackwell.
Решение направлено на устранение узких мест при работе с памятью и синхронизацией потоков, что позволяет значительно повысить производительность вычислений по сравнению со стандартными методами PyTorch.
Конрад Речко (@reczko_konrad), инженер из польской компании Software Mansion, представил демо, где виртуальный источник света в кадре с веб-камеры «понимает» глубину сцены и может огибать человека, скрываясь за поднятой рукой или плечом ровно в нужный момент — без единой задержки, как настоящее освещение.
Весь пайплайн — от нейросети, вычисляющей карту глубины, до финального рендера со светом — работает целиком на GPU в браузере, без пересылки данных между CPU и GPU. Проект собрал 7.4 млн просмотров за сутки и стал ML-проектом недели по версии Data Secrets.



NVIDIA договорилась с крупнейшими инвестфондами Уолл-стрит — BlackRock, Blackstone, Goldman Sachs, Apollo и другими — о создании системы финансирования на $500 млрд для строительства ИИ-инфраструктуры. Финансисты начали рассматривать серверы с GPU как высоколиквидный залоговый актив, наравне с недвижимостью, и готовы выдавать под них крупные кредиты.
CEO NVIDIA Дженсен Хуанг объявил об этом в своём первом лонгриде в X под названием «Вычислительные мощности ИИ-фабрик становятся инвестиционным классом активов». Разработчикам ИИ и облачным сервисам больше не придётся искать собственный капитал на покупку оборудования — постройку ЦОД профинансируют фонды, зарабатывающие затем на аренде мощностей. Так NVIDIA создаёт финансовый механизм, гарантирующий устойчивый спрос на свои чипы.
NVIDIA представила открытую модель Nemotron 3.5 Lightning — решение на архитектуре MoEi (30 млрд параметров, 3 млрд активных), созданное специально для работы ИИ-агентов: рутинных задач, программирования и вызова инструментов. Модель работает в связке с более мощными моделями через систему маршрутизации.
По заявлениям NVIDIA, Nemotron 3.5 Lightning выполняет агентские сценарии до 4 раз быстрее аналогов, держит постоянную нагрузку и может запускаться как на дорогих системах DGX Spark, так и на локальных потребительских GPU уровня GeForce RTX 5090 — то есть позиционируется как экономичная альтернатива для массового использования агентов.




Китайская компания Moonshot AI выпустила Kimi K3 — MoEi-модель с 2,8 трлн общих и 104 млрд активных параметров, открытыми и бесплатно скачиваемыми весами, native vision и контекстом в 1M токенов. По заявлению авторов, это первая открытая модель 3T-класса, и по многим тестам она приблизилась к топовым закрытым американским моделям, вызвав ажиотаж в индустрии — вплоть до реакции Илона Маска, который назвал релиз «впечатляющим» и сообщил, что xAI готовит ответ на 2 трлн параметров.
Однако «бесплатность» весов не означает дешевизну использования: по официальным рекомендациям Moonshot AI для развёртывания К3 нужна конфигурация «суперузла» из 64+ ускорительных карт, с первоначальными инвестициями порядка 20 млн юаней (~$3 млн), не считая затрат на электроэнергию — что резко ограничивает круг тех, кто реально может запустить модель у себя.

Лаборатория Song Han (MIT), известного специалиста по эффективному глубокому обучению, опубликовала репозиторий со скиллом для AI-агентов, предназначенным для оптимизации кернеловi под архитектуры Hopperi и Blackwelli.
Скилл содержит набор скриптов, которые позволяют агенту самостоятельно обращаться к базам знаний, блогам, PR'ам и другим артефактам, посвящённым тензорным ядрам и архитектурным особенностям Hopper и Blackwell — то есть автоматизирует часть рутинной работы по низкоуровневой оптимизации GPU-кода.
