ИИ

Сбер открыл код модели Kandinsky WM 1.0 для обучения роботов и беспилотных авто

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 3 нед назад

Сбер выложил в открытый доступ под лицензией MIT семейство моделей Kandinsky WM 1.0i — генератор обучающих видеороликов для роботов и беспилотных автомобилей. Технологию уже применяет собственный Центр робототехники Сбера и институт AIRI в своём дорожном симуляторе.

Это не полноценная нейросеть-симулятор реальности, как модели от Google и Nvidia, а инструмент для синтеза физически достоверных обучающих данных — решение критической проблемы: снимать вживую редкие и опасные сценарии (ДТП, экстремальную погоду, отказы оборудования) дорого и небезопасно.

5,3 млнвидео для обучения модели
5-секундныхблоки генерируемого видео

Полный разбор →

Карпати предложил новый бенчмарк для ИИ: превратить книгу в 3D-мир

Андрей Карпати (по данным vc.ru — «выходец из OpenAI») предложил новый способ оценивать возможности ИИ-моделей: не рисование пеликана на велосипеде в SVG, а генерацию целых интерактивных 3D-миров по литературным сюжетам. Он дал модели Opus 5i первый абзац «Властелина колец» с бюджетом в 1 млн токенов и попросил создать трёхмерную визуализацию на three.jsi.

За два часа Opus 5 написал 5500 строк кода, процедурно отрендеривших сюжет; звук для сцены сгенерировали через ElevenLabsi. Карпати считает, что старые тесты на пространственное мышление устарели — современные мультимодальные модели легко с ними справляются, а вот с генерацией целых миров по книгам и фильмам они пока справляются плохо.

ВыводГенерация сцены обошлась примерно в 10 долларов, по данным Machinelearning.

5500 строкобъём сгенерированного кода на three.js
1 млн токеновбюджет генерации
~2 часавремя генерации сцены

Полный разбор →

Книги по нейросетям в Японии

Ч@honestmarketingмедиа / агрегатор
3 нед
Если вы думали, что книги по программированию и работе с Windows остались в прошлом, то вам стоит слетать в Японию Там можно найти пособия по Claude Code, ChatGPT, Copilot, Gemini и другими актуальным нейросетям. Всё это вполне объёмные книги с иллюстрациями, которые стоят на тематических полках 🤔

Дайджест новостей ИИ: регулирование, безопасность и новые продукты

3 нед

Google против OpenAI и Anthropic: два разных пути развития ИИ

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 3 нед назад

Автор разбираемой статьи выдвигает тезис, что Google «не проиграл» гонку ИИ, а сознательно вышел из неё, выбрав другую стратегию. По его наблюдениям, OpenAI и Anthropic вышли на петлю самоулучшения (RSIi), делая ставку на грубую силу вычислений и масштабирование — по «горькому уроку» Ричарда Саттона. Те, кто первым построит топовые модели уровня 2025-2026 годов, получат «скорость убегания» (escape velocityi) и оторвутся от конкурентов настолько, что догнать их станет практически невозможно.

Google, по мнению автора, стоит в стороне от этой PR-гонки RSI и делает экзистенциальный выбор «всё или ничего» в пользу иной теории развития ИИ — world models и альтернативных архитектур вместо чистого масштабирования трансформеров.

Полный разбор →

Выпущен ускоряющий модуль ComfyUI для MiniMax H3

Н@GreenNeuralRobotsAI-инженер
3 нед
ComfyUI Spectrum MiniMax H3 Ускоряющий модуль для MiniMax H3 Прогнозирует скрытые признаки по модели Чебышева вместо полного пересчета трансформера на каждом шаге • Сохраняет нативные выходы MiniMax H3 на каждом шаге • Работает с аудио и видео одновременно • Поддерживает популярные сэмплеры: Euler и RES multistep • Совместимость с ComfyUI от 3 августа 2026, ранние версии не поддерживает • Параметры настройки: степень полинома, размер окна прогнозирования, количество шагов прогрева • Поддерживает FP16/BF16 для хранения истории #comfyui #optimization #minimaxh3

OpenAI устроила пресс-тур для инфлюенсеров и получила волну критики за «лицемерие»

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 3 нед назад

OpenAI провела свой первый brand tripi для инфлюенсеров — вывезла блогеров в загородный отель в штате Нью-Йорк (upstate New York), где прошли мастер-классы по работе с ChatGPT Worki, ужин на свежем воздухе при свечах и активности вроде сбора мёда и спорта на природе. Соцсети и СМИ раскритиковали компанию и участников поездки за лицемерие: пока OpenAI строит дата-центры, наносящие вред экологии, инфлюенсеры наслаждаются «роскошной» природой в закрытом элитном отеле.

Историю подхватили технологические и общие медиа, вышли разборные статьи без единого защитника бренда. Комментарии от компании даёт «spokespersoni», а Reddit продолжает бурно обсуждать ситуацию.

$3kстоимость номера за ночь (по данным канала)
$5000стоимость номера за ночь (по данным vc.ru)

Полный разбор →

«Яндекс» зарегистрировал отдельное юрлицо для медицинского ИИ

«Яндекс» решил всерьез заняться искусственным интеллектом в медицине и выделил это направление в отдельное юридическое лицо — «Яндекс медi». Об этом сообщают «Ведомости» и Код.ру.

Ещё в конце июня компания показала пилотную версию AI-сервиса для медицинских организаций, разработанную совместно с департаментом здравоохранения Москвы. Сервис должен автоматизировать рутинную работу врачей, но не будет ставить диагнозы или назначать лекарства.

Полный разбор →

В Евросоюзе вступили в силу правила маркировки ИИ-контента

D@droidergramавтор про «tech»
3 нед
В Евросоюзе вступили в силу правила маркировки ИИ-контента

Кейс: как сохранить четкость текста в ИИ-видео с помощью Seedance и Nano Banana

Н@GreenNeuralRobotsAI-инженер
3 нед

Презентация по квантизации нейросетей

К@quant_prune_distillAI-инженер
3 нед
Презентация про квантизацию с моего выступления на нашей Hardware Efficiency Reading Group, где мы обсуждаем темы и статьи про эффективное глубокое обучение. Записи и программу прошлых семинаров можно найти здесь.

Moonshot представила возможности Kimi Slides для создания презентаций

N@v_neuroAI-инженер
3 нед

NVIDIA представила архитектуру SANA-Video 2.0

Н@GreenNeuralRobotsAI-инженер
3 нед
SANA-Video 2.0 NVIDIA переработали архитектуру видеогенератора, гибрид линейного и softmax-внимания. Сразу скажу что весов нет. На гитхабе свежие обновки старой Саны, а по новой молчок. • генерация видео до 720p на одном GPU • высокая выразительность при линейном масштабировании • ускорение через Sol-Engine • совместимость с потребительскими GPU • версии 5B и 14B • 480p за 13.2 с (H100, 40 шагов) • VBench 84.30 • до 120x быстрее Wan 2.2-A14B Гитхаб #t2v #i2v

Автоматизация монтажа видео с помощью AI-агентов

V@ScaleAcademyAI-инженер
3 нед
Ребят, оказывается снимать youtube видео это так сложно 😅 Но я ленивый айтишник, поэтому снимая видео я сразу вам записываю видео-урок как автоматически монтировать, делать анимации и аудио эффекты с помощью агентов 😁. Занимает чуть дольше, но результат точно будет достойный (надеюсь) 😄

Методика оценки качества квантованных моделей

T@extremecodeAI-инженер
3 нед
Методика оценки качества квантованных моделей

Qwen 3.8 Max обошла Fable 5 в тесте на генерацию 3D-физики и оказалась почти в 7 раз дешевле

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 3 нед назад

Команда Atomic Chati протестировала две модели — Qwen 3.8 Max и Fable 5 — на одинаковом задании: создать три автономных HTML-файла с интерактивными 3D-сценами, требующими точной физики, сохранения состояния объектов и синхронизации во времени. Qwen 3.8 Max справилась лучше и при этом обошлась почти в 7 раз дешевле в расчёте на запуск.

По оценке авторов теста, сцены Qwen получились качественнее и стабильнее, тогда как у Fable 5 местами ломалась логика объектов. Результат подан как показательный пример резкого разрыва в эффективности между моделями при сопоставимой сложности задачи.

ВыводЗадание включало три сцены: мраморные шарики поднимаются на колесо и проходят петлю, автомобильный конвейер и лесопилка, превращающая брёвна в доски

$0,28стоимость запуска Qwen 3.8 Max
$1,93стоимость запуска Fable 5
6,9 разаво сколько раз Qwen дешевле Fable

Полный разбор →

Интерпретативный AI и утрата темпоральности мышления

Ч@skitstoriesAI-инженер
3 нед

ИИ-агенты как причина профессионального выгорания

@neyroseti_drAI-инженер
3 нед
ИИ приводит к выгоранию: это вывод психотерапевта Ника Санчеса из Кремниевой Долины, который постоянно общается с топ-менеджерами из бигтеха. Агентам и ботам проще делегировать задачи, поэтому можно вести по 4-5 проектов одновременно. Это рассеивает внимание — приходится погружаться сразу в несколько очень разных тем. Мозг к такому просто не готов. Забавно, но для борьбы с выгоранием Ник советует обращаться к ИИ. Чат-бота можно использовать как личный дневник и делиться с ним эмоциями. #интересное
ИИ-агенты как причина профессионального выгорания

Наблюдения последних недель: AGI, Китай, математика, найм и квантовые вычисления

C@chillhousetechAI-инженер
3 нед

Обновление локального исследовательского агента на базе Qwen

А@AGI_and_RLAI-инженер
3 нед
Обновление локального исследовательского агента на базе Qwen

Решение проблемы race condition в многопоточных AI-агентах

T@kryak_startupAI-инженер
3 нед
Многопоточные AI агенты против race condition или как мой агент написал скрипт ab_test_bus.py, который имитирует 20 агентов, одновременно пытающихся прочитать файл task.md, найти в нем конкретную строчку, изменить статус на [x] и сохранить файл обратно. Именно это постоянно делают агенты в Antigravity.
Решение проблемы race condition в многопоточных AI-агентах
Ещё ↓