нейросетиСбросить фильтр ×

МикроТриллер «Эмма»: эксперимент с нейросетевым видео

М@cgeventAI-инженер
10 ч

Релиз модели SenseNova U1.5 Lite

Н@GreenNeuralRobotsAI-инженер
11 ч
SenseNova U1.5 Lite Полноценный релиз U1.5 Lite - Шесть улучшений: качество картинки, сложные инструкции, текст (англ и кит) без иероглифической каши, нативный 4K, редактирование с сохранением оригинала, точный контроль через bbox + мульти-референс Гитхаб HF Попробовать ——— Кванты SenseNova-U1.5-8B-MoT-T8-convrot для 12GB+ VRAM INT8 ConvRot 17.6 GB и гибрид W4A8 13.8 GB - работает на RTX 4070 12GB при 2048x2048 8-шаговая LoRA скорости в комплекте ComfyUI #t2i #int8 #convrot #4k #imageediting VK | MAX
Релиз модели SenseNova U1.5 Lite

Tencent представила open-source модель Hy4-preview на 770 млрд параметров

Tencent выпустила Hy4-preview — новую флагманскую open-source модель с MoEi-архитектурой, ориентированную на кодинг, агентные сценарии и рабочую продуктивность. Модель выложена под лицензией Apache 2.0 и позиционируется компанией как frontier-level решение с доступной стоимостью запуска.

По внутренним тестам Tencent, Hy4-preview немного обошла флагманы конкурентов — GLM-5.3 (Z.ai) и Kimi K3 (Moonshot), что 3DNews трактует как попытку Tencent выйти из числа отстающих в китайской ИИ-гонке и закрепиться среди лидеров рынка. Независимые проверки результатов пока не проводились.

770Bвсего параметров модели
49Bактивных параметров на токен
1 млн токеновмаксимальный контекст

Полный разбор →

AIRI выложила в открытый доступ записи летней школы «Лето с AIRI 2026»

Институт AIRIi опубликовал полный плейлист лекций и семинаров с юбилейной, пятой летней школы для молодых учёных в области искусственного интеллекта «Лето с AIRI 2026». Школа проходила две недели и завершилась 3 августа в Усть-Лабинске (Краснодарский край), а теперь все выступления доступны бесплатно любому желающему.

В плейлисте — 76 видео (по другим данным «70+»), охватывающих почти все направления современного ИИ: VLA-моделиi, автономные агенты, робототехнику, автономный транспорт, применение ИИ в медицине и науках о жизни, прогнозирование погоды и поиск новых материалов, а также вопросы безопасности, интерпретируемости и эффективности моделей.

76видео лекций и семинаров (по данным Love. Death. Transformers.)
70+докладов (по данным Machinelearning и CodeCamp)
5-япо счёту летняя школа AIRI

Полный разбор →

Обновление ComfyUI-QwenVL: оптимизация работы с видео

Н@GreenNeuralRobotsAI-инженер
13 ч
ComfyUI-QwenVL запуск Qwen-VL внутри #ComfyUI - визуальное понимание и генерация текста. Раньше при попытке скормить видео 1080p нода вылетала с OOM, теперь автоматический рассчет токенов и масштабирование кадров под контекст модели - Умное масштабирование видео: 1080p/4K автоматически поджимается под безопасный бюджет токенов — 16-32 кадра без вылета - Маленькие видео (480p) не трогает — идут в оригинале - Можно переопределить вручную через dropdown: auto, 384, 448, 512, 768, original Работает с GGUF (llama.cpp) и Transformers (Hugging Face) #vlm VK | MAX
Обновление ComfyUI-QwenVL: оптимизация работы с видео

SMACK — новая LoRA для MiniMax H3 добавляет «вес» ударам в экшен-сценах

Вышла LoRAi под названием SMACK (версия Beta 1) для видео-модели MiniMax H3 Ref2Vi, которая делает драки, столкновения и стрельбу в генерируемых роликах более физически убедительными. По словам автора, базовая модель H3 отрабатывает удары «слишком вежливо» — тела почти не реагируют на попадания, — а SMACK добавляет реальную реакцию на кулаки, оружие, автомобильные столкновения и падения, плюс более агрессивную работу камеры, похожую на съёмку каскадёрской команды, а не видео с телефона.

LoRA обучена всего на 35 клипах и не требует триггер-слова: достаточно подключить её к MiniMax H3 Ref2V, описать нужную сцену и запустить. Это заготовка для тех, кому не подошла предыдущая похожая LoRA от Omni 1.1.

35клипов в обучающем датасете LoRA
1.0рекомендуемая сила применения LoRA
0.8+сила при стекинге с другими LoRA

Полный разбор →

Google тестирует новую модель Gemini 3.8 Flash

3@ru3dnewsавтор про «tech»
14 ч
Внутри Google стартовало тестирование новой версии модели Gemini Flash Некоторые сотрудники Google уже тестируют раннюю версию ИИ-модели Gemini 3.8 Flash. Компания ускоряет выпуск обновлений и представляет новые версии почти каждые несколько недель. Так Google пытается не отстать от OpenAI и Anthropic в гонке искусственного интеллекта. #google #gemini #ии 📎Подробнее 🔖 3DNews в TG | MAX | VK
Google тестирует новую модель Gemini 3.8 Flash

Релиз Audio8 TTS Preview 0.1B

Н@GreenNeuralRobotsAI-инженер
17 ч
Audio8 TTS Preview 0.1B ONNX INT8 Компактная многоязычная говорилка с клонированием голоса по одному примеру. Работает на CPU без видеокарты. • RAM около 0.6 ГБ при загрузке основных сессий • звук на выходе 44,1 кгц, моно • скорость около 19 мс на токен медленной части и 8 мс на кадр быстрой 11 языков из коробки: китайский, кантонский, английский, французский, немецкий, итальянский, японский, корейский, польский, испанский, нидерландский Гитхаб HF #tts #voicecloning #compact VK | MAX
Релиз Audio8 TTS Preview 0.1B

Алиса AI научилась распознавать рукописный текст, даже когда буквы слились в закорючки

Яндекс представил обновление голосового помощника Алиса AIi: теперь он умеет распознавать рукописный текст с фотографий — от студенческих конспектов до врачебных рецептов. Возможность появилась благодаря новой VLM-модели (vision-language model, модель, объединяющая распознавание изображений и текста).

Чтобы продемонстрировать возможности технологии, в Москве появились плакаты, на которых буквы «И», «ш», «л» и «м» написаны физически одинаково и слипаются в сплошную волну — различить их человеку можно только по смыслу фразы. Алиса AI при этом выдаёт с фото корректно распознанный текст даже на такой слитной скорописи.

Полный разбор →

Google выпустила продакшен-версию видеомодели Gemini Omni 1.1 Flash

Google представила Gemini Omni 1.1 Flash — обновленную мультимодальную модель для генерации и редактирования видео, которая перешла из стадии предварительного просмотра в полноценный продакшен-релиз. Инструмент получил расширенные возможности управления контентом, включая функции монтажа и оптимизированные режимы рендеринга.

Обновление ориентировано на профессиональное использование: модель позволяет создавать более длинные и детализированные видеоролики с улучшенным контролем над ключевыми кадрами. Доступ к функционалу открыт через Google AI Studio для разработчиков и платформу Google Flowi для пользователей.

40 секундмаксимальная длительность видео
60%ускорение генерации черновиков
$0,10стоимость секунды видео в 720p

Полный разбор →

Подборка инструментов и ресурсов для MiniMax-H3

Н@GreenNeuralRobotsAI-инженер
18 ч
Подборка инструментов и ресурсов для MiniMax-H3

Выпуск подкаста «на Вайбе»: обзор новостей ИИ

А@itbeardавтор про «it»
18 ч

VK перешли на нейросетевой ранкер ленты рекомендаций

D@data_secretsAI-инженер
18 ч
VK перешли на нейросетевой ранкер ленты рекомендаций

Учёные реконструировали звук юрского леса по окаменевшим крыльям кузнечиков

Международная команда учёных восстановила, как звучал лес в середине юрского периода, примерно 165 миллионов лет назад. Для этого использовали 20 окаменевших крыльев девяти видов родственников современных кузнечиков и сверчков, найденных во Внутренней Монголии.

Важность открытия в том, что стрекотi насекомых — чисто механический процесс: одно крыло несёт гребёнку из микроскопических зубцов, второе — скребок, и при трении рождается звук. Такая структура окаменевает, а значит частота сигнала буквально «записана» в геометрии крыла и может быть измерена спустя миллионы лет.

ВыводУчёные измерили зубцы на всех 20 крыльях и загрузили данные в компьютерные модели вместе с информацией о живых насекомых и схемой родства видов — так восстановили частоту и базовую структуру каждого сигнала

165 миллионов летвозраст ископаемых крыльев
20число исследованных окаменевших крыльев
9 видовколичество изученных видов насекомых

Полный разбор →

Релиз модели генерации изображений Fibo 1.5 от Bria AI

Н@GreenNeuralRobotsAI-инженер
20 ч
Fibo 1.5 (Bria AI) Дистиллированная версия картинкогенератора FIBO 4-6 шагов вместо 50, без CFG, с улучшенным реализмом и текстурами. Дистилляция DMD + DMD-R поверх оригинального FIBO. При этом сохраняет JSON-native структурированный промптинг Fibo-Edit-1.5-base - редактирующая с мультиреференсом Есть турбоверсия HF - полный зоопарк ИИ-скилл #imageediting #json2image #skill VK | MAX
Релиз модели генерации изображений Fibo 1.5 от Bria AI

Тест самообучаемой модели Ornith 1.5 9B

Г@gmorevaAI-инженер
20 ч
Видео про Ornith 1.5 9B Меня давно просили протестировать Ornith. Вот вышла версия 1.5 от DeepReinforce, которую называют «самообучаемой»: при RL-обучении модель сама генерирует себе задачи, скаффолды и роллауты, без фиксированных человеческих датасетов. Разбираюсь, что это значит на практике, и гоняю плотную 9B-версию в реальных задачах. Спойлер: я не ожидал такого от 9 миллиардов параметров. Ссылки на видео на всех площадках: 📹 YouTube | VK | Rutube | Dzen 📹

Почему делегирование текстов ИИ вредит мышлению: мнение Брета Стивенса

Т@yumaksавтор про «marketing»
20 ч
Почему делегирование текстов ИИ вредит мышлению: мнение Брета Стивенса

Подборка инструментов и обновлений для MiniMax H3

Н@GreenNeuralRobotsAI-инженер
22 ч
Ещё ↓