videoСбросить фильтр ×

Обновление ComfyUI-QwenVL: оптимизация работы с видео

Н@GreenNeuralRobotsAI-инженер
18 ч
ComfyUI-QwenVL запуск Qwen-VL внутри #ComfyUI - визуальное понимание и генерация текста. Раньше при попытке скормить видео 1080p нода вылетала с OOM, теперь автоматический рассчет токенов и масштабирование кадров под контекст модели - Умное масштабирование видео: 1080p/4K автоматически поджимается под безопасный бюджет токенов — 16-32 кадра без вылета - Маленькие видео (480p) не трогает — идут в оригинале - Можно переопределить вручную через dropdown: auto, 384, 448, 512, 768, original Работает с GGUF (llama.cpp) и Transformers (Hugging Face) #vlm VK | MAX
Обновление ComfyUI-QwenVL: оптимизация работы с видео

Rockstar выложила исходный файл презентации GTA VI

B@biggeekавтор про «tech»
вчера
Rockstar выложила презентацию GTA VI в открытый доступ Если вы ещё не устали от новостей про GTA VI в каждом сообществе и на каждом канале, или вдруг пропустили ночной показ на Netflix и YouTube, то теперь вы можете скачать полную игровую презентацию с сайта Rockstar без ограничений. Видео на 14 гигабайт без сжатия и артефактов в максимальном качестве доступно по ссылке: https://www.rockstargames.com/VI/media/videos
Rockstar выложила исходный файл презентации GTA VI

Перемонтированная версия видео о походе в ЦОД

P@prohitecавтор про «tech»
вчера
Вы могли уже видеть этот шедевральный фильм о походе в ЦОД. Но, к моему большому сожалению, в нынешних обстоятельствах видео потребовали удалить. Я договорился, что видео можно будет оставить, если вырезать некоторые фрагменты, поэтому я его немного перемонтировал. И желаю вам приятного просмотра! https://youtu.be/pbJNy49SNBs

Гайд по созданию анимаций для продукта и рекламы

S@saasstuffмедиа / агрегатор
2 дн
Гайд как делать анимации для рекламы, туториалов для онбординга и лекций Записал гайд, если у вас нет лишнего бюджета или аниматора, как сделать онбординги и прочие вкусные анимации в продукт https://www.youtube.com/watch?v=oWbUL_TZm_4

Анонс видеоверсии со слайдами и сессии Office Hours

К@Katerinalengoldкарьера / HR
3 дн
🎥 Сделали еще видеоверсию со слайдами. Посмотреть можно тут. Если останутся вопросы – присылайте их здесь в комментариях. Буду разбирать их завтра (26 августа) в 9:00 по Калифорнии / 18:00 СET / 19:00 MSK на Office Hours в Зуме. Ссылку на подключение как обычно пришлю прямо сюда в канал.
Анонс видеоверсии со слайдами и сессии Office Hours

InfinityEdit: инструмент для бесконечного редактирования видео

Н@GreenNeuralRobotsAI-инженер
4 дн
InfinityEdit Инструмент для бесконечного редактирования видео по текстовым командам, который не заканчивается, от Zhejiang University + Alibaba Group. Видео продолжает генерироваться, а команды накладываются на живой поток одна за другой - Правки по текстовым инструкциям - Поток не обрывается: каждая новая правка продолжает уже измененное видео, а не переписывает его заново - Генерация длинного видео с накоплением правок без потери качества - Работает поверх готового видеогенератора, сам инструмент легкий Замороженный бэкбоун - Helios-Distilled Гитхаб #streaming #videoediting VK | MAX

Runway представил модель Ruby для конвертации SDR в HDR

М@cgeventAI-инженер
4 дн

Black Forest Labs выпустила FLUX Video Upscale — генеративный апскейлер видео до 4K

Black Forest Labs (BFL) представила FLUX Video Upscale — отдельную модель для увеличения разрешения видео до 1080p, 2K и 4K. В отличие от классических апскейлеров типа ESRGAN или Topaz (масштабирование + шарпен) и покадровых решений вроде Magnifici, это полноценная генеративная видеомодель на базе FLUX 3i, которая перегенерирует детали и исправляет типичные артефакты AI-видео: размазанные лица, глаза, «плывущие» текстуры воды и травы.

Модель лучше всего работает с видео, сгенерированным самой FLUX 3, поскольку «знает» её внутреннее распределение, но принимает на вход любое видео начиная от 480p. Доступна прямо сейчас в BFL Playground без кода и через API для разработчиков.

1.5x–3xкоэффициент апскейла видео
20 секундмаксимальная длина входного видео
$0.07 / $0.10цена за мегапиксель-секунду (Precise/Creative)

Полный разбор →

Китайский энтузиаст создал реалистичный ролик по Red Alert 2 с помощью ИИ

@neyroseti_drAI-инженер
5 дн

MaskVidExperiments: набор инструментов для работы с масками в ComfyUI

Н@GreenNeuralRobotsAI-инженер
5 дн

Трейлер фанатского проекта по мотивам «Трудно быть богом»

И@brainshareмедиа / агрегатор
6 дн
Зачем-то "Трудно быть богом" Стругацких поместили в сеттинг Дюны, хотя выглядит все равно хорошо. https://youtu.be/aNoTb-WOFJs Мне максимально не понравилась экранизация Германа 2013 года, но то что в новом сериале тоже есть Ярмольник - по-моему круто.

Frame Extractor: инструмент для отбора кадров из видео для 3D-реконструкции

Н@GreenNeuralRobotsAI-инженер
1 нед
Frame Extractor Умный извлекатель качественных кадров из видео для SfM-пайплайнов - COLMAP, 3DGS и т п. Не выкачивает каждый кадр подряд а выбирает только те что нужны для реконструкции. #gaussian #nerf #tools VK | MAX
Frame Extractor: инструмент для отбора кадров из видео для 3D-реконструкции

Словарь ИИ-режиссера: гид по операторским движениям для промптов

Н@neuronutsAI-инженер
1 нед
Долго готовил этот материал. Но кто, если не я. Словарь ИИ-режиссера. Полный гид по операторским движениям: как называется каждое движение камеры по-английски для использования в промптах нейросетей, и что оно означает по-русски. Читать по этой ссылке.
Словарь ИИ-режиссера: гид по операторским движениям для промптов

Музыкальное видео-эксперимент: брейк-данс в средневековом сеттинге

М@cgeventAI-инженер
1 нед

Выпуск LoRA-моделей LTX 2.5 для улучшения видео и изображений

Н@GreenNeuralRobotsAI-инженер
1 нед
LTX 2.5 - CQ Video and Image Enhancer LoRAs Две лоры #LTX25 улучшайзеры-апскейлеры картинок и видео спасибо @m_franz #lora #upsacale #enhance #imagerestoratoipn #videorestoration VK | MAX

Topaz выпустил модель Hyperion 2.5 для SDR-to-HDR апскейлинга

М@cgeventAI-инженер
1 нед

Reddit тестирует ИИ-генерацию коротких видео и озвучку постов

Reddit начал тестировать новые функции: автоматическую генерацию коротких вертикальных видео на основе текстовых постов и озвучку публикаций с помощью ИИ. Пользователи получают выбор — читать пост в привычном текстовом формате или посмотреть/прослушать его версию, при этом сама текстовая форма никуда не исчезает.

Причина нововведения — сторонние авторы уже давно нарезают контент Reddit в короткие ролики для TikTok и Reels и собирают на этом миллионы просмотров; платформа решила забрать этот формат себе. Часть пользователей раскритиковала изменения, опасаясь, что Reddit превратится в «ещё один» TikTok.

Полный разбор →

Приложение Divine с короткими видео стало доступно всем пользователям

v@vcnewsмедиа / агрегатор
1 нед
Приложение Divine, среди инвесторов которого сооснователь Twitter Джек Дорси, стало доступно всем пользователям. Сервис вдохновлён закрытым в 2016 году Vine с шестисекундными роликами — в него перенесли более 2 млн архивных видео. В Divine запрещён ИИ-контент, а его цель — «дать людям свободу творить друг для друга, а не для алгоритма» vc.ru/services/3085875
Приложение Divine с короткими видео стало доступно всем пользователям

YouTube изменит подсчёт просмотров: теперь с первого кадра

С 24 августа YouTube переходит на новую систему подсчёта просмотров для видео любых форматов — просмотр будет засчитываться с самого первого кадра, а не после того, как пользователь досмотрел ролик до определённого порога. Такой метод уже действует для формата Shortsi, а также используется в Instagram и TikTok.

Изменение не затронет монетизацию и условия участия в партнёрской программе YouTube (YouTube Partner Program), но приведёт к резкому росту счётчиков просмотров у всех видео на платформе.

24 августадата запуска новой системы подсчёта
30 секундпредполагаемый прежний порог засчитывания просмотра

Полный разбор →

Ещё ↓