bytedanceСбросить фильтр ×

DiffusionOPSD: новый метод дистилляции от Bytedance

Н@GreenNeuralRobotsAI-инженер
23 ч
DiffusionOPSD Новый метод дистилляции от Bytedance для дообучения диффузионных моделей на их же собственных генерациях: цель для каждого шага обновляется постоянно, под текущее поведение модели, а не задаётся один раз заранее • собирает запросы прямо из генераций текущей модели • строит цели с положительным и отрицательным сдвигом внутри контролируемого радиуса • обновляет поведенческую модель скользящим средним без остановки цикла обучения Выложили LoRA для Z-Image-Turbo и SD3.5-M HF Github #training #optimization VK | MAX
DiffusionOPSD: новый метод дистилляции от Bytedance

ByteDance разрабатывает AI-модель на 10 триллионов параметров

G@aiofthedayAI-инженер
1 нед

Голливудские студии договорились с ByteDance о защите авторских прав в ИИ

D@dtfbestгеймдев
1 нед
Голливудские студии достигли соглашения с ByteDance по защите интеллектуальной собственности в сервисах на основе генеративного ИИ. Сделка в том числе распространяется на Seedance и TikTok. https://dtf.ru/cinema/5245730
Голливудские студии договорились с ByteDance о защите авторских прав в ИИ

Seedream 5.0 Pro получил функцию Layer Separation

М@cgeventAI-инженер
2 нед

Китайские техгиганты ограничивают AI-компаньонов

G@aiofthedayAI-инженер
2 нед

ByteDance разрабатывает ИИ-модель с 10 трлн параметров

v@vcnewsмедиа / агрегатор
3 нед
Китайская ByteDance начала разработку ИИ-модели, «сопоставимой» с Mythos 5, — у неё будет около 10 трлн параметров, узнало FT. Модель находится на стадии предварительного обучения — обычно этот этап занимает от трёх до шести месяцев vc.ru/ai/3067803
ByteDance разрабатывает ИИ-модель с 10 трлн параметров

ByteDance представила SeedRealtime — full-duplex аудиовизуальную модель для естественного диалога

ByteDance Seed анонсировала SeedRealtimei — нативную аудиовизуальную full-duplexi-модель, которая одновременно смотрит видео, слушает пользователя и отвечает голосом без классической паузы «сначала договорите, потом отвечу». Релиз рассматривается как ответ Alibaba и её Wan Streameri — конкуренция среди мультимодальных моделей смещается от качества ответов к скорости и естественности взаимодействия, то есть к тому, «кто меньше похож на бота с задержкой».

Ключевая архитектурная особенность — единая модель для аудио, видео и текста, учитывающая временную последовательность событий, а не только отдельные кадры. Это позволяет связывать сказанное с происходящим в кадре и понимать, обращаются ли вообще к модели.

Полный разбор →

Дайджест новостей ИИ: регулирование, перестановки в Google и новые модели

3 нед

Обзор событий в мире технологий: 5 августа 2026

P@prohitecавтор про «tech»
3 нед

ByteDance выпустила Seed Audio 1.0 — модель для генерации целых звуковых сцен

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 1 мес назад

ByteDance Seed представила Seed Audio 1.0 — аудиомодель, которая по одному промпту генерирует целую звуковую сцену: речь, атмосферу и звуковые эффекты одновременно. Доступ к модели открыт через платформу BytePlusi.

Модель ориентирована на озвучку, подкасты и дубляж: она позволяет жёстко задавать тайминг репликi с точностью до 100 мс и создавать голоса как по текстовому описанию, так и по аудио- или визуальному референсу.

100 мсточность тайминга реплик
2 минутымаксимум аудио за один проход
20+ языковподдерживаемых моделью

Полный разбор →

Нейродайджест: новости ИИ за неделю

э@ai_newzAI-инженер
1 мес

Это всё на сейчас.