deep-learningСбросить фильтр ×

Explorative Modeling: новый подход к обучению генеративных моделей

Б@boris_againAI-инженер
1 нед

Родословная Джеффри Хинтона

K@kantor_aiмедиа / агрегатор
2 нед

Обзор фреймворка Humming от InclusionAI

К@quant_prune_distillAI-инженер
1 мес

Самые сложные темы в изучении Deep Learning и LLM

Т@tech_priestessAI-инженер
1 мес
А поделитесь, какая тема была для вас самой сложной при изучении глубокого обучения и особенно LLM/VLM/etc? В чем оказалось сложнее всего разобраться?

Эволюция алгоритмов FlashAttention: от Hopper до Blackwell

D@deep_schoolAI-инженер
1 мес

Лилиан Вэн опубликовала обзор истории и развития scaling laws

e@epsiloncorrectAI-инженер
1 мес

Представлен инструмент FaceAnything для реконструкции лиц по видео

Исследователи из Huawei и Мюнхенского университета анонсировали проект FaceAnything, предназначенный для 4D-реконструкции лиц на основе обычных видеозаписей. Технология использует совместное предсказание глубины и канонических координат, что позволяет извлекать облака точек без применения специализированного оборудования. Несмотря на наличие артефактов, ограничивающих точность 3D-моделирования, инструмент может быть эффективно использован для создания визуальных эффектов в композе.

NVIDIA представила Fast-FoundationStereo для оценки глубины

Н@GreenNeuralRobotsAI-инженер
1 мес
Fast-FoundationStereo Стереомодель от NVIDIA. Считает диспаритет по паре фото — строит карту глубины. • гибридная архитектура: трансформеры + CNN • 14.6 млн параметров • zero-shot, без донастройки • работает в реальном времени Дистиллирована из FoundationStereo, бэкбон — EdgeNeXt. Лицензия — nvidia-open-model-agreement. Оптимизирована под GPU NVIDIA. Гитхаб HF #video2depth #stereo2depth

Подкаст об исследовательском мышлении в AI с Татьяной Гайнцевой

K@kantor_aiмедиа / агрегатор
2 мес

MuonMD: новый метод нормализации весов для оптимизации нейросетей

К@quant_prune_distillAI-инженер
2 мес

Это всё на сейчас.