Tencent показала Hunyuan3D-Buffalo 1.0 — экспериментальное развитие своей линейки Hunyuan3D. В отличие от обычной генерации 3D по картинке или тексту, Buffalo умеет понимать структуру объекта: отвечать на вопросы о нём, находить отдельные детали по текстовому описанию, удалять или заменять их, а также генерировать геометрию прямо из текста — всё в одном пайплайне, без отдельных моделей под каждую задачу.
Главный акцент разработки не на красоте image-to-3Di генерации, а на осмысленном редактировании и работе с частями модели — то есть система сначала «понимает», где у объекта крылья, колёса или другие детали, а затем может что-то с ними сделать по команде.
ВыводВ основе системы лежит генератор Hunyuan3D-2.1, к которому добавили 3D-VLM (визуально-языковую модель), работающую как «мозг» системы