Stability AI представила Stable-Layers — инструмент, который разбирает обычное изображение на отдельные RGBA-слоиi (фон, персонажи, предметы), пытаясь при этом восстановить то, что было скрыто за объектами на переднем плане. Это не собственная архитектура Stability, а LoRAi-надстройка поверх сторонней модели Qwen-Image-Layered 20B, дополнительно обученная методом Flow-GRPOi.
По сравнению с оригинальной Qwen-Image-Layered результат заметно чище: меньше дублирующихся слоёв, аккуратнее альфа-канал, лучше разделение объектов друг от друга.
20Bпараметров базовой модели Qwen-Image-Layered
330 МБразмер LoRA Stable-Layers
640 pxрекомендуемое разрешение обработки
- Базовая модель — Qwen-Image-Layered 20B, Stability дообучила её через метод Flow-GRPO
- Сама LoRA Stable-Layers весит около 330 МБ, но требует базовую модель Qwen-Image-Layered
- Рекомендуемое разрешение — 640 px; на более высоком разрешении качество начинает падать
- Веса и код открыты: репозиторий на HuggingFace (StabilityLabs/Stable-Layers) и GitHub (Stability-AI/Stable-Layers)
- Оригинальная Qwen-Image-Layered уже работает в ComfyUI, есть FP8 и квантованные версии для слабых GPU, что позволяет запускать Stable-Layers локально на менее мощных картах
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖