← к ленте

Qwen представила мультимодальную модель Qwen3.8-Flash

2 дн

Qwen анонсировала модель Qwen3.8-Flash с архитектурой MoE, нативным контекстом 262K и высокой эффективностью обучения.

Новая модель Qwen предлагает высокую производительность при значительно меньших затратах на обучение и использование.

  • Снижение стоимости обучения в 9 раз по сравнению с предыдущими версиями делает разработку мощных ИИ доступнее.
  • Низкая стоимость API-доступа ($0.16/$0.47 за 1 млн токенов) позволяет компаниям эффективнее внедрять LLM в свои продукты.
  • Архитектурные инновации, такие как активация лишь 6B параметров, позволяют запускать сложные модели быстрее и с меньшими требованиями к железу.
⚡ Qwen показала Qwen3.8-Flash - мультимодальную MoE-модель и ранний превью архитектуры Qwen4. - 125B параметров + 51B N-gram embeddings - активируется всего 6B параметров на токен - нативный контекст 262K, расширение до 1M через YaRN - новая архитектура: GDN + QSA hybrid attention, Gated Residual, N-gram Embedding и Muon optimizer - обучение обошлось примерно в 9 раз дешевле Qwen3.7-Plus Бенчмарки: - DeepSWE 1.1 - 58.7 - SWE-bench Pro - 62.5 - CoWorkBench - 73.9 - AndroidWorld - 84.5 - MathVision - 95.7 Продакшен-версия появится в QwenCloud: $0.16 / 1M входных токенов $0.47 / 1M выходных токенов Также Qwen открывает веса Qwen3.8-Flash-Next - ранней версии архитектуры, которую команда исследует для Qwen4. https://github.com/QwenLM/Qwen3.8-Flash-Next/blob/main/tech_report.pdf https://huggingface.co/Qwen/Qwen3.8-Flash-Next?spm=a2ty_o06.30285417.0.0.1d73c921FsyOPe&file=Qwen3.8-Flash-Next
Qwen представила мультимодальную модель Qwen3.8-Flash

Кратко (AI)

Компания Qwen представила новую мультимодальную MoE-модель Qwen3.8-Flash, отличающуюся высокой эффективностью за счет активации лишь 6B параметров на токен. Модель поддерживает нативный контекст 262K и использует инновационные архитектурные решения, такие как GDN и Muon optimizer. Также открыты веса версии Qwen3.8-Flash-Next для изучения архитектуры будущей Qwen4.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖