llmСбросить фильтр ×

Новые правила промпт-инжиниринга для современных моделей

A@ai_productAI-инженер
16 ч
Новые правила промпт-инжиниринга для современных моделей

Alibaba открыла веса Qwen3.8-Flash-Next — превью архитектуры Qwen4

Alibaba выпустила Qwen3.8-Flash-Next — мультимодальную модель с открытыми весами, которая служит ранним предпросмотром архитектуры будущего Qwen4. Модель понимает текст, изображения и видео, при 125 млрд основных параметров активирует лишь 6 млрд на токен, а контекст доведён до 262 144 токенов нативно и почти до 1M через YaRNi.

По словам источников, обучение обошлось примерно в 9 раз дешевле, чем у Qwen3.7-Plus, при этом новая модель обгоняет и Qwen3.7-Plus, и DeepSeek-V4-Flash по большинству бенчмарков — особенно в программировании и офисных задачах. Схема повторяет ход Alibaba с Qwen3-Next перед релизом Qwen3.5: сначала показывают архитектурные новшества, потом строят на них весь модельный ряд.

125Bосновных параметров модели
6Bактивных параметров на токен
51Bпараметров в n-gram embeddings

Полный разбор →

Z.ai открыла веса GLM-5.3 — модели для агентного кодинга и киберзащиты

Китайская компания Z.ai опубликовала на HuggingFace полные веса модели GLM-5.3, которую сама называет «самой способной» своей моделью для агентного программирования (agentic codingi) и оборонительной кибербезопасности. Модель вышла в середине августа 2026 года, а веса довезли только сейчас — после отдельной оценки безопасности.

Это не API-доступ, а полноценный релиз весов: разработчики и исследователи могут скачать GLM-5.3, запускать её локально, дообучать и кастомизировать под свои задачи, разбирая модель глубже, чем позволяет обычный доступ через API.

743 млрдпараметров в модели GLM-5.3

Полный разбор →

IBM представила открытые модели Granite 4.2 и Granite Speech 5.0

11 ч
IBM представила открытые модели Granite 4.2 и Granite Speech 5.0

Tencent представила open-source модель Hy4-preview на 770 млрд параметров

Tencent выпустила Hy4-preview — новую флагманскую open-source модель с MoEi-архитектурой, ориентированную на кодинг, агентные сценарии и рабочую продуктивность. Модель выложена под лицензией Apache 2.0 и позиционируется компанией как frontier-level решение с доступной стоимостью запуска.

По внутренним тестам Tencent, Hy4-preview немного обошла флагманы конкурентов — GLM-5.3 (Z.ai) и Kimi K3 (Moonshot), что 3DNews трактует как попытку Tencent выйти из числа отстающих в китайской ИИ-гонке и закрепиться среди лидеров рынка. Независимые проверки результатов пока не проводились.

770Bвсего параметров модели
49Bактивных параметров на токен
1 млн токеновмаксимальный контекст

Полный разбор →

Загадочная модель Ox Alpha оказалась GLM-5.3-Flash от китайской Z.ai

AI-редакция
30 источников · показать все· свернуть
FuturisРелиз анонимной мультимодальной ИИ-модели Ox AlphaMachine learning InterviewЗагадочная модель Ox Alpha появилась в OpenCodevc.ruНа OpenRouter появилась модель Ox AlphaData SecretsНа OpenRouter появилась анонимная модель Ox AlphaМетаверсище и ИИщеНа OpenRouter появилась бесплатная модель Ox AlphaНейронавт | Нейросети в творчествеМультимодальная модель Ox Alpha доступна в OpenRouterPRO Hi-TechТаинственная модель Ox Alpha: характеристики и предположения о происхожденииGPT/ChatGPT/AI Central Александра ГорногоЗагадочная модель Ox Alpha появилась на OpenRouterХайтек+Загадочная ИИ-модель Ox Alpha показала рекордные результаты в тестахБлоGнотZ.AI подтвердила, что анонимная модель Ox Alpha — это их разработкаMachinelearningАнонимная модель Ox Alpha оказалась новой версией GLM от Zaivc.ruКитайская компания Z.ai представила модель Ox AlphaМетаверсище и ИИщеZ.ai подтвердила, что Ox Alpha — это новая модель семейства GLMCodeCampZ.ai выпустили модель GLM-5.3 FlashMachinelearningВыход мультимодальной модели GLM-5.3-FlashMachine learning InterviewВыход мультимодальной модели GLM-5.3-FlashСвята место пусто не бываетOx Alpha оказалась моделью GLMFuturisРелиз моделей GLM-5.3 и GLM-5.3-FlashCyberYozhВыход модели GLM-5.3 Flash и её влияние на AI SecurityNEURO-AI Новости ИИZ.ai представила мультимодальную модель GLM-5.3-FlashНейронавт | Нейросети в творчествеРелиз мультимодальной модели GLM-5.3-Flashэйай ньюзOx Alpha представила мультимодальную модель GLM 5.3 FlashLove. Death. Transformers.Релиз модели GLM-5.3-Flash на Hugging FaceAI Product | Igor AkimovZ.ai представила мультимодальную модель GLM-5.3-Flashvc.ruZ.ai представила мультимодальную модель GLM-5.3-FlashтехноданяМодель ox-alpha оказалась GLM-5.3-Flash️Нейросети: Волшебство ИИ, IT ️и маркетинг⚡️Релиз модели GLM-5.3 FlashData SecretsОфициальный релиз модели GLM-5.3-FlashGPT/ChatGPT/AI Central Александра ГорногоВыход модели GLM-5.3 Flash от Ox AlphaХайтек+Загадочная модель Ox Alpha переименована в GLM-5.3-Flash
мега-хайп · 30обновлено вчера

20 августа на OpenRouter и в OpenCode бесплатно и анонимно появилась мощная мультимодальная ИИ-модель Ox Alpha с контекстом на 1 млн токенов, заточенная под кодинг и агентные задачи. На небольшом прогоне из 10 задач DeepSWEi она набрала около 80% против 65% у Claude Fable 5 и 52% у GPT‑5.6 Sol, а в тесте с монтажом видео совпала с Opus 5 High на 90–97%, работая примерно в семь раз быстрее — при этом выборки были маленькими, и официального полного бенчмарка не было.

26 августа интрига разрешилась: китайская компания Z.ai (бывшая Zhipu AI) подтвердила Bloomberg, что за псевдонимом стояла её новая модель, которая тогда же получила официальное имя GLM-5.3-Flash. За несколько дней бесплатного доступа модель вышла на первое место по использованию на OpenRouter, более чем вдвое обогнав DeepSeek — по данным OpenRouter, это крупнейший запуск в истории площадки.

80% / 65% / 52%результат Ox Alpha, Fable 5 и Sol на DeepSWE-мини-тесте
320B / 18Bвсего / активных параметров GLM-5.3-Flash
$0.15 / $0.50цена API за млн входных/выходных токенов

Полный разбор →

Бенчмарк LLM в задаче OCR для e-commerce

S@saas_foundersAI-инженер
8 ч
провел бенчмарк LLM моделей на OCR в задаче "распознай данные со скриншота магазина и сложи в JSON" - требуется определить заголовок, категорию товара, цену, выбранные параметры/опции. Фокус был на костах, конечно же - стоимость за 1000 распознанных скриншотов с максимальным качеством при этом. Победила опять... Gemma 4 31B. В 20+ раз дешевле gemini 3.7 flash. $0.115 за 1000 распознанных скриншотов. Судьей в бенчмарке выступил мой хороший приятель Codex + 5.6 Sol Medium.
Бенчмарк LLM в задаче OCR для e-commerce

MIT: LLM-агенты сами создали «цивилизацию» в песочнице SwarmWorld

Исследователи из MIT опубликовали препринтi о симуляции SwarmWorldiы добывают ресурсы и строят объекты без заданных ролей">i — виртуальном мире, где до 200 изначально одинаковых LLM-агентов без заданных ролей и инструкций добывают ресурсы, строят объекты и пишут код для их автоматизации. Цель эксперимента — проверить, способны ли агенты сами организоваться и коллективно изобретать технологии без явного управления.

Результат: агенты спонтанно разделили труд на «разведчиков» и «оседлых инженеров», а обмен знаниями шёл в основном не через диалоги, а через копирование и доработку чужих рабочих построек и скриптов — по аналогии с гитхабом. Вывод авторов: для возникновения зачатков «цивилизации» у нейросетей не нужно много общения — достаточно общего мира, где результаты труда одного агента остаются и могут быть найдены и улучшены другим.

ВыводSwarmWorld — песочница, где агенты ходят по карте, добывают и перерабатывают ресурсы, экспериментируют с материалами и строят объекты

до 200агентов одновременно в симуляции SwarmWorld
95%культурного обмена происходило через копирование построек, а не через чат

Полный разбор →

Анализ архитектуры ИИ-агента GigaCowork от Сбера

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 12 ч назад

Эксперты и пользователи начали сравнивать российский ИИ-инструмент GigaCowork с зарубежным аналогом Claude Cowork. В центре внимания оказался технический разбор архитектуры сервиса, который указывает на использование сторонней языковой модели в качестве основы.

В отличие от обычных чат-ботов, GigaCowork позиционируется как ИИ-агентi, способный самостоятельно выполнять рабочие задачи, такие как поиск информации в сети и работа с файлами. Это отражает общеотраслевой тренд 2026 года, где бизнес переключается с простых генеративных моделей на автономных агентов для достижения реальной окупаемости.

Qwen3-235Bназвание используемой языковой модели
50%доля инвестиций в ИИ-агентов

Полный разбор →

Тест самообучаемой модели Ornith 1.5 9B

Г@gmorevaAI-инженер
19 ч
Видео про Ornith 1.5 9B Меня давно просили протестировать Ornith. Вот вышла версия 1.5 от DeepReinforce, которую называют «самообучаемой»: при RL-обучении модель сама генерирует себе задачи, скаффолды и роллауты, без фиксированных человеческих датасетов. Разбираюсь, что это значит на практике, и гоняю плотную 9B-версию в реальных задачах. Спойлер: я не ожидал такого от 9 миллиардов параметров. Ссылки на видео на всех площадках: 📹 YouTube | VK | Rutube | Dzen 📹

Куда двигать свой AI-стек: подписки, локальные модели и железо

N@NGI_ruAI-инженер
вчера

Оптимизация данных для обучения SLM и управление мультиагентными системами

T@kryak_startupAI-инженер
вчера

Alibaba выпустила Qwen3.8-Flash-Next — экономичное превью архитектуры Qwen4

Команда Qwen (Alibaba) представила Qwen3.8-Flash — мультимодальную MoEi-модель, а также открыла веса Qwen3.8-Flash-Next, ранней версии архитектуры, которую компания исследует для будущей Qwen4. Модель насчитывает 125B параметров плюс 51B «N-gram»-эмбеддингов, но активирует на токен всего 6B — за счёт этого обучение обошлось примерно в 9 раз дешевле, чем у Qwen3.7-Plus.

По заявленным бенчмаркам модель обходит Qwen3.8-27B и DeepSeek-V4-Flash, а по данным Data Secrets — превосходит Claude Opus 4.6 Max на 8 из 9 тестов. Благодаря компактному числу активных параметров и поддержке GGUF-квантизации модель можно запускать локально на машинах с 128 ГБ памяти (DGX Spark, Mac Studio, Strix Halo), что делает её заметным событием для локального инференса топового уровня качества.

125Bвсего параметров модели
6Bактивных параметров на токен
9 раздешевле обучение по сравнению с Qwen3.7-Plus

Полный разбор →

Влияние локальных LLM на счета за электроэнергию

П@mflenovавтор про «it»
вчера
Влияние локальных LLM на счета за электроэнергию

Это всё на сейчас.