ИИ

Массовый переход бизнеса на китайские ИИ-модели: аналитика и тренды

Согласно данным аналитики OpenRouter, доля американских ИИ-моделей в общем объеме потребления токенов сократилась с 70% в 2025 году до 30% в 2026 году. В то же время доля китайских разработок выросла с 20% до 50%. Пользователи все чаще отдают предпочтение китайским решениям из-за их высокой экономической эффективности: при снижении качества работы в среднем на 7-10%, затраты на использование моделей сокращаются на 60-75%.

Крупные технологические компании начали массовый отказ от американских провайдеров в пользу альтернатив из КНР. В частности, Lindy перешли на Deepseek v4, Cursor — на Kimi k2.5, Coinbase — на GLM-5.2 и Kimi 2.7, а Shopify, Airbnb, Uber Eats, Siemens и Chapsvision интегрировали модели Qwen. По имеющимся данным, Microsoft также тестирует Deepseek v4. Инженеры отмечают, что для рутинных задач, таких как код-ревью, разница в качестве между моделями практически не ощущается.

Техническое сравнение показывает, что китайские модели успешно конкурируют с американскими аналогами. Например, GLM-5.2 демонстрирует показатели в кодинге, превосходящие GPT-5.5, при стоимости в 5-10 раз ниже. В генерации видео Kling 3.0 показывает результаты, сопоставимые с Veo 3.1, при двукратной экономии. Для генерации изображений используется Seedream 4.5, а для массовых задач — MiMo V2.5.

На фоне этого исхода индустрия фокусируется на оптимизации инфраструктуры. NVIDIA и Microsoft работают над чипом RTX Spark, который позволит запускать модели со 120 миллиардами параметров и окном в миллион токенов локально на ноутбуках, исключая необходимость в серверных мощностях.

Обновление Hermes Agent 0.18.0 от Nous Research

N@v_neuroAI-инженер
2 мес
🤖 Hermes Agent 0.18.0 Крупнейший апдейт открытого агента Nous Research. Вместо «всё готово» он собирает доказательства - например, гоняет тесты. Что нового: ✧ Ансамбль моделей выбирается как одна модель ✧ /learn лепит навык из любого опыта ✧ Память - редактируемый граф, видно всё, что агент о вас узнал За полторы недели закрыли ~700 критических задач. Либо героизм, либо очень напуганный бэклог. 🔗 Что нового и где подвох → ссылка #hermes

NVIDIA выпустила квантованную версию Mistral Medium 3.5

2 мес
🖥 NVIDIA только что выпустила на Hugging Face квантованную версию Mistral Medium 3.5. Это dense-модель на 128B параметров с контекстным окном 256k, работающая в точности NVFP4 на Blackwell GPU и почти без потери качества. Model: https://huggingface.co/nvidia/Mistral-Medium-3.5-128B-NVFP4 Base model: https://huggingface.co/mistralai/Mistral-Medium-3.5-128B

Исследование MIT: модульность мозга и LLM

S@Syncretsисследователь
2 мес

Анализ стоимости использования Claude Sonnet 5

Исследователи из Artificial Analysis провели сравнительный анализ стоимости использования новой модели Claude Sonnet 5 от Anthropic. Согласно полученным данным, Sonnet 5 обходится пользователям на 15% дороже, чем предыдущая модель Opus 4.8, и является одной из самых дорогих моделей на рынке.

Основной причиной роста затрат стал высокий расход токенов. По замерам Artificial Analysis, Sonnet 5 тратит на решение задач значительно больше ресурсов, чем Opus 4.8, а объем токенов, расходуемых на «рассуждения», увеличился на 30%. Это приводит к более быстрому исчерпанию лимитов и увеличению итоговой стоимости выполнения запросов.

В сравнении с моделью Fable 5 данные разнятся: по средней стоимости на одну задачу Fable 5 все еще остается чуть дороже, однако при выполнении комплексных бенчмарков общие затраты на Sonnet 5 могут превышать 6000 долларов, что делает его дороже Fable 5 на масштабе. В целом, новая модель демонстрирует значительно более высокий расход токенов — примерно в два раза больше, чем у Fable 5.

Анализ автономности Claude Code: отчет Anthropic

2 мес

Интервью с Сергеем Марковым о будущем ИИ

С@oulenspiegel_channelAI-инженер
2 мес
https://vk.ru/wall-231855325_28 В гостях Сергей Марков - Директор по развитию технологий ИИ Сбербанка. В выпуске: – Стоит ли бояться ии – Сбои в работе нейросетей – Нейросеть в 2026 году – Кто такие агенты – Забавные случаи при работе с ии – Оцифровка человеческого мозга

Google добавила ИИ-агента Spark в десктопное приложение Gemini

v@vcnewsмедиа / агрегатор
2 мес
Google добавила ИИ-агента Spark в десктопное приложение Gemini. Он может работать с файлами локально, управлять браузером и «следить» за заданными темами. Пока доступен только на Mac по подписке AI Ultra в США vc.ru/ai/3006620

Проблемы с управлением контекстом у автономных AI-агентов

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 2 мес назад

Исследователи зафиксировали сбои в работе автономных AI-агентов, вызванные ошибками в управлении контекстом. Из-за некорректной обработки данных система начала повторно выполнять уже завершенные задачи. Проблема была выявлена в момент попытки агента совершить коммит, который был успешно выполнен ранее. Данный инцидент подчеркивает критическую важность контроля состояния контекста для стабильной работы автономных AI-систем.

Claude Code для 3D-моделирования

S@SantryBlogAI-инженер
2 мес
Открытие этой недели: claude code умеет в трехмерное моделирование. Если установить пакет скиллов, то вполне можно создавать и редактировать трехмерные модели в текстовом чате. С Opus 4.8 это опыт близкий к ранним генераторам картинок. То есть, нужно четко формулировать ТЗ и постоянно направлять модель, но даже так она полезна. Я, например, редактировал stl. В Fusion 360 делать это жутко не удобно, а тут нужно было лишь немного поспорить с электронным болваном. Если верить твиттеру, Fable 5 моделит чуть ли не реактивные турбины целиком. Проверю, когда вернут доступ.

Pika представила функцию генерации видео через чат

N@v_neuroAI-инженер
2 мес
📱 Pika выкатила вещь, за которую раньше отвечал бы целый отдел моушн-дизайна. Кидаешь в чат своё селфи, пишешь /anime-soccer и через полминуты смотришь, как твоя аниме-версия с зелёными глазами и пирсингом лупит с разворота, вратарь в прыжке тащит мяч, вокруг молнии и рёв трибун. Всё внутри обычного чата, через #Pika MCP, без единого приложения. Двадцать шесть секунд эпика по одной команде. Забавно, как генераторы видео тихо переползают туда, где ты и так весь день сидишь - в переписку. А потестировать можно тут
Ещё ↓