ИИ

Disney Research представили модель для генерации точной анимации барабанщика по аудио

М@cgeventAI-инженер
1 нед

Стоимость развертывания ИИ-моделей в России выросла в 2,8 раза

3@ru3dnewsавтор про «tech»
1 нед
Стоимость развёртывания ведущих мировых ИИ-моделей в России за год выросла в 2,8 раза Компания MWS Cloud (входит в МТС Web Services) проанализировала требования к вычислительной инфраструктуре для запуска ведущих мировых и российских больших языковых моделей. #software #ии #mws #llm #исследование #финансы #servernews via @servernewsru 📎Подробнее
Стоимость развертывания ИИ-моделей в России выросла в 2,8 раза

DeepSeek выпустила open-source харнесс для AI-агентов и почти сразу подняла цену на кэшированные токены

DeepSeek опубликовала DeepSeek Harnessi (dsh) — open-source инфраструктурный слой для превращения обычных ИИ-моделей в автономных агентов, аналог обвязки вокруг Claude Code/OpenCode/Codex. Идея проекта — «everything is a plugin»: модель, инструменты, skills, sandbox, память, permission policy, UI и даже суб-агенты (можно подключить Claude Code или Codex) собираются как отдельные плагины. Проект основан на мета-фреймворке Cordisi, распространяется по MIT-лицензии и не требует использования именно API DeepSeek — можно подключить любого провайдера или локальную модель.

Репозиторий стал одним из самых быстрорастущих в истории GitHub: 122K+ звёзд за 3 дня и уже более 140к звёзд спустя несколько дней — быстрее, чем в своё время набирал звёзды OpenClaw. Почти одновременно с релизом DeepSeek подняла цену на cache-hit inputi в 6–12 раз, а именно этот тип токенов больше всего расходуют агентные циклы, которые Harness делает массовыми — на это обратили внимание наблюдатели.

122K+звёзд GitHub за 3 дня
>140кзвёзд GitHub через пару дней
6–12 разрост цены cache-hit input

Полный разбор →

GenBio AI представил виртуальную модель клетки человека AIDO Cell

Х@htech_plusисследователь
1 нед
Стартап нобелевского лауреата представил виртуальную модель клетки человека Стартап GenBio AI из Пало-Альто разработал AIDO Cell — систему искусственного интеллекта, которую компания называет виртуальной копией человеческой клетки. Она предназначена для моделирования клетки в нормальном состоянии и отслеживания её реакции на лекарства и другие воздействия. Среди соучредителей GenBio — лауреат Нобелевской премии по химии Дэвид Бейкер, известный работами в области компьютерного проектирования белков. https://hightech.plus/2026/08/19/startap-nobelevskogo-laureata-predstavil-virtualnuyu-model-kletki-cheloveka

Keenable о методологии бенчмарка Artificial Analysis

L@lovedeathtransformersAI-инженер
1 нед

Keenable о методологии бенчмарка Artificial Analysis

С@senior_augurAI-инженер
1 нед
Keenable о методологии бенчмарка Artificial Analysis

Оптимизация инференса MoE моделей через Warp Decode от Cursor

К@quant_prune_distillAI-инженер
1 нед

Mistral AI запускает облачную платформу и добавляет модель GLM-5.2

C@cyberyozh_officialAI-инженер
1 нед

Яндекс тестирует рекламу в ИИ-выдаче

К@d_codeавтор про «tech»
1 нед
😸 Кругом реклама Яндекс расширяет тестирование рекламы в своей ИИ-выдаче. При этом доступ к такому формату пока получило лишь ограниченное число компаний. Мнения о рекламе в нейровыдаче неоднозначные: ↖️ https://kod.ru/yandex-reklama-neirovydacha
Яндекс тестирует рекламу в ИИ-выдаче

MOSS-VL: открытая визуально-языковая модель с реалтайм-стримингом

Н@GreenNeuralRobotsAI-инженер
1 нед
MOSS-VL Семейство открытых визуально-языковых моделей от OpenMOSS. Флагманская фишка - реалтайм-стриминг: модель смотрит на входящие кадры и отвечает параллельно, не дожидаясь конца видео модель живёт в настоящем времени, а не смотрит запись постфактум. Вместо внешних планировщиков и опроса раз в секунду - три встроенных поведения: ответ в любой момент, проактивное молчание, своевременная коррекция. • 11B параметров, контекст 256K • Кванты FP8 и NF4 Гитхаб HF Демо #vlm #realtime #fp8 #nf4 #dialog #interactive VK | MAX

Reddit тестирует ИИ-генерацию коротких видео и озвучку постов

Reddit начал тестировать новые функции: автоматическую генерацию коротких вертикальных видео на основе текстовых постов и озвучку публикаций с помощью ИИ. Пользователи получают выбор — читать пост в привычном текстовом формате или посмотреть/прослушать его версию, при этом сама текстовая форма никуда не исчезает.

Причина нововведения — сторонние авторы уже давно нарезают контент Reddit в короткие ролики для TikTok и Reels и собирают на этом миллионы просмотров; платформа решила забрать этот формат себе. Часть пользователей раскритиковала изменения, опасаясь, что Reddit превратится в «ещё один» TikTok.

Полный разбор →

Qwen 3.8 превосходит Opus 4.8 в юридических задачах при меньшей стоимости

1 нед
Qwen 3.8 превосходит Opus 4.8 в юридических задачах при меньшей стоимости

Разработка скилла для оптимизации токенов в кодинг-агентах

D@denissexyAI-инженер
1 нед
А еще, было время в выходные сделать скилл который экономит токены кодинг агентам Я гонял авторесеч поверх агентских хуков (это когда агент, вызывает что-то сам, например, перед первым своим ходом) и уже прошедших евалов, и получил агентский хук который правда экономит до 22% токенов, при сохранении качества (этот % зависит и от задачи, и от бенчмарка, может быть больше, а может быть меньше) Выложил тут: https://github.com/JetBrains/benjamin-plus-skill/ Авторесеч – это когда агент работает по кругу, читает что получилось, правит конфиги и заново запускается
Разработка скилла для оптимизации токенов в кодинг-агентах

ComfyOrg выпустили MCP-сервер для локального ComfyUI

Н@GreenNeuralRobotsAI-инженер
1 нед

Стругацкие и концепция AI-агентов

I@inspired_PMмедиа / агрегатор
1 нед

Релиз модели Dflash2 и критика подхода авторов

К@quant_prune_distillAI-инженер
1 нед

Вопрос о производительности квантованных моделей и шине PCI-E

T@extremecodeAI-инженер
1 нед
Эксперты из каментов, я с этими бенчмарками скоро с ума сойду. Почему так ёпта? PCI-E 4 / x4, на ЖПУ также только 4 линии распаяно. В теории должны упираться в шину, какого хрена iMatrix, и уж тем более 8-и битки быстрее, чем очереднярные Q4? Все в интернетах пишут типа, "АРРРЯЯ IQ медленные", какого хрена у меня они стабильно быстрее? Даже на нормальной жпу в pcie5 со всеми линиями (скрин в каменты к посту закину) Параметры бенча дефолтные [--fit-target 1024], контекст 512 на pp, и 128 на tg
Вопрос о производительности квантованных моделей и шине PCI-E
Ещё ↓