ИИ
Google представила модель Gemini Flash-Lite
Представлен инструмент FaceAnything для реконструкции лиц по видео
Исследователи из Huawei и Мюнхенского университета анонсировали проект FaceAnything, предназначенный для 4D-реконструкции лиц на основе обычных видеозаписей. Технология использует совместное предсказание глубины и канонических координат, что позволяет извлекать облака точек без применения специализированного оборудования. Несмотря на наличие артефактов, ограничивающих точность 3D-моделирования, инструмент может быть эффективно использован для создания визуальных эффектов в композе.
OpenAI оптимизировала стоимость инференса в два раза
ИИ-система Reti-Pioneer для диагностики заболеваний по снимкам сетчатки
Цифровая память и страх перед будущим ИИ
ИИ не обладает сознанием: доказательство через Age of Empires II
ComfyUI представила MCP-сервер для интеграции с ИИ-агентами
Команда ComfyUI анонсировала запуск публичной бета-версии MCP-сервера, который позволяет ИИ-агентам взаимодействовать с платформой через естественный язык. Новое решение дает возможность агентам автоматически находить ноды, создавать и редактировать графы генерации, что упрощает настройку сложных рабочих процессов. В дополнение к этому представлены Comfy CLI и репозиторий Comfy Skill для расширения возможностей автоматизации генеративных пайплайнов. Интеграция направлена на повышение воспроизводимости рабочих процессов и автоматизацию рутинных задач в командной разработке.
Скандал вокруг статистики использования ИИ в Spotify
«Это они добавляют каждую новую песню в git или что-то в таком роде?» «Наглядное пособие по созданию ИИ-пузыря» «Зачем? Последняя новая фича в Spotify появлялась 15 лет назад»Главное, что KPI по токенмаксингу выполнили
Блокировки аккаунтов Claude в РФ и риски привязки к сервисам
LiveEdit: потоковое редактирование видео на базе Wan2.1
Anthropic планирует внедрить проверку паспортов для доступа к Fable 5
100 хаков для эффективной работы с Claude
ИИ не заменит профессии, требующие эмпатии
Ценность эксперта в эпоху AI: критическое мышление и контроль качества
Сбер представил токенизатор KVAE-Audio для генеративных аудиомоделей
Сбер опубликовал в открытом доступе алгоритм KVAE-Audio, предназначенный для эффективного сжатия аудиоданных с коэффициентом 960x. Разработка оптимизирует процесс обучения диффузионных моделей и обеспечивает более высокое качество генерации звука по сравнению с аналогичными решениями от Sony, Meta и Stability AI. Новый токенизатор решает проблему компактности данных, что позволяет повысить эффективность работы генеративных нейросетей.
Анализ рыночных позиций OpenAI в 2026 году
Экономика и архитектура современных LLM: почему дешевые модели выигрывают
Анализ эффективности мультиагентного оркестратора Fugu Ultra от Sakana AI
Компания Sakana AI представила мультиагентный оркестратор Fugu Ultra, предназначенный для распределения сложных задач между различными LLM. Анализ показал, что система демонстрирует высокие результаты в задачах по программированию, однако значительно уступает топовым моделям, таким как Claude 3 Opus, по показателям скорости. Эксперты отмечают, что текущая реализация Fugu Ultra является экономически невыгодной для масштабируемого бизнеса из-за высокой стоимости использования при сопоставимой с frontier-моделями эффективности.
OpenClaw выпустил мобильные приложения для управления локальными ИИ-агентами
Проект OpenClaw представил официальные мобильные приложения для iOS и Android, позволяющие пользователям управлять локальными ИИ-агентами со смартфона. Решение обеспечивает интеграцию с функциями устройства, включая камеру и календарь, а также поддерживает голосовое общение через защищенный шлюз. Платформа ориентирована на приватность и работу с собственными серверами, однако пользователи отмечают наличие ошибок и недоработок в текущей версии ПО.