ИИ

Оптимизация MiniMax H3 VAE в ComfyUI

М@cgeventAI-инженер
2 нед

Cloudflare представил браузер для AI-агентов

И@AImademydayAI-инженер
2 нед
Браузер для AI-агентов от Cloudflare Добавил в Hermes новый CLI браузер. Результат обхода RU страниц с защитами на скрине. Ключевые выводы 1. Kitesurf IP = Cloudflare Workers (US) — российские сайты видят американский IP 2. Ozon полностью блокирует cloud-браузер (редирект-цикл / "нет соединения") 3. Яндекс грузится, но при поиске показывает CAPTCHA (подозрительный IP) 4. Трекеры блокируются — metrika, yandcache возвращают HTTP 451 Все инструменты работают на реальной странице: snapshot, screenshot, evaluate, network, console, fill, click, emulate, heap Про Playwright и Selenium можно забыть.
Cloudflare представил браузер для AI-агентов

Эволюция вайбкодера: от сомнений до полной автоматизации

А@undisruptмедиа / агрегатор
2 нед
Эволюция вайбкодера — а вы пробовали клод? — ерунда какая-то — клод проверяет мой код — клод пишет для меня код — я диктую задачу с телефона и клод пишет код — вчера пьяный шёл из бара и запилил b2b-saas, рыча в клод — стоит подумать о задаче как клод уже написал код — клод знает, о чём я подумаю завтра, поэтому вчера уже написал код — я всё делаю через клод — клод клод клод клод код клод

LoopX: инструмент для управления многодневными задачами ИИ-агентов

Инженер ByteDance Хуан Жуйтэн, участник разработки OpenVikingi, опубликовал в открытый доступ LoopXi — надстройку, которая хранит цель и состояние долгой задачи ИИ-агента отдельно от его памяти. Сам LoopX агентов не запускает и не заменяет Codex, Claude Code или Cursor — он работает рядом с ними как отдельный слой данных.

Проблема, которую решает инструмент, известна: у языковой модели ограничена память в пределах одного разговора, и после нескольких дней работы, перезапусков или смены модели агент теряет нить задачи. LoopX хранит цель, границы полномочий, очередь задач, собранные подтверждения, расписание запусков и точки, требующие решения человека, — всё это можно продолжить с другой машины, в новой сессии или на другой модели ИИ.

9 сутокдлительность первой опубликованной траектории задачи
11 сутокдлительность второй опубликованной траектории задачи
3.11минимальная требуемая версия Python

Полный разбор →

Сравнение производительности и стоимости DeepSeek и Fable 5

F@FuturisAI-инженер
2 нед
DeepSeek показывает примерно уровень Opus/Fable, но генерация ответа стоит в 29–57 раз дешевле🌈: в работе через терминал у него 87,9 против 88 у Fable 5, а в поиске уязвимостей — 83,3 против 83,1. В сложной длительной разработке Fable всё ещё впереди: 70 против 62,7. И всё это стоит всего $0,435 за вход и $0,87 за выход миллион токенов🤣
Сравнение производительности и стоимости DeepSeek и Fable 5

Релиз Grok 4.7 и расширение лимитов в Cursor

т@techn0danyaAI-инженер
2 нед
🐸 Релиз за релизом На этот раз для твиттерских Вы пустили Grok 4.7 и по этому случаю Grok Build и Cursor удвоили лимиты на модель на всю неделю. Ну и еще вы можете попробовать что-то типа OpenClaw/Hermess местного разлива, который называется GrokBot, но вот хоть убейте, но я до сих пор не понял, какие у этого есть применения. Буду благодарен за просвещение в комментариях #AI @techn0danya
Релиз Grok 4.7 и расширение лимитов в Cursor

Субъективное восприятие артефактов в генеративной музыке

М@cgeventAI-инженер
2 нед
Зерно с песком Раз уж сегодня музыкальный марафон вкину такой наброс. Тут вот вечно ругают Суно за песок. А мне норм, я слушаю прежде всего "музыкальную мысль", новизну, фишки, аранжировку, драйв. Если качает, но песок норм. А вон в кино, например, меня всегда бесило пленочное зерно. Тот же песок, вид из глаза, а не из уха. А все такие эстеты: "ооо, зерно, круто, стильно, сеанс". И ну носиться с этим зерном как с фетишем. А мне оно мешает. И не нравится. Это я к чему. Ну песок и песок. Кому-то фу, кому-то ок. Вкусовщина. Отстаньте от Suno уже. Слушайте музыку, а не блох. @cgevent

Сергей Марков о будущем ИИ и рисках технологий в подкасте «Визионеры»

С@oulenspiegel_channelAI-инженер
2 нед

NVIDIA выпустила открытую модель Nemotron 3.5 Lightning для ИИ-агентов

NVIDIA представила открытую модель Nemotron 3.5 Lightning — решение на архитектуре MoEi (30 млрд параметров, 3 млрд активных), созданное специально для работы ИИ-агентов: рутинных задач, программирования и вызова инструментов. Модель работает в связке с более мощными моделями через систему маршрутизации.

По заявлениям NVIDIA, Nemotron 3.5 Lightning выполняет агентские сценарии до 4 раз быстрее аналогов, держит постоянную нагрузку и может запускаться как на дорогих системах DGX Spark, так и на локальных потребительских GPU уровня GeForce RTX 5090 — то есть позиционируется как экономичная альтернатива для массового использования агентов.

30 млрдобщее число параметров модели
3Bактивных параметров (MoE)
86%точность на PinchBench

Полный разбор →

Возможное снятие лимитов в OpenAI Codex

D@data_secretsAI-инженер
2 нед
Освобождайте завтрашнюю ночь для вайбкодинга: кажется, OpenAI пробили какую-то большую отметку пользователей Codex (50M? 100M?), и завтра нас ожидает большой сброс лимитов. А может, и еще что-нибудь приятное.
Возможное снятие лимитов в OpenAI Codex

Sonauto переименовался в Treblo и предлагает бесплатную безлимитную генерацию музыки на фоне ограничений Suno

Сервис генерации музыки Sonauto 3 июня официально сменил название на Treblo. На фоне того, что Suno вводит ограничение на скачивание треков (не более 7 за всю жизнь аккаунта), Treblo выглядит подозрительно щедрым конкурентом: последняя модель Melodia v3i доступна обычным пользователям бесплатно и без лимитов — без кредитов, дневных квот и урезанной старой версии, причём ограничений на использование сгенерированных треков нет даже на бесплатном тарифе.

Treblo позиционируется как альтернатива для тех, кто хочет «валить» из Suno: генерация идёт по текстовому промпту и более чем 4160 стилевым тегам, поддерживаются свои или авто-сгенерированные лирика, микс языков в одном треке, инструменталы, а также редактирование — inpaint секций, замена текста, extension, remix и stem separationi.

7лимит скачиваний в Suno на весь аккаунт
4160+стилевых тегов в Treblo
<1 на 10 000заявленный false-positive Treblo Classifier

Полный разбор →

Почему AI в фитнесе — это оверхайп и как использовать LLM эффективно

N@NGI_ruAI-инженер
2 нед

Stability AI выпустила Stable-Layers — модель для разбора картинок на редактируемые слои

Stability AI представила Stable-Layers — инструмент, который разбирает обычное изображение на отдельные RGBA-слоиi (фон, персонажи, предметы), пытаясь при этом восстановить то, что было скрыто за объектами на переднем плане. Это не собственная архитектура Stability, а LoRAi-надстройка поверх сторонней модели Qwen-Image-Layered 20B, дополнительно обученная методом Flow-GRPOi.

По сравнению с оригинальной Qwen-Image-Layered результат заметно чище: меньше дублирующихся слоёв, аккуратнее альфа-канал, лучше разделение объектов друг от друга.

20Bпараметров базовой модели Qwen-Image-Layered
330 МБразмер LoRA Stable-Layers
640 pxрекомендуемое разрешение обработки

Полный разбор →

The GTM Co-Founder: база знаний для AI-агентов

С@startupofthedayавтор про «startups»
2 нед

Как учить детей в эпоху ИИ

ч@chelovek_naukAI-инженер
2 нед

Исследователи заподозрили Kimi в обучении на скрытых рассуждениях Claude

2 нед
Исследователи заподозрили Kimi в обучении на скрытых рассуждениях Claude

OpenAI выпустила превью-приложение ChatGPT для Linux

OpenAI представила официальную превью-версию десктопного приложения ChatGPT для Linux, объединяющую в одном клиенте сервисы ChatGPT, ChatGPT Work и Codexi с интеграцией в локальные проекты и браузерные процессы пользователя.

В компании пояснили, что Linux — одна из самых востребованных платформ для десктопного приложения, и его запуск завершает поддержку ChatGPT и Codex на всех крупных настольных операционных системах.

5поддерживаемых дистрибутивов Linux

Полный разбор →

xAI выпустила Grok Bot — бета ИИ-агентов с «собственными компьютерами» в облаке

xAI представила раннюю бета-версию Grok Bot — сервиса, который создаёт команды автономных ИИ-агентов для рабочих задач. Каждый агент получает собственный виртуальный компьютер в облаке и работает в обычных интерфейсах — заходит на сайты, кликает и печатает как человек, — вместо того чтобы подключаться через API или MCPi. Это позволяет боту работать с любыми сервисами, даже если у них нет технической интеграции.

Боты умеют объединяться в команды: один разбирает почту, второй следит за финансами, третий занимается наймом, а отдельный «руководитель» (chief of staffi) распределяет задачи и координирует остальных. К человеку агент возвращается только за подтверждением важного шага или с готовым результатом, а работать может автономно даже при выключенном компьютере пользователя.

$200/месяццена подписки Cursor Ultra
$120/место/месяццена Cursor Teams Premium

Полный разбор →

Оптимизация рекомендательных систем через Reinforcement Learning

2 нед
Оптимизация рекомендательных систем через Reinforcement Learning
Ещё ↓