ИИ

Mewmori: локальный ИИ-питомец для macOS

C@campcodeAI-инженер
1 нед
Коты стали умнее людей — заводим себе гениального пушистика с локальным ИИ на Mac 😁 Mewmori работает на Qwen, следит за происходящим на экране, запоминает ваши привычки и разговоры, охотится за курсором, выпрашивает рыбу и иногда устраивает подставы с фейковыми ошибками macOS. Всё работает локально и никуда не отправляет вашу цифровую жизнь. Теперь не женюсь 😁

VibeWorlding: фреймворк для генерации 3D-миров агентами

Н@GreenNeuralRobotsAI-инженер
1 нед
VibeWorlding Фреймворк от HKUST и Tencent для агентов, которые строят интерактивные 3D-миры по текстовому запросу. Единый стек: бенчмарк, песочница для RL и модели. Агент сам понимает интент, планирует сцену, вызывает 3D-инструменты и рефлексирует по фидбеку. • Сборка 3D-мира от запроса до готовой сцены без ручной работы • многошаговое взаимодействие с окружением - планирование, вызов инструментов, рефлексия • Поиск и редактирование ассетов, рендер сцены через MCP-инструменты • Флагман VibeWorlder-30B-A3B, есть версии 8B и embedding 4B Гитхаб HF #textto3d #3d #agent VK | MAX

Написание книги Agentic AI System Design

В@cryptovaleriiAI-инженер
1 нед
Две первые главы книги «Agentic AI System Design» уже написаны и сейчас находятся на ревью у соавторов. Один соавтор тот же: https://t.me/partially_unsupervised Два — с курса по ML System Design. По отзывам вышло неплохо:
Прочитал с кайфом и даже взял на вооружение
Надеюсь, к концу года допишем.

Tencent представила UI-Mate-27B: GUI-агент для управления рабочим столом

Н@GreenNeuralRobotsAI-инженер
1 нед

Юристы Конгресса США тратят больше времени на проверку ИИ-законопроектов

К@d_codeавтор про «tech»
1 нед
😀 Американцы Юристы Палаты представителей США теперь тратят больше времени на вычитку законопроектов, написанных в Claude и ChatGPT, чем заняло бы их написание с нуля. Ошибки долетают вплоть до неверных ссылок на действующие законы: ↖️ https://kod.ru/congress-ai

Проект HuiHui выпустил версию Qwen3.8 27B с ослабленной цензурой

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 1 нед назад

Проект HuiHui опубликовал модель Huihui-Qwen3.8-27B-abliteratedi — сжатую (квантованную) версию модели Qwen3.8-Max с ослабленной цензурой. Модель доступна на Hugging Facei в нескольких квантизациях, есть демо-версия.

Исследователи предупреждают, что из-за снятых ограничений модель может давать спорные или неуместные ответы на «чувствительные» темы, что важно учитывать при её использовании.

27Bколичество параметров модели

Полный разбор →

OpenAI передала ФБР логи переписки пользователя с угрозами

C@cyberyozh_officialAI-инженер
1 нед

MiniMax выпустил открытую модель генерации музыки с вокалом Music 3

MiniMax опубликовал веса Music 3 — open-source модель, которая по текстовому промпту создаёт полноценные песни с вокалом, инструментами и структурой (куплет-припев) за один проход, длительностью до 5 минут (по данным одного источника — до 10 минут). Модель уже интегрирована в ComfyUIi, HuggingFace Diffusers и SGLang, работает локально и не требует топового железа.

В отличие от типичных audio-token генераторов, MiniMax использует гибридную архитектуру из двух LLM плюс модуль Flow Matching и Flow-VAEi, что даёт более гибкий контроль над структурой трека, вокалом и аранжировкой через отдельные seed и CFG для разных уровней генерации.

24 GBминимум VRAM для полной точности
8Bразмер Global LLM (Qwen3-8B)
32 kHzчастота дискретизации выходного аудио

Полный разбор →

Alibaba представила HappyShrimp 1.0 для генерации песен

М@cgeventAI-инженер
1 нед

Speko: единый API и роутер для голосовых AI-моделей

A@ai_productAI-инженер
1 нед
Speko: единый API и роутер для голосовых AI-моделей

DeepSeek V4 Pro получил прирост производительности через J-Space

1 нед
🚀 DeepSeek V4 Pro внезапно стал заметно сильнее - без переобучения модели К DeepSeek V4 Pro 0813 подключили harness под названием J-Space, который снижает ошибки в длинных цепочках reasoning и tool use. По опубликованным результатам прирост местами очень серьёзный: * Terminal Bench: 87.9 → 90.1 * NL2Repo: 61.5 → 73.4 * CyberGym: 83.3 → 86.8 * DeepSWE: 62.7 → 72.0 * Toolathlon: 74.1 → 79.5 В ряде agentic/coding тестов такая связка якобы обходит даже Fable 5 и Opus 4.8. https://github.com/Tiger3807861189/DeepSeek-V4-J-Space-Capability-Realization-Report
DeepSeek V4 Pro получил прирост производительности через J-Space

Marionette: игровая модель мира от Alaya Lab

Н@GreenNeuralRobotsAI-инженер
1 нед

Alibaba выпустила компактную модель Qwen3.8-27B, которая обходит облачных конкурентов

14 августа 2026 года Alibaba релизнула Qwen3.8-27B — мультимодальную dense-модель на 27 млрд параметров с открытыми весами (лицензия Apache 2.0i), которую можно запускать на одной домашней видеокарте. По бенчмаркам Alibaba модель обходит собственную облачную Qwen3.7-Plus и местами превосходит Claude Opus 4.6 Max, при этом умеет работать с кодом, агентными сценариями, изображениями и видео.

Релиз показателен для всей индустрии: китайские открытые модели быстрее прогрессируют, чем закрытые западные аналоги, и по некоторым замерам уже опережают флагманов уровня GPT-5 при кратно меньшей стоимости эксплуатации. Несколько авторов отмечают, что главным недостатком локальных моделей остаётся не «глупость», а скорость работы.

27 млрдпараметров у Qwen3.8-27B
262 144токенов нативного контекста (до 1M через YaRN)
2,4 трлнпараметров у флагмана Qwen3.8-Max

Полный разбор →

Ещё ↓