ИИ
Массовые увольнения руководителей в OpenAI

Tencent представила платформу AI-Infra-Guard для безопасности AI-инфраструктуры
.pyc, защиту от charset smuggling и расширили базу до 2000+ правил для CVE.
Есть отдельные CLI для Agent Scan, MCP Scan и Skill Scan. Разворачивается локально через Docker.
https://github.com/tencent/AI-Infra-Guard
Дайджест новостей ИИ: OpenAI, Google, NVIDIA, Perplexity и Anthropic
Подборка инструментов и воркфлоу для Minimax H3
Anthropic объединила память Claude в обычном чате и в Claude Cowork
Anthropic сделала единую систему памяти для Claude: то, что бот узнал о пользователе, его проектах и предпочтениях в обычном чате, теперь автоматически доступно в Claude Coworki, и наоборот. Раньше эти два продукта хранили информацию раздельно — в документации Anthropic прямо указывалось, что память «is not currently available for Cowork».
Пользователь может просматривать сохранённые данные по темам, редактировать или удалять их. Чувствительные категории — например, здоровье и убеждения — по умолчанию не сохраняются вовсе.
Сетап ИИ-инженера и борьба с синдромом самозванца

Релиз MiniMax-H3 Pruned Ref-Delta Fused
OpenAI обещает «лучший DevDay в истории компании» 29 сентября
Руководитель направления Codex в OpenAI Тибо Соттьё заявил, что DevDayi этого года станет самым значимым за всю историю компании. Конференция состоится 29 сентября в Сан-Франциско, открывающий кейноут покажут в прямом эфире.
Что именно представят, Соттьё не раскрыл, но прошлые DevDay задавали тон развитию продуктов OpenAI на год вперёд, поэтому анонс воспринимается как сигнал о крупных релизах.
Выпуск LoRA для Krea 2 Turbo

Perplexity представила инструмент для локального запуска ИИ-моделей Portable Computer
Alibaba тизерит Qwen3.8-Flash-Next — первую модель на архитектуре будущего Qwen-4
Китайская платформа Model Scopei (аналог Hugging Face в Китае) запустила обратный отсчёт до релиза модели Qwen3.8-Flash-Next. Это будет первая модель, построенная на архитектуре следующего поколения, на которой в дальнейшем будет основан и сам Qwen-4.
Деталей пока немного, но известно, что изменения затронут механизм внимания, residual-связиi, эмбеддинг-слоиi и оптимизацию модели — то есть речь о довольно глубокой архитектурной перестройке, а не о косметическом обновлении.
Оптимизация системных промптов через gisting: опыт Shopify
Google представила Gemini Enterprise for Legal для юристов

Запуск итерации V20 Curiosity Engine с GNN-оркестрацией
Mitigating Silent Expert Death in Ultra-Sparse MoE
Запуск локальной студии для обучения RL-моделей

Что такое RAGFlow и как он решает проблему нарезки документов
