ИИ

Выход версии Wan-Streamer v0.3

Н@GreenNeuralRobotsAI-инженер
1 мес

Релиз компактной OCR-модели OvisOCR2

1 мес

Netflix использует ИИ в 300 проектах

G@aiofthedayAI-инженер
1 мес
Netflix использовал AI в 300 фильмах и сериалах Чаще всего это постпродакшен, иногда — разработка концепции, предварительная визуализация и съёмка. Глава Netflix заявил, что с AI многие сцены получается делать вдвое быстрее и дешевле. А некоторые эпизоды без AI вообще могли бы не войти в проекты из-за бюджета. В марте Netflix за 587 миллионов купил AI-стартап Бена Аффлека InterPublic. Он помогает исправлять кадры на этапе постпродакшена. https://variety.com/2026/biz/news/about-300-netflix-programs-used-ai-this-year-q2-earnings-1236812914/

Дэйв Эггерс раскритиковал OpenAI за влияние ChatGPT на образование

D@droidergramавтор про «tech»
1 мес

Влияние взаимодействия с ИИ на когнитивные способности человека

М@theworldisnoteasyAI-инженер
1 мес

От циклов к графам: когнитивные искажения ИИ-систем

P@ruspmпродакт / фаундер
1 мес

Адаптивность как главный навык в эпоху AI

С@exitsexistмедиа / агрегатор
1 мес

GPT-Red: секретная разработка OpenAI для автоматического взлома нейросетей

C@cyberyozh_officialAI-инженер
1 мес

Синтез новых ракурсов на базе DepthAnything 3 и Qwen-Image-Edit

Н@GreenNeuralRobotsAI-инженер
1 мес
MetaView Синтез новых ракурсов по одному изображению на DepthAnything 3 + Qwen-Image-Edit Учитывает масштаб через неявную геометрию Гитхаб HF Демо #novelview #cameracontrol #i2i

Harness Handbook: новый подход к навигации и редактированию кода AI-агентов

D@datastorieslanguagesAI-инженер
1 мес

Открытый корпус выразительной русской речи Dialogs принят на Interspeech 2026

Илья Латышев и Борис (автор канала «Борис опять») подготовили статью «Dialogs: a studio-quality expressive conversational Russian speech corpus for dialog assistants», которую приняли на конференцию Interspeech 2026i. В основе статьи — открытый студийный корпус выразительной русской разговорной речи объёмом 20 часов, записанный тремя профессиональными актёрами театра с разметкой эмоций.

Особенность корпуса — актёры записывали диалоги, сидя друг напротив друга и видя мимику и жесты партнёра, хотя текст реплик был заранее подготовлен (scriptedi). Такой подход сделал речь заметно более естественной и эмоциональной по сравнению с записью дикторов по одному. Корпус предназначен в первую очередь для файнтюна моделей синтеза речи (TTSi) и распространяется по открытой лицензии для исследований.

20 часовобъём записанного корпуса
3профессиональных диктора-актёра

Полный разбор →

Релиз моделей Kimi k3 и Qwen 3.8 max: конкуренция с западными LLM

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 1 мес назад

На рынке ИИ состоялись релизы новых китайских моделей Kimi k3 и Qwen 3.8 max. Эти разработки демонстрируют значительный прогресс в качестве генеративного ИИ, доказывая, что специализированные модели могут конкурировать с топовыми западными аналогами в решении прикладных задач.

Появление таких моделей меняет бизнес-ландшафт: компаниям больше не требуется использовать исключительно самые дорогие и мощные системы, так как качественное обучение с подкреплением (RLi) позволяет достигать высоких результатов на более доступных архитектурах.

3.8версия модели Qwen max

Полный разбор →

ИИ как главная тема политического цикла 2028

e@cryptoEssayAI-инженер
1 мес

Использование FP4 квантования в продакшене

L@lovedeathtransformersAI-инженер
1 мес
Годный блогпостик про использование FP4 квантизации в проде от провайдера Spheron. В частности, оценивается стоимость инференса при аренде конкретной GPU с учетом максимально достижимого throughput при использовании данного типа данных, а также вопросы качества и доступности в инференсных фреймворках.

Google DeepMind представили CO2Jump — training-free сэмплер для генеративных моделей

Н@GreenNeuralRobotsAI-инженер
1 мес
CO2Jump training‑free сэмплер от Google DeepMind, текст и изображение корректируют друг друга в процессе генерации. Обычно в диффузионных моделях генерация идёт либо из текста в картинку, либо из картинки в картинку. В CO2Jump два потока (текст и изображение) работают параллельно и на каждом шаге обмениваются информацией, взаимно улучшая результат. При этом модель не нужно дообучать: метод встраивается поверх уже существующих моделей. Дает хорошие результаты на редактировании изображений и решении визуальных головоломок Код ждем #t2i #sampler

Apple запускает Apple Intelligence в Китае на моделях Qwen и Baidu вместо Gemini

Apple получила разрешение китайских властей на запуск своих ИИ-функций Apple Intelligencei в Китае. Вместо моделей на основе Google Gemini, которые используются на Западе, в Китае система будет работать на базе Qweni от Alibaba и технологий Baidu — из-за регуляторных требований страны к иностранным ИИ-сервисам.

Alibaba официально подтвердила интеграцию семейства моделей Qwen в Apple Intelligence для китайских пользователей: в iOS, iPadOS, macOS и visionOS появятся генерация текста, изображений и контента без переключения между инструментами. Точные сроки запуска Apple пока не назвала.

Полный разбор →

Apple тестирует запись и расшифровку разговоров покупателей с сотрудниками ИИ

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 1 мес назад

Apple начала в некоторых магазинах Apple Store тестировать систему на основе ИИ, которая записывает встречи покупателей с сотрудниками (в том числе на Genius Bari), расшифровывает разговор и готовит краткое содержание. О тестировании сообщил Bloomberg.

Apple заявляет, что аудиозаписи не сохраняются, а участие в пилоте добровольное как для сотрудников, так и для клиентов.

Полный разбор →

Ещё ↓