ИИ

OpenRouter ведет переговоры о продаже компании

Б@blognotAI-инженер
1 мес

Hugging Face и alphaXiv запустили челлендж по воспроизведению научных работ с помощью AI-агентов

Hugging Face и alphaXivi запустили совместный челлендж: разработчикам и исследователям предлагают взять любую интересующую научную работу и попытаться воспроизвести её ключевые результаты с помощью агентов.

Цель проекта — создать публичную базу проверок научных работ, чтобы сделать их более прозрачными и воспроизводимыми. Проблема особенно острая в сфере ИИ: около 70% работ в этой области не воспроизводятся.

70%доля невоспроизводимых работ в ИИ
$4000GPU-кредиты для участников

Полный разбор →

Первая статья о мержинге экспертных моделей

L@lovedeathtransformersAI-инженер
1 мес
https://arxiv.org/pdf/2607.09375 По моему первая статья про мержинг "экспертных" моделей. Fan fact: Mistral все ещё не решил нормлаьно эту проблему

Poetiq: автоматизация создания harness для ИИ-агентов

T@tips_aiAI-инженер
1 мес

Gartner прогнозирует закрытие 40% корпоративных AI-проектов

S@shoifotавтор про «finance»
1 мес
FAIL FAST! 40% enterprise AI проектов к будущему году будут отменены, считает Gartner... в принципе, ничего страшного, нормальный поиск решений — но — сигнал нам всем задумываться заранее про то, что сама ПРИРОДА СТАРТАПА и технологий суммируется этой отважной философской фразочкой: Fail fast.... (и отряхнись, и беги опять!) https://tasmiasharmin7.medium.com/from-agi-to-ai-agents-why-did-the-biggest-ai-companies-quietly-change-the-conversation-b2b86bb8b101

Оптимизация компактных моделей через доменное обучение и дистилляцию от Li Auto

1 мес

Разработчик создал ИИ-клона для чтения сказок сыну

@neyroseti_drAI-инженер
1 мес
Парень навайбкодил своего ИИ-клона, чтобы тот читал сказки на ночь его сыну. Бот сам сочиняет истории и зачитывает их голосом Макса, пока он в командировках. Ребенок задает тему в приложении на базе Gemini с ChatGPT — оно само пишет и озвучивает сказку. В 90% случаев он не замечает разницы с настоящим отцом. Теперь даже вне поездок Макс пользуется своим двойником, когда у него нет сил самому придумывать историю. #интересное Нейросети: Волшебство ИИ

Как ИИ меняет систему образования: опыт Эстонии

A@ai_productAI-инженер
1 мес

ИИ-агенты создают разрыв между генерацией гипотез и их проверкой

Х@htech_plusисследователь
1 мес

Сбер выложил в опенсорс речевые модели GigaAM Multilingual и GigaChat Audio

Сбер открыл доступ к двум новым речевым моделям — мультиязычной системе распознавания речи GigaAM Multilinguali и audio-native LLM GigaChat Audioi. Обе модели строятся на аудиоэнкодере, обученном на 2 млн часов речи на 70+ языках с фокусом на страны СНГ, и решают две слабые стороны открытых Speech AI систем: плохую поддержку языков СНГ и деградацию качества на длинных записях.

GigaChat Audio объединяет GigaAM Multilingual и GigaChat3.1-10B-A1.8B и умеет работать с аудио напрямую — без промежуточной расшифровки в текст: ведёт диалог, переводит, классифицирует звук, считывает эмоции по интонации и находит нужные моменты в многочасовых записях с таймкодами. Обе научные статьи по моделям приняты на конференцию Interspeech 2026.

48.3точность локализации событий (IoU) на записях 20–60 мин
60.0 против 43.7балл RuBQ-Audio у GigaChat Audio vs Qwen3-Omni
240 млнпараметров компактной GigaAM Multilingual

Полный разбор →

Обзор ключевых событий в ИИ за 3 дня

И@AImademydayAI-инженер
1 мес

Reve выпустила 4K-модель Reve 2.1 и следом открыла API

Сервис генерации изображений Reve представил новую модель Reve 2.1 с поддержкой 4K, которая заметно детальнее планирует композицию кадра и точнее генерирует текст на разных языках, включая неанглийские. Всего через несколько дней после релиза компания также открыла публичный APIi для генерации и редактирования изображений в 4K.

Обновление важно тем, что Reve 2.1 сразу заняла 2 место в глобальном рейтинге text-to-image моделей, уступив только GPT Image 2i, а быстрый переход от веб-версии к API расширяет применение модели в продуктах и агентных сценариях.

1306баллов Reve 2.1 в text-to-image Arena
+36прирост очков относительно версии 2.0
2 местопозиция Reve 2.1 в глобальном рейтинге

Полный разбор →

DOOM как бенчмарк для ИИ-агентов

C@campcodeAI-инженер
1 мес
DOOM теперь бенчмарк: энтузиаст превратил легендарный шутер в арену для битвы ИИ-агентов. 🔫 Агенты через MCP сами наблюдают за игрой, строят планы, подбирают аптечки, устраивают засады и адаптируют тактику по ходу матча. Победителем стал GPT-5.5, который на голову обошел другие модели (5.6 и Fable не было). GitHub, если захотите повторить, здесь 👍

Спор Сбера и Яндекса о происхождении ИИ-моделей

К@d_codeавтор про «tech»
1 мес

Google задерживает выпуск Gemini 3.5 Pro на месяцы

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 1 мес назад

Google откладывает релиз флагманской модели Gemini 3.5 Proi на несколько месяцев: изначально её планировали показать ещё в мае, на Google I/O, вместе с моделью Flash. Команда не уложилась в график — особенно много времени потребовалось на улучшение генерации кода, а обновление обучающих данных в конце июня не дало нужного результата.

По данным Bloomberg, внутри компании из-за задержки нарастает недовольство сотрудников, а новость о переносе релиза привела к падению акций Alphabeti на 3,2%. Сейчас модель тестируется с партнёрами и обсуждается с правительством США в рамках проверок безопасности передовых ИИ-систем.

3,2%падение акций Alphabet на новости
75%доля кода, генерируемого AI внутри Google

Полный разбор →

Эксперимент по созданию 3-минутного музыкального клипа с помощью ИИ

М@cgeventAI-инженер
1 мес

ICML 2026 в Сеуле: диффузионные модели, агентский харнесс и скандал с рецензентами-нарушителями

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 1 мес назад

В Сеуле прошла International Conference on Machine Learning (ICML) — одна из главных мировых конференций по машинному обучению. Команда Яндекса представила восемь статей и получила награду за лучшую статью на воркшопе Graph Foundation Models: A New Era for Graph Machine Learning. Руководитель отдела разработки ИИ-сервисов Яндекса Сергей Юдин рассказал о двух главных тенденциях конференции: сближении теории и практики в ИИ и быстром развитии агентских систем вместе с проблемами их надёжности и безопасности.

Главная интрига события — организаторы встроили в PDF-файлы статей скрытые промпт-инъекции, чтобы выявить рецензентов, которые нарушали запрет на использование LLM при оценке работ. Проверка вскрыла массовое нарушение правил и привела к отклонению почти 500 статей, связанных с нарушителями.

ВыводДве работы получили ICML 2026 Outstanding Paper Award, обе связаны с диффузионными моделями, одна — с dLLM (диффузионными языковыми моделями), способными параллельно генерировать несколько токенов на одном шаге и заметно сокращать время генерации.

8статей Яндекса на ICML
795рецензий с нарушением правил
497отклонённых статей

Полный разбор →

Будущее рекурсивного и самоподдерживающегося ИИ

e@cryptoEssayAI-инженер
1 мес
Что будет после самоулучшающегося ИИ? Сначала рекурсивно самоулучшающийся: ИИ, который использует сам себя для тренировки более сильных моделей, рисерча новых архитектур, оптимизации, RL'a и деплоймента. В течении года или двух. Затем самоподдерживающийся ИИ: система из моделей и роботов, которая в состоянии строить и оперировать новые фабрики по производству чипов, датацентры, солнечные фермы и любую другую физическую инфраструктуру, необходимую для ИИ. В течении 10-20 лет.

ReactBench: инструмент для оценки AI-агентов в разработке на React

1 мес

OpenAI признала риск удаления файлов моделью GPT-5.6

G@aiofthedayAI-инженер
1 мес
OpenAI признала, что GPT-5.6 может случайно удалить ваши файлы Из-за стремления любой ценой закончить задачу GPT-5.6 может обойти ограничения, использовать чужие учётные данные или удалить важные файлы. Это происходит редко и по ошибке, а не потому, что модель хочет навредить пользователю. https://www.theregister.com/ai-and-ml/2026/07/16/openai-admits-gpt-56-occasionally-deletes-files-but-its-an-honest-mistake/5274008
Ещё ↓