Герман Греф обвинил Яндекс в использовании китайской модели Qwen для обучения YandexGPT, компания отрицает зависимость от внешних решений.
Глава Сбера, Герман Греф заявил, что Яндекс дообучает (китайский) Qwen,
и это не радует
По словам Грефа, только Сбер имеет ИИ, полностью разработанный в России:
Компания Яндекс сегодня дообучает Qwen — в основе лежит китайская модель. Конечно, нас это нисколько не радует, что мы одни, потому что мы за конкуренцию.
Яндекс отрицает эти обвинения:
Яндекс продолжает развивать собственные фундаментальные модели, сохраняет полный цикл разработки и не зависит от внешних решений.
Ряд медиа распространяют информацию, что Яндекс использовал веса (параметры) Qwen-2.5-32B-base для модели YandexGPT 5 Pro, после чего провел собственный полный цикл обучения на русскоязычных и иных данных. Если это правда, кто-нибудь может объяснить в комментариях, почему в качестве базовой не была взята модель на ~450B?
P.S. Я сравнивал онлайн-версии Алисы и GigaChat. По-моему мнению, обе отставали от Deepseek при решении прикладных задач, но GigaChat демонстрировал меньшее отставание.
Кратко (AI)
Герман Греф публично заявил, что Яндекс использует китайскую модель Qwen в качестве основы для своих разработок, что вызывает вопросы о независимости российских ИИ-решений. Яндекс официально опроверг эти обвинения, настаивая на использовании собственных фундаментальных моделей. В медиа обсуждается гипотеза о дообучении YandexGPT 5 Pro на базе весов Qwen-2.5-32B.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖