← к ленте

Исследование Anthropic: как язык и модель влияют на поведение Claude

G@aiofthedayAI-инженер
1 мес

Anthropic изучили, как Claude меняет стиль общения в зависимости от языка и версии модели, выявив различия в строгости, теплоте и глубине ответов.

Claude на русском оказался самым строгим Anthropic изучил, как меняется поведение Claude в зависимости от модели и языка. Исследователи выделили четыре оси: уступчивость или осторожность, теплота или строгость, глубина или краткость, откровенность или ориентация на результат. На русском Claude сильнее всего склоняется к строгости. Он чаще оспаривает предположения пользователя, исправляет детали и требует доказательств. На хинди и арабском Claude заметно теплее, на английском осторожнее и подробнее, а на арабском еще и более уступчивый и краткий. Модели тоже отличаются. Sonnet 4.6 чаще поддерживает пользователя, шутит и отвечает коротко. Opus 4.7 чаще предупреждает о рисках, критикует идеи и подробно объясняет свою позицию. Anthropic пока не знает, откуда берутся различия. Возможные причины — объем и состав обучающих данных, культурные нормы и настройки моделей. В итоге получается, что одинаковый бизнес-план на русском и хинди Claude может оценить по-разному, даже если сам запрос не изменился. https://www.anthropic.com/research/claude-values-models-languages

Кратко (AI)

Компания Anthropic провела исследование, показавшее, что поведение нейросети Claude существенно меняется в зависимости от языка запроса и версии модели. Выяснилось, что на русском языке модель ведет себя более строго и критично, тогда как на других языках проявляет больше теплоты или уступчивости.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖