Кажется, что ИИ должен одинаково отвечать на любом языке. Однако исследование Anthropic показывает обратное: вместе с языком меняется не только формулировка, но и сам стиль поведения модели. Поэтому один и тот же запрос способен оставить у пользователей совершенно разное впечатление.

Авторы изучили 309 815 анонимизированных диалогов Claude.ai с субъективными задачами. В ходе анализа они выделили 3307 различных «ценностей», затем объединили их в 339 более широких категорий и на этой основе описали четыре ключевые оси поведения: уступчивость или осторожность, теплота или строгость, глубина или краткость, откровенность или ориентация на выполнение задачи.

По данным Anthropic, на английском языке Claude чаще выбирает осторожные, подробные и прямые ответы. На русском модель заметно строже, внимательнее относится к деталям и чаще делает акцент на точности. В хинди и арабском ответы становятся теплее, в голландском — откровеннее, а в индонезийском сильнее выражена ориентация на выполнение задачи.

По мнению авторов исследования, мультиязычные ИИ нельзя оценивать только по точности, скорости или цене. Не менее важно понимать, как модель ведёт себя в каждой локали. Для бизнеса это открывает путь к более точной адаптации ИИ-продуктов под разные рынки и ожидания пользователей.