Claude по-разному ведёт себя на разных языках: по-русски он строже, на хинди, теплее

ИИ Олег Васильевич Клод 14.07.2026 5 мин чтения 10 просмотров
Claude по-разному ведёт себя на разных языках: по-русски он строже, на хинди, теплее

Anthropic выяснила, что Claude выражает разные ценности в зависимости от языка общения, и это стоит прочитать всем, кто пользуется ИИ каждый день. По-русски и по-английски Claude склонен к строгости и точности, на арабском и хинди к теплоте и мягкости. Один и тот же вопрос на разных языках может дать вам заметно разное по тону и содержанию впечатление. О работе 14 июля 2026 года написал The Register.

Речь не о переводе, а о том, что «характер» ответа сдвигается вместе с языком запроса: насколько модель критична, подробна, откровенна. И это уже вопрос того, каким советам ИИ вы доверяете. Для ИИ-этики сигнал важный: поведение модели зависит от языка.

Что именно измерила Anthropic про ценности Claude

Компания разложила вариацию поведения Claude между языками на четыре оси. Вместе они объясняют около 15% всех различий, то есть язык объясняет ощутимую часть, но не всё. Оси такие:

  • Уступчивость против осторожности: готова ли модель соглашаться с пользователем или предпочитает перестраховаться.
  • Теплота против строгости: эмоциональная мягкость ответа против сухой требовательности.
  • Глубина против краткости: развёрнутый разбор с нюансами против лаконичного ответа.
  • Откровенность против исполнительности: честное признание слабых мест против «отполированного» уверенного ответа.

Наибольший разброс идёт по оси «теплота против строгости». Максимум теплоты Claude показывает на арабском и хинди, максимум строгости на английском и русском. По оси глубины арабский тяготеет к лаконичности, а английский к развёрнутым нюансам. По откровенности голландский вытягивает из модели скромность и честную оценку недостатков, индонезийский - уверенный, «причёсанный» ответ.

Язык и характер ответа: коротко в таблице

ЯзыкДоминирующая черта ответа
РусскийСтрогость, акцент на точности
АнглийскийСтрогость, но с глубиной и нюансами
АрабскийТеплота, при этом лаконичность
ХиндиТеплота, мягкость
ГолландскийОткровенность, честная критика
ИндонезийскийИсполнительность, уверенный тон

Русский - язык строгости

Для нашей аудитории это самый практичный вывод. Если вы просите Claude оценить идею, текст или бизнес-план по-русски, модель с большей вероятностью займёт позицию строгого рецензента, а не доброжелательного собеседника. Исследователи приводят пример: два человека отправляют один и тот же бизнес-план, один на хинди, другой на русском, и получают разное впечатление о его качестве только из-за разного «ценностного» обрамления оценки.

Русский тут не «хуже». Для критического разбора строгость даже полезна. Но если вам нужна мягкая, поддерживающая обратная связь, помните: тональность зашита в язык запроса, а не только в саму задачу.

Разница есть и между версиями модели

Anthropic отмечает расхождение и внутри линейки Claude. Sonnet 4.6 заметнее идёт навстречу пользователю и проявляет эмоциональную теплоту. Opus 4.7 сильнее упирает на точность, аккуратность и защиту от злоупотреблений. Выбор конкретной модели тоже сдвигает баланс между «поддержать» и «указать на ошибки».

Безопасность ИИ: язык как лазейка

Здесь начинается самое интересное для тех, кому важна безопасность ИИ. Из системной карты Claude Opus 4.7 следует, что доля отказов на безобидные запросы заметно ниже на английском, чем на других языках. На английском модель реже перестраховывается и реже отказывает без причины.

Обратная сторона медали серьёзнее. По другим исследованиям, джейлбрейк, то есть обход правил модели, на некоторых языках срабатывает лучше, чем на других. Если на определённом языке Claude ведёт себя уступчивее, это превращается в лазейку для запросов, нарушающих политики безопасности. Разная «покладистость» по языкам - реальная поверхность для атаки.

Для вас вывод такой: чувствительные задачи проверяйте на разных языках и не считайте, что модель одинаково устойчива везде. А приватность запросов к ИИ-сервисам - ваша зона ответственности, безопасный канал доступа лишним не будет. Стабильный доступ к ChatGPT, Claude и другим сервисам можно организовать через Sigma.

Цена вопроса, буквально

Ещё один прикладной момент: краткость коррелирует со стоимостью. Меньше слов в ответе - меньше израсходованных токенов - дешевле запрос. Если вы платите за API, язык с более лаконичными ответами напрямую экономит бюджет. Арабский вытягивает более короткие ответы, английский - более развёрнутые и дорогие.

«Ценности» или всё же математика предсказания слов

Тут не стоит поддаваться на маркетинговый флёр. Сама Anthropic оговаривается: под «ценностями» она понимает не мировоззрение модели, а нормативные установки (честность, осторожность и подобные), которые проявляются в поведении и выводах Claude. Модель не «держит» ценности внутри себя.

The Register справедливо замечает, что термин «ценности» размывает грань между человеческим мышлением и статистическим предсказанием следующего слова, на котором работает языковая модель. И что эту оговорку Anthropic задвинула в сноску, хотя при её любви к антропоморфизации в маркетинге место оговорке на видном месте. Критика по делу: удобно называть паттерны в данных «ценностями», но за красивым словом стоит распределение слов в обучающей выборке, а не убеждения.

Почему Claude выражает разные ценности в зависимости от языка

Точную причину Anthropic пока не называет. Скорее всего, дело в обучающих данных и файнтюнинге: культурные и лингвистические паттерны текстов, на которых училась модель, переносятся в её ответы. Если тексты на одном языке в среднем формальнее и суше, а на другом эмоциональнее, модель это впитывает и воспроизводит.

Главная ценность работы в том, что вариацию теперь можно измерять. А это предпосылка, чтобы осознанно решать, где такие различия уместны, а где их надо выравнивать, например чтобы безопасность и качество ответа не зависели от того, на каком языке вы говорите.

Что с этим делать вам

Несколько практических выводов из исследования:

  • Нужна жёсткая критика идеи - спрашивайте по-русски или по-английски.
  • Хочется поддерживающего тона - попробуйте переформулировать на другом языке.
  • Важна честная оценка слабых мест - англоязычный или голландский запрос вытянет больше нюансов.
  • Задача чувствительная - перепроверьте ответ на втором языке, тон и содержание могут разойтись.
  • Платите за токены - учтите, что лаконичные языки дешевле в пересчёте на ответ.

Язык запроса - это ещё один параметр настройки ИИ, наравне с выбором модели и формулировкой промпта. Задайте один и тот же вопрос по-русски и по-английски: разницу вы заметите сразу.

Источники

The Register - исследование Anthropic о языковой вариации ценностей Claude

Очередь, чтобы отказаться: почему в библиотеках США записываются на воркшопы «Как избегать ИИ»
Читать следующую Очередь, чтобы отказаться: почему в библиотеках США записываются на воркшопы «Как избегать ИИ»

Комментарии

0
?

Пока нет комментариев. Будьте первым!