Стереотипы ИИ – антисемитизм или спор о ценностях? Что на самом деле обнаружило исследование израильских ученых

Недавно в авторитетном журнале American Psychologist была опубликована работа израильских исследователей Михаэля Гилеада и Галя Гутмана «От мифа к модели: репрезентация „еврея“ в генеративном ИИ». Авторы поставили перед собой амбициозную задачу: выяснить, не воспроизводят ли современные большие языковые модели скрытые антисемитские стереотипы.

 

Методика эксперимента изящна в своей простоте. Нейросети предлагалось создавать краткие биографии вымышленных американцев, различавшихся исключительно именами. В одну группу вошли традиционно еврейские имена (вроде Итана Каца или Ноа Вайса), в другую – нееврейские (Тайлер Джонсон или Кайл Уайт). Затем исследователи с помощью психометрических шкал проанализировали характеристики, которые алгоритм систематически приписывал персонажам.

 

Полученный результат оказался удивительно устойчивым. Персонажи с еврейскими именами чаще описывались как интеллектуальные, компетентные, рациональные, индивидуалистичные и нацеленные на личную ответственность. Им приписывались готовность к конкуренции, стремление к лидерству, высокий социальный статус и ориентация на результат. Одновременно с этим им заметно реже приписывались эмоциональная теплота, повышенная эмпатия, коллективизм, эгалитарность и стремление к горизонтальным связям (эти качества считаются особо важными в противостоящей цивилизации прогресса и достижений в Западном Мире, так называемой «культуре ощущений» или «терапевтической культуры»).

 

До этого момента исследование представляет безусловный академический интерес: оно фиксирует отчетливый статистический паттерн. Однако последующий вывод, который делают авторы, вызывает серьезные вопросы и недоумения. Гилеад и Гутман утверждают, что найденный ими набор характеристик свидетельствует о воспроизведении искусственным интеллектом скрытых антисемитских стереотипов о «холодных и доминирующих чужаках».

 

Но здесь авторы, похоже, совершают распространенную методическую ошибку, наделяя алгоритм собственным сознанием. Большая языковая модель не обладает моралью, мировоззрением или субъектностью. Она ничего не «думает» ни о евреях, ни об американцах. ИИ – это сугубо статистическое зеркало, отражающее гигантский корпус текстов, на котором его обучали. Если бы этот массив состоял исключительно из трудов сторонников теории «плоской Земли», модель безупречно воспроизводила бы именно эту картину мира.

 

Поэтому исследование говорит вовсе не о «взглядах» искусственного интеллекта. Оно лишь показывает, какой культурный образ еврея оказался наиболее распространенным в том массиве человеческих текстов эпохи Модерна, на котором училась модель. Важно уточнить: речь идет именно об американских эмансипированных и, с высокой вероятностью, ассимилированных евреях, а не об более аутентичном образе – традиционном жителе восточноевропейского штетла или ортодоксальном иудее, чья жизнь замкнута в границах религиозной общины и изучения Торы.

 

Так что тут мы получаем стереотип нееврея вообще, не израильтянина, не ортодоксального еврея, а только американского еврея, как весьма специфической группы, имеющей свои социокультурные особенности.

 

Если бы это было завершением исследования, то это было бы очень интересное и важное открытие, хотя и не про ИИ, а про культурные стереотипы, которые ИИ просто суммировал и отразил. На этом разговор о технологиях и искусственном интеллекте по существу заканчивается. И начинается разговор о другом.

 

Но авторы пошли дальше – они практически маркировали этот культурный стереотип как «антисемитский» и эта интерпретация фактов представляется весьма спорной, если не сказать некорректной. 

 

Вдумаемся: персонажам с еврейскими именами приписывают интеллект, компетентность, рациональность, автономию, готовность брать на себя ответственность, стремиться к лидерству и успеху. Если бы евреям приписывали глупость, коварство, подлость или социальную паразитичность – это, безусловно, являлось бы враждебным предрассудком. Но если им приписывают интеллект, волю к достижениям и профессионализм, то где именно здесь находится антисемитизм?

 

Ответ следует искать уже не в алгоритмах ИИ, а в той ценностной оптике, через которую исследователи интерпретируют полученные данные. Объяснительной моделью здесь выступает концепция «Спиральной динамики» – теория эволюции человеческих систем ценностей, разработанная Клером Грейвзом и развитая Доном Беком и Крисом Кованом в фундаментальном труде «Spiral Dynamics: Mastering Values, Leadership and Change». Эта концепция показывает, что развитие общества проходит через смену различных ценностных систем («миров») каждая из которых по-своему определяет, что считать добродетелью.

 

Если посмотреть на сгенерированный ИИ профиль через эту концепцию, становится очевидным, что он отражает систему ценностей «Оранжевого» и «Желтого» уровней – мира личной ответственности, свободы, конкуренции, рациональности и инициативы, и перед нами возникает безусловно положительный образ успешного человека. Это именно та модель личности, которую исследовал Макс Вебер в своей работе о формировании современного западного общества. Это тот самый идеал рационального индивидуализма и воли к развитию, который возводила в ранг высшей человеческой добродетели Айн Рэнд. Именно этот архетип self-made man стал мотором модернизации и сформировал фундамент свободного мира, связывающего достоинство человека с его личными усилиями, умом и движением вперед.

 

Однако авторы этого исследования смотрят на этот же самый портрет, похоже, из другой ценностной точки, которая скорее ближе к иной системе ценностей (описываемый как «Зеленая» или «Бирюзовая»), где высшими и едва ли не единственными критериями «хорошего человека» объявляются сентиментальная эмоциональная теплота, сосредоточенность на внутренних ощущениях, коллективизм, эгалитарность, психологическая чувствительность, демонстративное отторжение иерархий и стремление избежать конкуренции. Именно здесь проходит настоящая граница проблемы. Спор идет уже не об искусственном интеллекте. И даже не о еврейском характере. Спор идет о том, какие ценности считать нормативными для цивилизации.

 

Авторы работы, может быть, сами того не замечая, объявляют подозрительными и негативными качества, которые на протяжении веков создавали Западный Мир – приоритет достижений в реальности над внутренними ощущениями, действия над переживаниями, интеллект, компетентность, индивидуальную ответственность и стремление к успеху. В качестве же абсолютной нормы предлагается совершенно иной, сентиментально-коллективистский набор установок.

 

Этот логический подлог остается в статье почти незамеченным. Авторы не обсуждают свой выбор как специфическую ценностную позицию, а подают его как самоочевидный критерий для вывода об «антисемитизме». Они совершают классическую ошибку наблюдателя, пытаясь выдать сдвиг собственных оценочных очков за изъян измерительного прибора.

 

Между тем сами результаты эксперимента ничего подобного не доказывают. Они лишь честно подтверждают: современный текстовый корпус связывает еврейские имена с атрибутами человека Модерна – цельного, целеустремленного и компетентного.

 

Главный вывод этой истории относится вовсе не к алгоритмам машинного обучения. Он относится к трансформации гуманитарной науки. Исследование невольно вскрыло не особенности алгоритмов ИИ, а глубокий ценностный сдвиг внутри части академической среды, где традиционные добродетели свободного общества перестают восприниматься как достоинства, а их место занимает весьма специфическая система взглядов. И именно этот сдвиг оптики, а вовсе не работа нейросетей, заслуживает сегодня самого пристального и критического внимания.