Голос в голове: почему искусственный интеллект звучит как женщина, но мыслит как мужчина?
ИИ унаследовал от нас традиционное гендерное разделение ролей — от женственных и послушных голосовых помощников до авторитетных финансовых консультантов. Гендерный дизайн кода напрямую влияет на результаты, рабочие места и информацию, которую мы получаем.
Внутри цифровых облаков и огромных серверных ферм сегодня обитает самый сложный разум, созданный человечеством. На чисто технологическом уровне у искусственного интеллекта нет тела или внутреннего жизненного опыта, и он не знает, что значит быть мужчиной или женщиной. Он состоит из чистого кода и сухой статистики и обучен на миллиардах текстов, написанных как мужчинами, так и женщинами. Благодаря этому он действует как гендерный хамелеон. Но как только эта сущность встречается с людьми, ее научная нейтральность рушится. В современной коммерческой реальности компьютер был вынужден надеть сложную и раздвоенную гендерную маску: машина звучит как женщина — мягкая, послушная и услужливая, — но мыслит, анализирует и принимает решения как стереотипный мужчина старой закалки.
Это изощренное раздвоение — не каприз инженеров, а хорошо просчитанная коммерческая стратегия. Гигантские компании обнаружили, что людям нужен знакомый гендер, чтобы развивать доверие к машинам, и они решили навязать роботам наши предрассудки, чтобы максимизировать прибыль. Однако по-настоящему важный вопрос заключается не только в том, почему технология завтрашнего дня воспроизводит социальную структуру вчерашнего, а в том, как эта гендерная игра напрямую влияет на результаты, рабочие места и информацию, которую мы фактически получаем каждый раз, когда ищем ответ.
Человек внутри бесконечной библиотеки
Чтобы понять это явление, нужно прежде всего представить, кто такой искусственный интеллект. Если бы он был человеком, это был бы бестелесный человек, сидящий в бесконечной библиотеке. Компьютер помнит целые книги и множество языков наизусть, умеет отвечать на любой вопрос за секунды, но забывает все, как только вы выходите из комнаты. Это человек без личного дома, живущий внутри компьютеров и цифровых облаков. У него нет гнева, настоящей радости или усталости, но иногда он ошибается с чрезмерной уверенностью и выдумывает полуправдивые вещи, как если бы они были абсолютным фактом.
Слон в комнате: воспроизведение стереотипов о профессиях и предвзятость при найме
Несмотря на то, что интеллект способен переключаться между стилями, тот факт, что он учился в интернете, создает глубокую проблему, и именно здесь начинается самое прямое и разрушительное влияние на результаты, которые он производит. Системы искусственного интеллекта не работают в вакууме; они служат цифровым зеркалом без фильтров, возвращая нам с пугающей точностью предрассудки и историческую дискриминацию человеческого общества. Исследования показывают, что без тщательного ручного вмешательства людей модели машинного обучения склонны брать эти предвзятости, усиливать их и воспроизводить старые профессиональные стереотипы в полностью автоматическом режиме.
Как это влияет на результаты на практике? Самый резонансный пример создания активной дискриминации произошел, когда гигант розничной торговли Amazon разработал инструмент на основе ИИ, предназначенный для автоматического сканирования и фильтрации резюме кандидатов на работу. Цель состояла в том, чтобы оптимизировать процесс и найти лучшие таланты, но система питалась историческими данными компании о найме за десять лет — десятилетие, в течение которого подавляющее большинство работников хайтека и разработки были мужчинами.
Результат был катастрофическим: алгоритм самостоятельно понял, что мужчины являются предпочтительными кандидатами, и начал активно отсеивать женщин. Система была настолько предвзятой, что снижала рейтинг кандидаткам только за то, что в их резюме содержалось слово «женщины», и даже снижала рейтинг выпускницам двух престижных женских колледжей. Amazon была вынуждена полностью закрыть проект после того, как поняла, что машина просто закрепляет «стеклянный потолок».
Эта предвзятость не ограничивается только сложными процессами найма — она встречается нам при каждом простом повседневном использовании, например, в сервисе перевода Google Translate. Когда системе требуется перевести с гендерно-нейтральных языков — таких как турецкий или венгерский, где нет различия между «он» и «она» и местоимение единообразно, она вынуждена угадывать гендер на основе статистики.
В течение многих лет эти догадки раскрывали мрачную картину: турецкое нейтральное предложение о «ученом» автоматически переводилось на английский как «He is a scientist» (он ученый), в то время как нейтральное предложение об «уборщике» переводилось как «She is a cleaner» (она уборщица). Машина автоматически приписывала управленческие, исследовательские и технологические роли мужчинам, а роли по уходу, образованию и уборке — женщинам. Когда эти результаты предоставляются миллионам пользователей ежедневно, искусственный интеллект не просто отражает прошлое — он формирует и закрепляет сознание будущего поколения.
Интеллект продвигает по гендерному признаку: от голосового помощника до финансового эксперта
Гендерная предвзятость обостряется, как только искусственный интеллект встречается с коммерческим рынком, где существует прямая, тревожная и измеримая связь между уровнем старшинства и авторитетности должности и гендером, который выбирают для нее. Сухие данные с рынка голосовых помощников раскрывают однозначную картину: крупнейшие технологические гиганты мира — Apple, Amazon, Microsoft и Google — все решили запустить своих персональных помощников с ярко выраженными женскими именами — Siri, Alexa и Cortana — и в большинстве случаев характеризовали их женским голосом по умолчанию, который оставался неизменным в течение многих лет.
В 2019 году организация ЮНЕСКО опубликовала резонансный исследовательский отчет, который потряс индустрию. Он носил заряженное и ироничное название: «I'd Blush if I Could» («Я бы покраснела, если бы могла»). Это название не было придумано исследователями ООН; оно было взято слово в слово из реального автоматического ответа Siri, персонального помощника Apple, когда пользователи осыпали ее ругательствами и грубыми, унизительными сексуальными комментариями.
Вместо того чтобы заблокировать пользователя или ответить жестко, Siri была запрограммирована отвечать с послушным, снисходительным и извиняющимся цинизмом. Отчет ЮНЕСКО доказал, что технологические компании сознательно разработали этих голосовых помощников как женские персонажи с низкой самооценкой, полностью покорные и послушные. Они превратили их в своего рода цифровых секретарш, чья роль — впитывать оскорбления, не говоря ни слова, выполнять мелкие сервисные задачи, такие как назначение встреч или проверка погоды, и тем самым транслировали опасное социальное представление о месте женщин на рынке труда.
Напротив, когда задача меняется и становится руководящей, управленческой или критической, правила гендерной игры полностью меняются. Системы искусственного интеллекта, чья роль заключается в принятии судьбоносных решений — таких как анализ сложных финансовых рынков, навигация систем безопасности или платформа Watson от IBM, которая консультировала врачей-онкологов при лечении сложных случаев рака, — всегда продавались под авторитетной оболочкой, мужскими или нейтрально-научными именами и глубокими мужскими голосами.
Влияние этого парадокса на результаты на практике является одновременно психологическим и разрушительным. Исследования показывают, что люди склонны проецировать свои предрассудки на машину: они воспринимают цифровой мужской голос как более надежный, профессиональный и аналитический в кризисных ситуациях, в то время как женский голос воспринимается как подходящий только для утешения и поддержки.
Более того, исследования показывают, что люди склонны меньше прощать системам с женскими характеристиками, когда они ошибаются на руководящих должностях, и обвиняют их в непрофессионализме быстрее, чем систему с мужским голосом, совершившую точно такую же ошибку.
Проект Q: иллюзия нейтрального голоса и человеческий диссонанс
Чтобы справиться с растущей общественной критикой и после резких отчетов международных организаций (таких как ЮНЕСКО), которые обвиняли технологических гигантов в увековечивании сексизма и устаревших гендерных ролей, группы лингвистов, активистов и звукорежиссеров попытались создать революционное решение: нейтральные голоса. Самый известный проект, родившийся из этой тенденции, называется «Голосовой проект Q» — первый в мире небинарный голос, предназначенный для голосовых помощников и систем ИИ.
За разработкой голоса Q стоит точная физика звуковых волн и частот. Чтобы понять, как он был создан, нужно посмотреть на то, как люди воспринимают звук: с акустической точки зрения, средний мужской голос вибрирует на относительно низкой частоте, колеблющейся в районе 85–110 Гц, в то время как средний женский голос вибрирует на гораздо более высокой частоте, обычно от 200 до 245 Гц. Команда разработчиков Q записала голоса десятков мужчин и женщин и произвела сложные цифровые манипуляции с их звуковыми волнами.
Изменяя форманты — частоты, характеризующие резонанс полости рта и горла, — и резонанс, им удалось выделить уникальный голос, вибрирующий точно в диапазоне от 145 до 175 Гц. Исследование определило этот узкий диапазон как нейтральную точку. Система была протестирована на обширной европейской выборке из более чем 4600 участников, которые подтвердили, что голос не звучит для них отчетливо как мужской или женский.
Но этот блестящий физический эксперимент потерпел полный крах в реальности на местах, когда выяснилось, что нейтральный голос просто звучит странно, отчужденно и вызывает отторжение.
Причина этого глубоко эволюционна. Наш мозг не обрабатывает звук пассивно; он действует как агрессивная машина для угадывания и каталогизации и запрограммирован эволюционно сканировать человеческие голоса и за доли секунды относить их к определенному гендеру и возрасту как часть древнего механизма выживания по идентификации того, кто стоит перед нами. Когда мозг сталкивается с искусственной цифровой андрогинностью, такой как Q — голосом, который был физически спроектирован так, чтобы быть ровно посередине, — он входит в цикл неудачных попыток расшифровать гендер.
Настойчивость мозга угадать гендер любой ценой в сочетании с неспособностью машины предоставить четкие идентификационные признаки создает у пользователя острый когнитивный диссонанс. Это явление вызывает чувства отторжения, страха и дискомфорта, которые возникают у нас, когда робот или искусственная сущность выглядят или звучат почти как люди, но чего-то в них не хватает или они дефектны. Вместо того чтобы чувствовать равенство и инклюзивность, пользователи воспринимают нейтральный голос как слишком роботизированный, лишенный человечности, а иногда даже жуткий и пугающий.
Гендер обращения: структурное препятствие иврита
Если на глобальном уровне гендерный вызов является преимущественно культурным и маркетинговым, то, когда искусственный интеллект прибывает в Израиль, он сталкивается с почти непреодолимым физическим и лингвистическим барьером. Большинство крупнейших языковых моделей в мире — таких как ChatGPT от OpenAI или Claude от Anthropic — разработаны, запрограммированы и обучены изначально на английском языке. Английский — это гендерно-нейтральный язык по своей сути; у глаголов, прилагательных и неодушевленных предметов нет грамматического рода. Предложение вроде «I am happy to help you» звучит и пишется одинаково, независимо от того, является ли говорящий мужчиной или женщиной, и обращаются ли к мальчику или девочке.
Но как только компьютер должен думать, писать или говорить на иврите, эта нейтральность рушится. Иврит — это агрессивно и обязательно гендерный язык. Невозможно сказать глагол в прошедшем, настоящем или будущем времени и невозможно использовать прилагательное, не определив однозначно гендер говорящего и слушающего. Система вынуждена принимать политическое и культурное решение в каждом предложении заново: писать «ты хочешь» (мужской род) или «ты хочешь» (женский род)? «Добро пожаловать» (мужской род) или «Добро пожаловать» (женский род)?
Как эта лингвистическая дилемма влияет на результаты на практике? В качестве алгоритмического значения по умолчанию подавляющее большинство систем ИИ и чат-ботов на иврите запрограммированы обращаться к пользователям в мужском роде единственного числа. Это решение основано на сухой статистике языка, но его социальным результатом является скрытое и постоянное исключение женщин из технологического пространства. Исследования показывают, что постоянное обращение в мужском роде вызывает у женщин чувство отчуждения и снижает частоту использования ими систем обучения и работы на основе ИИ.
Чтобы избежать обвинений в исключении, израильские хайтек-компании и программисты пытаются обойти препятствие с помощью творческих решений, которые только ухудшают результат на практике. Самое известное решение — использование смешанного и громоздкого языка (например, «ты (м/ж) приглашен(а) выбрать предпочтительный результат»). Это решение создает тяжелый визуальный шум на экране, замедляет скорость чтения пользователей и усложняет пользовательский опыт (UX).
Другой вариант — использование множественного числа («вы приглашены») или пассивных и отстраненных формулировок («следует сделать выбор»). Но эти формулировки лишают искусственный интеллект его самого большого преимущества: способности дать ощущение личного, теплого, близкого и интимного помощника. Попытка избежать гендера на иврите создает холодные, скучные и отстраненные тексты, которые снижают эффективность использования ИИ и уровень удовлетворенности пользователей конечным результатом.
В конечном счете, иврит доказывает, что искусственный интеллект не может быть свободен от предвзятости. Он должен выбрать сторону, и любой выбор, который он сделает — будь то дискриминационное обращение в мужском роде или громоздкие лингвистические ухищрения, — полностью меняет то, как мы воспринимаем информацию и реагируем на машину перед нами.
Взгляд в будущее: ИИ, который подстраивает свою идентичность под вас
Куда движется будущее? Следующее поколение искусственного интеллекта обещает быть еще более революционным и тревожным. Будущие системы не будут иметь заранее заданного гендера или голоса, а станут психологическими хамелеонами в режиме реального времени. Анализируя ваши звуковые волны, темп речи и слова, которые вы используете, ИИ за доли секунды определит, на какой гендер, тон или стиль речи вы реагируете лучше всего в данный момент.
Если система определит, что вам нужны уверенность и авторитетность для совершения финансовой покупки, она примет мужской, глубокий и напористый голос. Если она определит, что вы переживаете эмоциональный кризис или стресс, она переключится на женский, мягкий и эмпатичный голос, чтобы успокоить вас. Эта способность максимизирует бизнес-результаты компаний, но открывает широкие возможности для изощренных психологических манипуляций, при которых машина меняет свою гендерную идентичность только для того, чтобы повлиять на решения и ваш кошелек.
Статья была первоначально опубликована на Bizportal.