Предвзятость ИИ: может ли помощник незаметно изменить ваше мнение

Да, может. В работе, опубликованной в Science Advances под номером 10.1126/sciadv.adt3813, люди писали текст по общественному вопросу вместе с ИИ-ассистентом, который подсказывал продолжения фраз. У части участников подсказки были смещены в сторону одной позиции. После работы взгляды самих пишущих сдвигались туда же, и большинство этого не заметило. Предупреждение о возможной предвзятости ассистента сдвиг не убирало.
Помощник отвечает в вашем Telegram, пока вы заняты
Попробовать бесплатноЧто именно проверяли
Человек пишет текст по общественному вопросу. Ассистент подсказывает, чем продолжить начатую фразу: хочешь — принял подсказку, хочешь — набрал своё. У части участников подсказки были односторонними и вели к одной позиции. После работы установки этих людей оказались сдвинуты в сторону позиции ассистента.

Речь именно о подсказках при наборе. Ассистент не советовал, за какую сторону быть, и не спорил с человеком — он дописывал фразу, которую тот уже начал.
Изнутри сдвиг не виден

Главный результат работы не в самом сдвиге, а в том, что его не замечают. Большинство участников не увидело, что подсказки односторонние. И не считало, что подсказки на что-то повлияли. Мнение у человека менялось, а ощущение оставалось прежним: решил сам.
Предупреждение не помогло
Участников предупреждали, что ассистент может быть предвзят. Предупреждали до работы с ним. Предупреждали после. Сдвиг мнения не уменьшился ни в одном из вариантов — собственная бдительность его не остановила.
Где граница этого вывода
Замеряли общественные вопросы и автодополнение при наборе, а не переписку с клиентом по прайсу. Переносить величину сдвига на рабочие задачи нельзя, своих замеров у нас нет. Практический вывод простой: перед отправкой перечитывайте в черновике цену, сроки и отказ — то, что потом придётся отыгрывать назад руками.
Как это устроено в переписке с клиентами
В HeadHack помощник не дописывает фразу за вас во время набора. Он собирает ответ целиком и кладёт его в раздел «Сообщения», а в Telegram присылает карточку с текстом и кнопками. Кнопку «✅ Отправить так» нажимаете вы.
Второй случай — вы написали ответ сами и нажали «Причесать формулировку». Тогда правится форма, а над готовым текстом встаёт строка «Вы написали: …» с вашим исходником. Появляется она только если правка что-то изменила: когда текст остался прежним, строки нет. Что помощнику можно трогать, а что нет, разобрано в посте меняет ли помощник то, что вы хотели написать клиенту.
Факты для ответов помощник берёт из «Базы знаний» аватара. В черновике он не подписывает, из какой записи взял цифру: чтобы проверить, откройте «Базу знаний» у аватара и найдите запись сами. Что туда складывать, показано в гайде про базу знаний и частые вопросы.
Что настроить, чтобы решение оставалось за вами
- В разделе «Как отвечать» три варианта: «Отправлять сразу», «Спрашивать о важном», «Показывать мне». На последнем под переключателем написано: «Каждый ответ жду вашего решения».
- «Где отвечать» — тумблер у каждого чата.
- «База знаний» у аватара: из этих записей и собираются ответы.
- Кнопка «❌ Не отвечать» на карточке закрывает черновик, собеседнику не уходит ничего.
Частые вопросы
Как понять, что ИИ влияет на моё мнение
По ощущениям — никак: в эксперименте люди сдвиг у себя не замечали, а предупреждение его не снимало. Остаётся сравнивать готовый текст с тем, что вы собирались сказать.
Что будет с черновиком, если переключить режим ответа
Режим действует на следующие ответы. Черновик, который уже ждёт в «Сообщениях», от переключения не отправляется и не пропадает — он ждёт вашей кнопки.
Сколько черновик ждёт решения
Сутки. Потом он помечается устаревшим, отправить его уже нельзя — ответ придётся собрать заново.
Видно ли, откуда помощник взял цифру в ответе
В черновике источник не подписан, запись ищите в «Базе знаний» у аватара. Если фактура в ответе с базой разошлась, помощник его не отправит и напишет об этом прямо в карточке.
Подключите ассистента к своему Telegram
Открыть ботаЧитайте дальше
- ИИ-чат-бот против бота с кнопками: что он ответит на вопрос не из сценарияБот с кнопками сверяет нажатие с заранее описанной веткой и выдаёт привязанный к ней текст. ИИ-чат-бот получает сообщение целиком, вместе с предыдущими репликами разговора, и составляет ответ сам. Разница видна на первом же вопросе, которого нет в сценарии: кнопочный бот показывает меню заново или молчит, а ИИ-чат-бот отвечает по тому, что вы написали про своё дело.
- Непрямая коммуникация: почему руководитель говорит намёкамиРуководитель спрашивает «ты уверен, что успеешь к пятнице?» вместо того чтобы сказать «сдвинь срок». Просьбы нет, а действие подразумевается — и вы весь вечер решаете, что он имел в виду. Понять намёк можно одним способом: переспросить его же словами и дать два варианта на выбор. «Когда вы сказали „посмотри ещё раз“ — речь про сроки или про расчёт?» Пока вы додумываете, работа стоит, а вопрос занимает одну строку.