Проверка ответов ИИ: можно ли доверять тому, что пишет чат-бот

Доверять можно тому, что удалось проверить. В эксперименте с 477 участниками более разговорный, человечный стиль ответов ИИ-ассистента повышал доверие людей к дезинформации, которую он выдавал: приятная формулировка сама по себе ничего не говорит о правдивости. Проверять в ответе нужно то, у чего есть источник, — суммы, ссылки, контакты и обещания.
Помощник отвечает в вашем Telegram, пока вы заняты
Попробовать бесплатноВ HeadHack этот шаг стоит перед отправкой. Прежде чем ответ уйдёт собеседнику, помощник ищет каждую названную сумму, ссылку и контакт в базе знаний, в загруженных документах и в самой переписке. Не нашёл — ответ не уходит, а остаётся черновиком и ждёт вашего решения.
Почему приятному ответу верят больше, чем точному

Работа из Journal of Computer-Mediated Communication: 477 человек переписывались с ИИ-ассистентом, который среди прочего выдавал дезинформацию. Части участников он отвечал в более разговорной, человечной манере. У них доверие к этой дезинформации оказалось выше.
Развилка для владельца бизнеса тут неприятная. Тон ответа и его правдивость между собой не связаны, а внимание читает их вместе: чем теплее звучит фраза, тем меньше хочется её перепроверять. Тон помощника вы настраиваете сами — в разделе «Стиль и длина ответов». Чем мягче выбран, тем реже собеседник усомнится в написанном.

Что меняет сама возможность проверить ответ
Второй результат той же работы. Когда у человека была возможность проверить ответ, воспринимаемая достоверность сказанного ИИ снижалась — даже при разговорном стиле общения. Сильнее всего это работало там, где проверка была обязательной, а не добровольной. Значит, спасает не подозрительность к тону: спасает шаг проверки, мимо которого не пройти.
Что помощник сверяет сам до отправки ответа
Источников у сверки несколько: база знаний, факты профиля, извлечённый текст документов, системная инструкция и вся история этого диалога. В готовом ответе проверяются суммы, ссылки и контакты — телефон и адрес почты.
Сверка простая. Текст сравнивается со словами из источников, помощника второй раз ни о чём не спрашивают, поэтому проверка ничего не стоит и ответ из-за неё не ждёт ни секунды. Умеет она ровно одно: убедиться, что цифры, ссылки и контакты откуда-то взяты. Смысл и тон остаются на совести модели — гладко изложенную глупость сверка пропустит.
Спорные случаи трактуются в пользу отправки: ложная тревога останавливает нормальный ответ и заставляет вас читать то, что читать не нужно. Поэтому цепочку из десяти цифр и длиннее суммой не считают вовсе — зарплату так не пишут. Но если это телефон или почта, их сверяют отдельно, и ответ с незнакомым номером собеседнику не уйдёт.
Переписка — такой же источник, что и база знаний: вилку, сроки и свой телефон чаще называет сам собеседник, и повторить его слова нормально. Отсюда и граница. Пока база знаний пуста, сверять остаётся только с тем, что сказал собеседник, — цену из вашего прайса помощник подтвердить не сможет и ответ с ней остановит. Из чего собирается база знаний — отдельный разговор, но начинать стоит с неё.
Что происходит, когда фактура не сошлась
Ответ не уходит. Он становится черновиком, а вы получаете карточку с причиной: «в ответе сумма „…“, которой нет ни в базе знаний, ни в переписке». То же самое для ссылки и для контакта. В шторке уведомлений заголовок короче — «Ответ остановлен: фактура не сошлась». Решение ждёт сутки, дальше черновик устаревает и собеседнику не уходит ничего; сколько черновик ждёт и что бывает потом.
Отдельно про деньги. Названная сумма — обещание от вашего лица, поэтому ответ с деньгами считается ответственным даже тогда, когда сумма честно взята из базы. В режиме «Спрашивать о важном» такой ответ ждёт вас. Туда же попадают отказ и отправка резюме: отказ закрывает разговор, а в резюме лежат личные данные, и отправленный файл уже не отозвать.
Как понять, можно ли уже доверять автопилоту
Настройки → Аватары → карточка аватара → «Как я справляюсь». Семь строк за всё время: сколько ответов ушло само, сколько остановлено на сверке, сколько помощник спросил о важном, сколько показал по вашей просьбе, сколько вы отправили как есть, сколько поправили и сколько отменили. Сверху — доля отправленных без правок среди просмотренных. От 80% там написано «можно доверить больше», ниже — «пока присматривайте».
Считается эта доля только по тому, что вы смотрели, поэтому вначале она скачет: при пяти просмотренных ответах одна отмена двигает процент сразу на 20 пунктов. Первую неделю ответы всё равно придётся читать — и цифра к концу недели наберётся честная.
Что проверять в ответе ИИ самому
- Цифры: цены, сроки, проценты, размеры скидки. У каждой должен быть источник, который вы можете открыть прямо сейчас.
- Ссылки. Открываются, ведут туда, куда обещано.
- Контакты — номер и почта. Один неверный знак, и человек не дозвонится.
- Обещания от вашего лица: что именно обещано и к какому числу. Это вам выполнять.
- Чем теплее и человечнее звучит ответ, тем внимательнее проверяйте фактуру. Стиль работает против бдительности — ровно это и показало исследование.
Посмотреть на всё это можно до того, как помощник заговорит с клиентами. Настройки → «Проверить ответ»: пишете входящее от лица клиента и получаете настоящий ответ, без отправки. Что прогнать перед запуском — там разобран порядок. Подключиться можно в @Head_Hack_bot.
Вопросы про проверку ответов ИИ
Можно ли доверять тому, что пишет чат-бот
Доверять стоит проверяемой части ответа. В эксперименте с 477 участниками человечный, разговорный стиль ответов ИИ повышал доверие к дезинформации, которую тот выдавал, а возможность проверить ответ это доверие снижала. Поэтому смотрите не на тон, а на цифры, ссылки и контакты — есть ли им подтверждение.
Что именно сверяется перед отправкой ответа
Суммы, ссылки и контакты: помощник ищет их в базе знаний, фактах профиля, документах и в самой переписке. Смысл ответа и его тон не сверяются никак — это остаётся на модели. Сверяются только тексты, которые написала модель; наши собственные шаблоны проверять незачем.
Уйдёт ли ответ собеседнику, если фактура не сошлась
Нет. Он останется черновиком, а вам придёт уведомление «Ответ остановлен: фактура не сошлась» и карточка с причиной. Это работает и в режиме «Отправлять сразу»: разрешение отвечать самому не означает разрешения сочинять за вас цифры.
Помогает ли база знаний уменьшить число выдумок
Да, и двумя способами сразу. Модель берёт цену и сроки из базы, а не придумывает их, — и та же база служит источником для сверки. Пустая база означает, что подтвердить цену из вашего прайса нечем: сверять останется только со словами собеседника, и ответ с этой ценой помощник остановит.
Подключите ассистента к своему Telegram
Открыть ботаЧитайте дальше
- ИИ-чат-бот против бота с кнопками: что он ответит на вопрос не из сценарияБот с кнопками сверяет нажатие с заранее описанной веткой и выдаёт привязанный к ней текст. ИИ-чат-бот получает сообщение целиком, вместе с предыдущими репликами разговора, и составляет ответ сам. Разница видна на первом же вопросе, которого нет в сценарии: кнопочный бот показывает меню заново или молчит, а ИИ-чат-бот отвечает по тому, что вы написали про своё дело.
- Непрямая коммуникация: почему руководитель говорит намёкамиРуководитель спрашивает «ты уверен, что успеешь к пятнице?» вместо того чтобы сказать «сдвинь срок». Просьбы нет, а действие подразумевается — и вы весь вечер решаете, что он имел в виду. Понять намёк можно одним способом: переспросить его же словами и дать два варианта на выбор. «Когда вы сказали „посмотри ещё раз“ — речь про сроки или про расчёт?» Пока вы додумываете, работа стоит, а вопрос занимает одну строку.