Блог

Может ли чат-бот провести глубинное интервью

ИИ в исследованиях
Может ли чат-бот провести глубинное интервью

Что такое ИИ-интервьюер

ИИ-интервьюер — это чат-бот на языковой модели, которому дают гайд и правила: какие темы пройти, когда уточнять, когда переходить дальше. Респондент отвечает текстом или голосом, бот реагирует на ответ и задаёт следующий вопрос. По устройству это что-то среднее между анкетой с открытыми вопросами и интервью: вопросы заданы заранее, но уточнения генерируются по ходу.
Важно, чего он не делает: он не придумывает ответы за людей. Это не синтетические респонденты, где модель изображает потребителя. Здесь отвечают живые люди — вопрос только в том, кто их спрашивает.

Что формат умеет

Масштаб. Живой модератор за день проводит несколько интервью по часу. Чат-бот ведёт сотни разговоров параллельно, и расшифровка не нужна — текст уже есть.
Одинаковые вопросы. Модератор устаёт, привыкает к гайду и начинает подсказывать. Бот задаёт вопрос в одной формулировке сотому респонденту так же, как первому, — если его инструкции хорошо протестированы.
Ночью и на двух языках. Человек отвечает тогда, когда ему удобно, и на том языке, на котором думает. Для Казахстана это существенно: модератор, который одинаково свободно ведёт интервью на казахском и русском, — редкость на рынке, и поэтому, если заказчику нужны живые интервью и фокус-группы на казахском, мы ведём их силами казахоязычных модераторов, а не переводчика рядом с русскоязычным. С ботом то же правило: казахская версия гайда и правил уточнения должна быть написана казахоязычным исследователем как второй оригинал, а не переведена, иначе бот задаёт уже другой вопрос.
Длиннее, чем открытое поле анкеты. В исследованиях ИИ-интервью респонденты писали больше, чем в обычных открытых полях, и оценивали разговор как неосуждающий. Аспиранты-социологи LSE и Гарварда, специализирующиеся на качественных методах, читая расшифровки, оценили интервью, проведённые ботом, примерно на уровне среднего живого эксперта. Это сильный результат, но важно, в каких условиях он получен: оценивали тексты расшифровок, на темах, которые выбрали сами авторы платформы. Паузы, интонацию и то, как повёл бы себя в том же разговоре закупщик крупной компании, такая оценка не проверяет.

Где формат проигрывает

Переспрос там, где начинается главное. Хорошее интервью держится на моменте, когда человек говорит что-то неожиданное, а модератор цепляется: «Сколько это было? А что вы сделали потом?» В гайде для голоса клиента это прямо записано: «долго» уточняется до «сколько это было и сколько было бы нормально», «удобно» — до «что именно было удобно». В эксперименте, где тот же гайд вели люди и ИИ, большинство нарушений правила «задать уточняющий вопрос на неожиданный или неясный ответ» пришлось на ИИ-интервьюера. Выборка там маленькая — 11 интервью со студентами, — но проблема ровно та, которую видно и на практике: бот задаёт следующий вопрос гайда там, где человек задал бы третий уточняющий.
Невербальное. Пауза, смешок, смена тона, «ну, в целом нормально» с интонацией «совсем не нормально» — в текстовом чате этого нет. Модератор на видеосвязи слышит, что ответ расходится с тем, как он произнесён, и возвращается к теме.
Доверие в B2B. Владелец бизнеса или закупщик соглашается на интервью ради разговора с человеком, который понимает отрасль. Чат-бот для него — анкета в другой обёртке, и он либо не приходит, либо отвечает коротко. Поэтому для аудиторий, которых нет в онлайн-панели — владельцев бизнеса, закупщиков, узких экспертов, — основной формат остаётся глубинным интервью с живым модератором.
Уход от темы. Модератор возвращает разговор к тому, ради чего он затеян, но чувствует, когда отступление важнее гайда. Бот либо жёстко возвращается и обрывает ценную ветку, либо идёт за респондентом и не проходит обязательные темы. Исследователи, которые строили такие системы, отдельно предупреждают: небольшая правка инструкций меняет поведение бота непредсказуемо, и его приходится долго тестировать.
Короткий контекст и чужой текст. В письменном формате люди отвечают откровеннее на чувствительные вопросы, но короче раскрывают контекст и реже рассказывают историю целиком. А бот, как видно из эксперимента выше, не всегда переспрашивает там, где начинается главное, — и недосказанное так и остаётся недосказанным. Кроме того, в текстовое поле можно вставить готовый текст — в том числе сгенерированный другой нейросетью. Если формат текстовый, вставку скопированного текста в поля ответа стоит запрещать, как и в обычной анкете; иначе вы анализируете не голос клиента. Подробнее об этой угрозе — в статье об ответах, написанных ИИ, в онлайн-опросах.

Когда годится, а когда нет

Задача
ИИ-интервьюер
Почему
Массовый короткий открытый блок: «почему выбрали», «что мешает» у сотен человек
Годится
Длиннее и точнее открытого поля анкеты, ответы потом кодируются как обычные открытые
Пре-тест гайда перед живыми интервью
Годится
Быстро видно, какие вопросы непонятны и где люди отвечают одно и то же
Голос клиента и дерево CTQ
Нет
Требования выводятся из событий последнего случая с числами-порогами — нужен переспрос
Jobs to be done: история покупки, силы переключения
Нет
Главное — в деталях момента выбора, которые человек вспоминает только после уточнений
B2B: владельцы бизнеса, закупщики, эксперты
Нет
Не придут или ответят формально; доверие строит разговор с человеком
Чувствительные темы: здоровье, долги, семья
Нет
Нужен модератор, который видит, когда остановиться, и отвечает за этику разговора
Групповая динамика, реакция на концепцию
Нет
Это задача фокус-группы, где люди спорят друг с другом
Про голос клиента подробнее. Дерево CTQ раскладывает потребность в проверяемые требования «было / не было», а требования берутся из интервью, где человек вспоминает последний случай по шагам. Интервью кодируется в тот же день: цитата дословно, этап, потребность словами клиента. Если интервьюер не дотянул «ждал долго» до «ждал 40 минут, нормально было бы 15», в дереве появится требование без порога, и опрос по нему ничего не измерит.
С jobs to be done то же самое. Интервью о переключении — это реконструкция момента выбора: что было до, что подтолкнуло, что удерживало. Как это делают живые модераторы, разобрано в статье о качественных методах jobs to be done. Бот пройдёт по вопросам, но редко доберётся до той детали, ради которой интервью проводилось.

Если всё же пробуете: как собрать пилот

Самый дешёвый способ понять, подходит ли формат вашей задаче, — параллельный пилот. Одну и ту же тему ведут 5–6 живых интервью и 30–50 разговоров с ботом по тому же гайду. Потом сравнивают не длину ответов, а то, какие потребности и пороги нашлись в каждом потоке. Если бот нашёл те же темы, что и модератор, его можно использовать для расширения охвата. Если модератор нашёл две-три важные вещи, которых у бота нет, — это и есть цена масштаба для вашей задачи.

Как проверить подрядчика, который предлагает ИИ-интервью

Если вам предлагают заменить глубинные интервью чат-ботом, задайте вопросы, которые стоит задавать любому подрядчику, включая нас:
  • Кто респонденты и как их отбирали — живые люди из нужной аудитории или кто придётся?
  • Сколько уточняющих вопросов бот задаёт в среднем и можно ли посмотреть три полные расшифровки до договора?
  • Кто писал казахскую версию гайда и правил уточнения?
  • Можно ли вставить в поле ответа скопированный текст?
  • Кто и как кодирует ответы — и сколько перепроверяется вручную? Об этом — статья о кодировке открытых ответов с ИИ.

Что это значит для вашего решения

Выбор между ботом и модератором — это выбор между шириной и глубиной. Если вам нужно понять, какие причины вообще встречаются у сотен клиентов, чат-бот даст больше, чем открытое поле анкеты. Если нужно понять, почему именно и где проходит порог, после которого клиент уходит, нужен человек, который переспросит. Часто правильный ответ — оба этапа: 6–8 живых интервью, из которых собираются гипотезы и требования, и количественный опрос, который их проверяет на выборке. В больших проектах пропорции другие, а логика та же: например, выход международного игрока медицинского туризма в Центральную Азию мы готовили на статистике, 30 глубинных интервью и опросе 3 500 респондентов.
Об этом же — опорная статья кластера «Заменит ли ИИ маркетинговые исследования»: ИИ ускоряет работу с текстом и данными, но не заменяет живых людей из нужной аудитории и того, кто умеет их слушать. Все методы, между которыми приходится выбирать, собраны в разделе «Методы».

Источники

  • Geiecke F., Jaravel X. Conversations at Scale: Robust AI-led Interviews with a Simple Open-Source Platform. CEPR Discussion Paper DP19705, 2024. cepr.org
  • Geiecke F., Jaravel X. AI can carry out qualitative research at unprecedented scale // LSE Impact Blog, 30.10.2024. blogs.lse.ac.uk
  • Wuttke A., Aßenmacher M., Klamm C. и др. AI Conversational Interviewing: Transforming Surveys with LLMs as Adaptive Interviewers // LaTeCH-CLfL 2025. arxiv.org

По теме

Обсудим ваше исследование. Расскажите, какое решение нужно принять, — предложим метод, выборку и сроки.