Производитель мясной гастрономии готовился к выходу на новый рынок и хотел понять, как его продукты выглядят на фоне конкурентов и какие из них сильнее. Мы провели слепой сенсорный тест: без упаковки, без названий, с оценкой каждого образца по семи отдельным атрибутам. Ответ оказался не тем, которого ждал заказчик. Вопрос «чей продукт вкуснее» в этой категории ведёт не туда: сильные стороны бренда лежат вообще не во вкусе, а продукты с лучшим вкусом на рынке проигрывают по общему впечатлению.
Кратко о проекте
- Категория: мясная гастрономия, колбасные изделия
- Метод: слепой сенсорный тест — количественные оценки по шкалам плюс открытые комментарии
- Аудитория: участники 20–67 лет, две языковые группы в равных долях
- Объём: 24 продукта в 28 позициях, 9 сетов, 7 атрибутов оценки, 644 заполненных бланка
- Что оценивалось: внешний вид, цвет, запах, консистенция, вкус, сочность, послевкусие — по десятибалльной шкале, каждый атрибут отдельно
- Результат: бенчмарки по продуктовым категориям, профили брендов по атрибутам, портреты потребителей, рекомендации по коммуникации и приоритеты доработки рецептур
Особенность категории
Колбасные изделия покупают часто, выбирают быстро и почти всегда — глазами через витринное стекло или упаковку. Попробовать до покупки нельзя, вернуться к сравнению можно только в следующий раз.
Из этого следует особенность, которую тест и должен был поймать: впечатление от продукта складывается из нескольких независимых слоёв, и покупатель проходит их последовательно. Сначала вид среза, потом запах, и только потом всё остальное. Продукт, не прошедший первый слой, до второго не доходит — в буквальном смысле: в этом тесте до трети участников отказались пробовать образец с худшим внешним видом.
Общая оценка «вкусно или нет» такую структуру скрывает. Поэтому продукт разбирался на семь атрибутов, каждый со своей шкалой.
Четыре решения в дизайне теста
Тест слепой, оценивался срез. Ни упаковки, ни названия, ни бренда. Это принципиально для трактовки: всё, что в отчёте сказано про визуальное восприятие, относится к самому продукту, а не к оформлению. Соответственно, и рекомендация «делать ставку на внешний вид» означает работу с рецептурой и структурой среза, а не с дизайном этикетки.
Два продукта повторялись в трёх сетах каждый. Оценка в тесте зависит не только от продукта, но и от того, с чем его сравнивают: рядом с сильными образцами средний продукт выглядит слабее, чем рядом со слабыми. Чтобы измерить этот эффект, а не гадать о нём, два продукта размещались трижды — в разном конкурентном окружении.
Результат оказался важным для всей методики. Итоговый средний балл продукта менялся между размещениями на 0,08 и 0,25 балла — то есть практически не менялся, и сравнительные сеты можно сопоставлять между собой напрямую. Но по отдельным атрибутам картина разная: визуальные оценки стабильны (размах от 0 до 0,35), а запах и послевкусие плывут заметно сильнее — до 0,91 и 0,66. Это накопительный эффект: к концу сета нос и рецепторы уже нагружены предыдущими образцами. Отсюда практическое следствие для дизайна поля — порядок предъявления внутри сета нужно ротировать.
Корреляции считались на уровне «респондент × продукт». Не по усреднённым оценкам продуктов, а по каждой отдельной строке бланка. Усреднение сгладило бы индивидуальные различия и дало бы завышенные и почти бессодержательные связи; расчёт по строкам показывает, как атрибуты связаны в восприятии одного человека.
Нестандартные позиции вынесены в отдельный сет — и там же остались. Четыре продукта заказчика, у которых нет прямых аналогов в выборке, тестировались в сете без конкурентов. Оценки в нём оказались систематически выше: доля высших оценок составила от 22 до 52% против 9–39% в сравнительных сетах. Причина не в качестве продуктов, а в отсутствии контраста — респонденту не с чем соотнести шкалу, и он использует её мягче. Такие цифры корректно сравнивать внутри сета, но не с остальным тестом, и в отчёте это оговорено отдельно.
Главная находка: выигрывает не вкус
Для каждого продукта считался сильнейший и слабейший атрибут — не по абсолютному баллу, а по отклонению от среднего по всем продуктам внутри этого атрибута. Иначе сравнение бессмысленно: шкала внешнего вида в среднем «щедрее» шкалы послевкусия, и продукт с шестёркой по виду выглядит на рынке хуже, чем продукт с шестёркой по вкусу.
Результат оказался одинаковым для обоих ведущих брендов теста. Ни у одного из девяти их продуктов сильнейшим атрибутом не оказался вкус, сочность или послевкусие. Все сильные стороны — во внешнем виде, цвете и запахе. Все слабые, без единого исключения, — во внутреннем сенсорном опыте.
Обратная сторона видна на третьей группе брендов. У неё лучшая вкусовая группа из всех трёх — и при этом самая низкая итоговая оценка. Визуальное отставание перевешивает сильный вкус.
Отсюда рекомендация, ради которой проект и делался. Коммуникация бренда строится на запахе и виде среза, а не на утверждении «вкуснее всех» — по вкусу бренд заказчика в среднем не выигрывает, и заявление об этом рассыпалось бы при первой же дегустации. Запах при этом оказался единственным атрибутом первого впечатления, где отрыв достигается не за счёт картинки: два флагманских продукта опережают рынок по запаху сильнее, чем любой продукт теста опережает рынок по любому атрибуту.
Корреляции объясняют, почему такая ситуация вообще возможна. Внешний вид и цвет для респондентов — фактически один параметр: связь между ними 0,90, различить их люди не могут. А вот связь визуального впечатления со вкусом заметно слабее — около 0,63–0,65. Поскольку тест слепой, это не эффект упаковки, а реальный сенсорный разрыв: по срезу нельзя предсказать вкус. При этом вклад всех семи атрибутов в итоговую оценку сопоставим — от 0,84 до 0,91, и перевес вкуса невелик.
Как читать нули в бланке фудтеста
Ноль в бланке сенсорного теста почти никогда не означает оценку «ноль». Он означает, что оценки нет — а причин у этого несколько, и они требуют разной обработки.
Отказ от дегустации. Участник оценил вид, цвет и запах, а вкусовую группу оставил пустой. В комментариях к таким бланкам прямо написано: «внешний вид, поэтому пробовать не хочется», «страшная», «не пробовала». Это не пропуск данных, а результат: продукт не прошёл визуальный порог входа. В отчёте он учитывается отдельной метрикой — долей отказов от дегустации, и по худшему продукту теста она дошла до 35%.
Пищевые ограничения участника. Опознаются по паттерну: нули строго в сетах одной продуктовой группы при полностью заполненных остальных. В этом проекте один участник не употребляет определённую группу продуктов, что подтвердилось уточнением у полевой команды.
Техническая недозаполненность. Пустая строка без объяснимой логики. Здесь её не оказалось, но проверять нужно всегда.
Ошибка, которой всё это предотвращает, простая и дорогая: если подставить нули как оценки, средние по продукту обвалятся, и продукт с отталкивающим видом получит вдобавок несуществующий провал по вкусу. Правильная обработка — исключить такие строки из расчёта вкусовых атрибутов, сохранив визуальные оценки как валидные. В этом проекте исключено 6,2% строк.
Отдельно стоит отметить, что отказ от дегустации оказался одним из самых информативных показателей всего теста. Продукт с худшим внешним видом получил у тех, кто всё же попробовал, вполне приличные вкусовые оценки — но треть участников до вкуса просто не добралась.
Что ещё показали данные
Категории различаются не уровнем, а характером нормы. Сосиски — визуально самая сильная группа теста, но с худшим послевкусием. У копчёной колбасы профиль обратный: слабейшая визуальная норма и лучшая норма по запаху. То есть первое впечатление формируется в этих категориях разными органами чувств, и коммуникация под них нужна разная.
Высокий балл не означает, что продукт понят правильно. Одна из позиций линейки получила уверенные оценки по всем атрибутам, но в открытых комментариях повторялось, что продукт не соответствует заявленной традиционной категории. Это расхождение цифр и восприятия не видно ни в одной шкале — только в комментариях, и оно меняет решение: дорабатывать нужно не рецептуру, а соответствие названию.
Доля высших оценок на малых базах — ориентир, а не показатель. При базе около двадцати человек один-два участника двигают Top Box на 4–9 процентных пунктов, тогда как средний балл остаётся устойчивым. Для сравнения волн между собой годится средний балл, для Top Box нужна база больше.
Демографические различия не интерпретируются исследователем в одиночку. В данных обнаружились две закономерности: старшие участники ставят баллы выше, и одна из двух языковых групп оценивает ассортимент выше другой. Оба различия можно было бы списать на манеру пользоваться шкалой. Мы зафиксировали различие, предложили гипотезу и уточнили её у заказчика — и оба раза объяснение оказалось содержательным и связанным со знанием категории и составом ассортимента. Порядок здесь принципиален: у клиента, как правило, есть контекст, которого в данных нет.
Итог
Заказчик пришёл с вопросом «какие наши продукты вкуснее», а получил ответ, что в этой категории вопрос стоит иначе. Продукт выигрывает или проигрывает раньше, чем его попробуют, и бренд, который спорит о вкусе, спорит не на том поле — тем более что по вкусу он и не лидирует.
Два вывода переносятся за пределы мясной гастрономии. Первый: общая оценка «нравится или нет» скрывает структуру впечатления, а решения принимаются именно по структуре — разбивка на отдельные атрибуты превращает расплывчатое «продукт средний» в понятный список того, что менять. Второй: пустая ячейка в бланке — это тоже данные. Разобрать, почему человек не поставил оценку, часто ценнее, чем посчитать среднее по тем, кто поставил.
Сенсорное тестирование под вашу задачу
Такие проекты отвечают на вопросы, которые не закрываются фокус-группой и дегустацией внутри компании: как продукт выглядит на фоне конкретных конкурентов, какой атрибут тянет впечатление вниз, что менять в рецептуре в первую очередь, на какое преимущество опираться в коммуникации и с каких позиций начинать выход на новый рынок.
Mosaic Agency проводит слепые сенсорные тесты с разбивкой на отдельные атрибуты, расчётом бенчмарков по категориям и разбором открытых комментариев. География проекта определяется задачей, а не нашими ограничениями. Заказчик получает решения по продукту и коммуникации, а вместе с ними — полные таблицы оценок и комментариев, к которым можно вернуться при доработке рецептур.
Расскажите о продукте и задаче — обсудим, какой дизайн теста ответит на ваш вопрос точнее всего.
Другие кейсы отдела исследований: Барьеры выбора бренда в детской категории · Потолок среднего чека в категории товаров для сна
Подробнее об услуге: маркетинговые исследования и стратегия