Большая часть вопросов в количественных опросах — это шкалы. «Насколько вы удовлетворены», «согласны ли вы с утверждением», «как вероятно, что вы порекомендуете». Кажется, что тут нечего обсуждать: поставил варианты от одного до пяти — и готово. Но именно в шкалах прячутся ошибки, которые потом невозможно исправить на этапе анализа.
Шкала задаёт систему координат, в которой респондент выражает своё мнение. От её длины, подписей, наличия середины и даже направления зависит, какие цифры вы получите. Две анкеты с одинаковым смыслом, но разными шкалами могут дать результаты, которые нельзя сравнивать между собой. И если сравнение нужно — например, с прошлой волной трекинга, — проблема становится дорогой.
В этой статье разберём основные типы шкал, их сильные и слабые стороны, а также решения, которые приходится принимать при каждом построении вопроса.
Немного теории: типы измерений
Прежде чем выбирать шкалу, полезно понимать, какой тип данных она даёт. От этого зависит, что с ответами можно делать при анализе.
- Номинальная шкала — просто категории без порядка: пол, регион, любимая марка. Можно считать доли, но нельзя считать среднее.
- Порядковая шкала — категории с порядком, но неизвестным расстоянием между ними: «никогда — иногда — часто — всегда». Можно ранжировать, медиану использовать корректно.
- Интервальная шкала — равные расстояния между точками. Строго говоря, оценочные шкалы в анкетах порядковые, но на практике их часто анализируют как интервальные, считая средние баллы.
- Шкала отношений — есть абсолютный ноль: возраст, доход, количество покупок в месяц.
Спор о том, корректно ли считать средний балл по пятибалльной шкале, идёт давно. Практический компромисс такой: средние использовать можно, если шкала сбалансирована и подписи точек воспринимаются как равноудалённые, но рядом всегда полезно показывать распределение и долю верхних оценок.
Шкала Лайкерта
Самая известная шкала. Респонденту предлагается утверждение, а он отмечает степень согласия: «полностью не согласен», «скорее не согласен», «ни да ни нет», «скорее согласен», «полностью согласен».
Где работает хорошо
Измерение установок, мнений, восприятия бренда, оценки сотрудников, исследование ценностей. Удобна, когда нужно задать много утверждений подряд в виде таблицы: респондент быстро привыкает к формату.
Подводные камни
- Тенденция к согласию. Многие люди склонны соглашаться с любым утверждением, особенно если оно сформулировано позитивно. Поэтому в батарею добавляют обратные утверждения: «Этот банк заботится о клиентах» и «Этому банку безразличны проблемы клиентов».
- Двойные утверждения. «Продукт вкусный и полезный» — с чем соглашается человек, если считает его вкусным, но вредным? Одно утверждение — одна мысль.
- Утомление от батарей. После пятнадцатого утверждения многие начинают отвечать «прямой линией». Длинные батареи лучше разбивать на несколько экранов и чередовать с другими типами вопросов.
Семантический дифференциал
Шкала между двумя противоположными прилагательными: «дешёвый — дорогой», «современный — устаревший», «надёжный — ненадёжный». Респондент отмечает точку между полюсами, обычно на семи градациях.
Семантический дифференциал незаменим в имиджевых исследованиях: он позволяет построить профиль бренда и наложить на него профили конкурентов. Визуально это даёт наглядные «змейки», по которым сразу видно, где бренд выигрывает, а где проигрывает.
Главная сложность — подбор пар. Противоположности должны быть действительно противоположными и понятными. «Тёплый — холодный» для банка звучит метафорично, и разные люди поймут это по-разному. Пары лучше брать из языка самих потребителей, собранного на качественном этапе, например на фокус-группах.
Чередуйте полюса: пусть позитивный полюс иногда стоит слева, а иногда справа. Иначе часть респондентов будет механически отмечать одну сторону, и профиль бренда окажется искусственно «хорошим».
Рейтинговые и числовые шкалы
Это шкалы, где респонденту предлагают поставить оценку числом: от 1 до 5, от 1 до 10, от 0 до 10. Подписаны обычно только крайние точки.
Пять, семь или десять точек
Короткие шкалы проще для респондента и хорошо работают в телефонных опросах, где человек не видит варианты. Длинные шкалы дают больше вариативности и лучше различают близкие объекты, но требуют от респондента больших усилий и больше подвержены разнице в индивидуальной манере отвечать.
Практическое правило: пятибалльная шкала — для массовых опросов и телефона; семибалльная — для имиджевых и атрибутивных оценок онлайн; одиннадцатибалльная (от 0 до 10) — для метрик вроде NPS, где формат уже стандартизирован.
Шкалы «как раз в меру»
Особый вид шкалы для продуктовых тестов: «слишком сладко — немного слишком сладко — в самый раз — немного недостаточно сладко — совсем недостаточно сладко». Она показывает не только оценку, но и направление доработки. Средний балл здесь бессмыслен: важно, какая доля ответов находится в центре и в какую сторону отклоняются остальные.
Сравнительные шкалы
Иногда нужно не оценить объект сам по себе, а понять, что важнее или лучше в сравнении. Для этого используют другие инструменты.
| Шкала | Как устроена | Когда использовать |
|---|---|---|
| Ранжирование | Респондент упорядочивает варианты от самого важного к наименее важному | Когда вариантов немного, до семи-восьми |
| Парное сравнение | Из каждой пары выбирается более предпочтительный вариант | Для небольшого числа объектов и точного порядка |
| Распределение суммы баллов | Нужно распределить, например, 100 баллов между характеристиками | Когда важна относительная сила, а не только порядок |
| MaxDiff | В наборах из нескольких вариантов выбирается самый и наименее важный | Для длинных списков характеристик, когда все «важны» |
Сравнительные шкалы решают классическую проблему оценочных вопросов: когда спрашиваешь о важности каждой характеристики отдельно, всё получает «4» и «5», и приоритеты не видны. Подробнее о том, как обойти этот эффект, — в материале о методе MaxDiff.
Решения, которые нужно принять при построении шкалы
Нужна ли средняя точка
Нечётная шкала с нейтральной серединой честнее по отношению к тем, у кого действительно нет мнения. Но она же даёт «убежище» тем, кто не хочет думать. Чётная шкала заставляет определиться, но может раздражать и провоцировать случайные ответы. Если тема знакома большинству респондентов, обычно оставляют нечётную шкалу; если тема чувствительная и есть риск уклонения, иногда выбирают чётную.
Вариант «затрудняюсь ответить»
Это не середина шкалы, а отдельный вариант за её пределами. Он нужен, когда часть респондентов объективно не может оценить объект: например, не пользовалась услугой. Без него такие люди поставят случайный балл или середину, и данные «размоются».
Подписи точек
Полностью подписанные шкалы надёжнее: каждый понимает, что значит «3». Если подписаны только концы, люди по-разному интерпретируют промежуточные точки. Важно, чтобы подписи были сбалансированы: два позитивных варианта, два негативных и нейтральный, а не три оттенка позитива против одного негатива.
Направление шкалы
В одной анкете направление должно быть единым. Если в одном вопросе «1» — это отлично, а в другом «1» — плохо, ошибки респондентов гарантированы. Особенно это важно для тех, кто привык к школьной оценочной системе, где «5» — лучшая оценка.
Типичные ошибки при работе со шкалами
- Несбалансированные варианты. «Отлично — очень хорошо — хорошо — удовлетворительно — плохо». Здесь четыре позитивных точки против одной негативной, и результат неизбежно смещается вверх.
- Разные шкалы для сравниваемых вопросов. Удовлетворённость сервисом на пятибалльной шкале, а ценой — на десятибалльной. Сравнить эти оценки напрямую уже нельзя.
- Смена шкалы между волнами. Решили «улучшить» вопрос в новой волне трекинга — и потеряли сопоставимость с историей. Изменения в шкалах трекинга вносят только с параллельным тестом старой и новой версии.
- Средний балл без распределения. Средняя «3,5» может означать, что все поставили «3» или «4», а может — что половина поставила «1», а половина «5». Это две совершенно разные ситуации для бизнеса.
- Перевод шкал без адаптации. Иностранная методика с буквальным переводом подписей часто работает хуже: оттенки слов «довольно», «скорее», «весьма» в русском языке воспринимаются иначе.
Многие из этих проблем легко выявить ещё до запуска поля. Для этого и нужен пилотаж анкеты: на десятке-другом интервью сразу видно, где люди спотыкаются и переспрашивают.
Как анализировать ответы на шкалах
Простого среднего балла почти всегда недостаточно. Полезно использовать несколько показателей одновременно.
Top-2 Box
Доля двух верхних оценок. Понятен руководителям и хорошо показывает, сколько людей по-настоящему довольны.
Bottom-2 Box
Доля двух нижних оценок. Показывает зону риска — тех, кто может уйти или распространять негатив.
Распределение
Полная гистограмма ответов. Без неё легко пропустить поляризацию мнений, которая скрыта за средним значением.
При сравнении групп важно проверять, значимы ли различия. Разница в 0,2 балла между двумя сегментами может быть как реальным сигналом, так и случайным колебанием — всё зависит от размера подвыборок и разброса ответов.
Практические выводы
- Выбирайте шкалу под задачу: Лайкерт — для установок, семантический дифференциал — для имиджа, сравнительные шкалы — для приоритизации.
- Делайте шкалы сбалансированными, с понятными подписями и единым направлением во всей анкете.
- Добавляйте «затрудняюсь ответить», когда часть аудитории объективно не может дать оценку.
- Не меняйте шкалы в трекинговых исследованиях без параллельного теста.
- В анализе смотрите не только на среднее, но и на распределение, доли верхних и нижних оценок.
- Проверяйте шкалы на пилотаже — это самый дешёвый способ избежать испорченных данных.
Хорошая шкала незаметна для респондента: он просто отвечает, не задумываясь о форме вопроса. А плохая шкала незаметна для заказчика до тех пор, пока не придётся объяснять, почему цифры не сходятся.
Нужна помощь с исследованием? Специалисты NRay проведут исследование под вашу задачу — от постановки целей до презентации результатов. Оставьте заявку или напишите на [email protected].