«До Сути»← Все статьи

Методика · 7 августа 2026 г.

Пропуски в ответах и «затрудняюсь ответить»: как обрабатывать

Пропуск в опросе — это отсутствие ответа, а «затрудняюсь ответить» — содержательный ответ о том, что у человека нет мнения. Смешивать их нельзя: первое означает, что вы данных не получили, второе — что получили и они означают неопределённость. Проценты по вопросу считаются от числа ответивших именно на него, а не от всех участников опроса, и это правило меняет цифры сильнее, чем кажется. Ниже разберём, какие бывают механизмы пропусков и как их различить, что делать с недозаполненными анкетами, когда подстановка значений допустима, а когда становится подгонкой, и как снизить долю пропусков ещё на этапе составления анкеты.

Что считать пропуском: три разные ситуации

Под словом «пропуск» в данных опроса прячутся три разные вещи, и обрабатываются они по-разному. Первая: человек дошёл до вопроса, но не ответил — увидел и сознательно пролистал. Вторая: человек до вопроса не дошёл, потому что бросил анкету раньше, и все последующие поля пусты не из-за нежелания, а из-за обрыва. Третья: вопрос ему вообще не показывался, потому что логика анкеты его отфильтровала — например, вопрос про доставку не задавали тем, кто покупает в магазине. Третий случай пропуском не является вовсе, хотя в выгрузке выглядит точно так же — пустой ячейкой.

Различить эти три ситуации нужно до начала анализа, иначе все проценты поедут. Отфильтрованные логикой вопросы должны быть исключены из базы расчёта — иначе вы получите «85% не ответили», хотя на самом деле вопрос им не показывали. Оборванные анкеты образуют характерную картину: пропуски идут сплошным хвостом с определённого места до конца. Сознательные пропуски выглядят иначе — это отдельные дырки в середине заполненной анкеты, и именно они интереснее всего, потому что показывают, на каких вопросах человек решил промолчать.

Чем «затрудняюсь ответить» отличается от пропуска

Это ключевое различие, и его часто игнорируют. Пропуск — это отсутствие информации: вы не знаете, что человек думает. «Затрудняюсь ответить» — это информация: человек сообщил, что мнения у него нет, вопрос ему непонятен или он не готов оценивать. Считать такие ответы вместе с пропусками неверно и в обратную сторону тоже: подмешивать их к содержательным вариантам нельзя. Правильная схема — три отдельные категории в отчёте: ответили содержательно, выбрали «затрудняюсь», пропустили. Каждая из трёх цифр отвечает на свой вопрос, и их сумма даёт полную картину по вопросу.

КатегорияЧто означаетКак учитывать
Содержательный ответЕсть мнение, оно высказаноОсновная база для процентов
«Затрудняюсь ответить»Мнения нет или вопрос непонятенПоказывать отдельной строкой
Сознательный пропускВопрос увидел, отвечать не сталИсключить из базы, долю указать
Обрыв анкетыДо вопроса не дошёлИсключить, анализировать точку обрыва
Отфильтрован логикойВопрос не показывалсяНе пропуск, из базы убрать полностью
Технический сбойОтвет не сохранился из-за обрыва связиПроверить логи, при массовости — перезапуск
Соберите такой опрос за 2 минуты
Опишите задачу своими словами — ИИ составит вопросы, даст ссылку для сбора ответов и проанализирует результаты.
Создать опрос

Три механизма: почему именно эти люди промолчали

Важно не только сколько пропусков, но и кто пропустил. Механизмов три. Первый: пропуски случайны и никак не связаны с респондентом — человек отвлёкся. Такие пропуски безобидны, они лишь уменьшают число наблюдений. Второй: пропуски связаны с известными признаками — например, вопрос про мобильное приложение чаще пропускают те, кто заходит с компьютера. Это поправимо, потому что признак у вас есть. Третий и самый неприятный: пропуски связаны с самим ответом — вопрос про доход чаще пропускают люди с высоким и очень низким доходом. Здесь пропуск сам по себе несёт информацию, которую вы никогда не восстановите.

Проверить механизм можно прямо в данных: сравните тех, кто ответил на проблемный вопрос, и тех, кто его пропустил, по всем остальным известным признакам. Если группы похожи, пропуски скорее случайны. Если пропустившие заметно отличаются — например, среди них вдвое больше новых клиентов, — механизм второй, и об этом обязательно нужно написать в отчёте. Третий механизм формально не диагностируется вообще: чтобы доказать связь пропуска с ответом, нужно знать ответ, которого у вас нет. Поэтому по чувствительным темам действует простое правило — считать высокую долю пропусков сигналом смещения, а не случайности.

Практический вывод из этой классификации простой: механизм определяет не столько метод расчёта, сколько формулировку вывода. При случайных пропусках вы просто пишете цифру и базу. При пропусках, связанных с известным признаком, добавляете оговорку: «среди пропустивших вдвое больше новых клиентов, поэтому оценка смещена в сторону опытных пользователей». При подозрении на связь пропуска с самим ответом вывод формулируется ещё осторожнее — как оценка по той части аудитории, что согласилась отвечать. Это не бюрократическая формальность: разница между «клиенты оценивают цену на 4,2» и «клиенты, готовые обсуждать цену, оценивают её на 4,2» может стоить неверного решения.

От какой базы считать проценты

Правило одно: проценты по вопросу считаются от числа ответивших на этот конкретный вопрос. Если анкету начали 500 человек, до вопроса дошли 430, а ответили 380, то база — 380. Эта арифметика меняет цифры сильнее, чем кажется: сорок человек, посчитанных в знаменателе, могут сдвинуть результат на несколько процентных пунктов и превратить рост в падение. При этом саму базу нужно показывать рядом с цифрой: строка «ответили 380 из 500 начавших» стоит одного предложения, но избавляет отчёт от половины вопросов на защите результатов.

Что делать с частично заполненными анкетами

Соблазн удалить все незавершённые анкеты велик — так таблица выглядит аккуратнее. Но это потеря настоящих данных: до момента обрыва человек отвечал честно, и эти ответы полностью пригодны. Разумный подход — оставлять частичные анкеты и считать каждый вопрос по своей базе. Удалять стоит только те, где заполнено меньше половины или пропущены ключевые для анализа вопросы, без которых анкета бесполезна. Отдельно посмотрите, на каком именно вопросе люди чаще всего бросают анкету: это самая полезная информация из всей истории с пропусками, потому что она указывает на конкретный сломанный вопрос.

Массовый обрыв на одном вопросе почти всегда означает, что вопрос плохо сформулирован, слишком личный или технически неудобен — например, длинная матрица на телефоне. Это не проблема респондентов и не повод чистить данные: это повод переписать вопрос до следующего запуска.

Полезно завести привычку смотреть на данные по вопросам, а не только по анкетам. Постройте простую таблицу: номер вопроса, сколько человек до него дошло, сколько ответило, сколько выбрало «затрудняюсь». Три колонки покажут всю анатомию потерь — где люди уходят из анкеты, где остаются, но молчат, и где отвечают формально. Обычно на такой таблице сразу видно два-три проблемных места, и их исправление даёт больше, чем любые ухищрения на этапе анализа. Заодно она защищает от иллюзии, будто низкая завершаемость равномерно размазана по анкете: почти всегда потери сконцентрированы в конкретных точках.

Подстановка значений: когда допустима, когда обман

Подстановка — это заполнение пропусков расчётными значениями, обычно средним или медианой по группе. В прикладных опросах она нужна редко и почти всегда опасна. Основная проблема в том, что подстановка создаёт видимость данных там, где их нет: разброс искусственно уменьшается, а уверенность в выводах растёт без всяких оснований. Для описательных задач — посчитать доли, сравнить группы, построить отчёт — подстановка не требуется вообще: достаточно честно считать по имеющимся ответам и показывать базу.

Если подстановка всё же применяется, соблюдайте три условия. Первое: доля пропусков по показателю невелика, ориентировочно до 5–10%. Второе: механизм пропусков похож на случайный — вы проверили это сравнением групп. Третье: в отчёте прямо написано, что значения подставлены, каким способом и по какому числу наблюдений. Нарушение любого из трёх превращает подстановку в подгонку. Отдельно запомните, что подставлять значения в чувствительные показатели вроде дохода не стоит никогда: там механизм пропусков заведомо связан с самим ответом.

Нужен ли вариант «затрудняюсь ответить» в анкете

Однозначного ответа нет, и выбор зависит от вопроса. Если у части аудитории мнения действительно может не быть — например, вы спрашиваете об услуге, которой человек не пользовался, — вариант нужен обязательно. Без него люди начнут выбирать средние значения шкалы просто чтобы двинуться дальше, и вы получите нейтральные оценки от тех, кто вообще не в теме. Если же вопрос касается личного опыта, который у респондента точно есть, вариант лучше не давать: он превращается в лёгкий путь для тех, кто не хочет думать.

  1. Определите, может ли у части аудитории объективно не быть мнения по этому вопросу.
  2. Если может — добавьте вариант и обязательно выносите его за пределы шкалы, а не в её середину.
  3. Если не может — не добавляйте, но и не делайте вопрос обязательным для ответа.
  4. Отслеживайте долю выбравших этот вариант: выше 20–25% означает, что вопрос не подходит аудитории.
  5. Никогда не считайте «затрудняюсь» как середину шкалы — это разные вещи по смыслу.
  6. В повторных замерах не меняйте набор вариантов: иначе динамику показателя будет не с чем сравнивать.

Как снизить долю пропусков на этапе анкеты

С пропусками эффективнее бороться до сбора, а не после. Главные причины молчания предсказуемы: вопрос непонятен, вопрос слишком личный, вопрос требует усилий, анкета слишком длинная и человек устал. Соответственно работают и меры: простые формулировки без двойных отрицаний, объяснение зачем нужен чувствительный вопрос, размещение личных вопросов в конце анкеты, разумная длина и адаптация под телефон. Отдельно помогает обязательность ответа, но применять её нужно осторожно: принудительный ответ на неудобный вопрос выталкивает человека из анкеты целиком, и вместо пропуска в одном поле вы получаете обрыв.

Полезный приём — пилотный запуск на небольшой группе с последующим просмотром пропусков по вопросам. Дырки покажут проблемные формулировки точнее любой вычитки: там, где вопрос непонятен, люди молчат. В сервисе «До Сути» анкета собирается из описания задачи текстом, и порядок вопросов задаётся автоматически, но проверить пилотом всё равно стоит — ни один инструмент не знает, какая формулировка окажется слишком личной именно для вашей аудитории. Это проверяется только на живых людях и только заранее.

Ограничения: чего анализ пропусков не даёт

Анализ пропусков показывает, что данных нет и у кого именно их нет. Он не показывает и в принципе не может показать, что эти люди думали. Любая попытка достроить их мнение — подстановка, экстраполяция по похожим респондентам, предположение «наверное, они как остальные» — остаётся допущением, а не измерением. Особенно осторожно стоит относиться к выводам по вопросам, где пропустила пятая часть аудитории: там результат описывает уже не всю группу, а только ту её часть, что согласилась ответить, и это разные совокупности.

Ещё одно ограничение касается сравнений во времени. Если в прошлом замере доля пропусков по вопросу была 5%, а в новом стала 18%, сравнивать средние значения напрямую уже нельзя: изменилась не только оценка, но и состав тех, кто её давал. Прежде чем объявлять динамику, проверьте, совпадают ли базы расчёта и структура ответивших. Нередко оказывается, что показатель не вырос и не упал, а просто перестала отвечать та группа, которая раньше тянула его вниз, — и весь наблюдаемый рост объясняется этим, а не изменениями в продукте.

Типичные ошибки

Проверить себя просто: возьмите готовый отчёт и найдите в нём базу расчёта под каждой таблицей. Если её нет ни под одной, значит, пропуски в анализе не учитывались вообще — и любая цифра в этом отчёте может отличаться от настоящей на несколько пунктов в неизвестную сторону. Добавление одной строки с базой под каждой таблицей — самое дешёвое улучшение качества отчёта из всех возможных, и делается оно за пятнадцать минут.

Соберите такой опрос за 2 минуты
Опишите задачу своими словами — ИИ составит вопросы, даст ссылку для сбора ответов и проанализирует результаты.
Создать опрос

Частые вопросы

От какого числа считать проценты, если часть людей не ответила?

От числа ответивших именно на этот вопрос. Если анкету начали 500 человек, до вопроса дошли 430, а ответили 380 — база равна 380. Тех, кому вопрос не показывался из-за логики переходов, в базу включать нельзя вообще. Базу расчёта нужно указывать рядом с каждой таблицей: это одна строка, которая позволяет читателю понять, насколько устойчива цифра, и снимает большую часть вопросов к результатам.

Нужно ли удалять анкеты, заполненные не до конца?

В большинстве случаев нет. До момента обрыва человек отвечал по-настоящему, и эти ответы пригодны для анализа — просто по поздним вопросам будет меньше наблюдений. Удалять стоит анкеты, где заполнено меньше половины вопросов или отсутствуют ключевые для анализа поля. Гораздо полезнее посмотреть, на каком вопросе люди бросают анкету чаще всего: это прямо указывает на неудачную формулировку или слишком длинный блок.

Добавлять ли вариант «затрудняюсь ответить»?

Добавляйте, если у части аудитории объективно может не быть мнения — например, вы спрашиваете про функцию, которой человек не пользовался. Без такого варианта люди выбирают середину шкалы, и вы получаете нейтральные оценки от тех, кто не в теме. Если же вопрос о личном опыте, который точно был, вариант лучше не давать. Размещайте его за пределами шкалы и никогда не считайте как её среднее значение.

Можно ли заполнить пропуски средним значением?

Только при трёх условиях одновременно: пропусков немного (ориентировочно до 5–10%), пропустившие не отличаются от ответивших по другим признакам, и факт подстановки описан в отчёте с указанием способа. В чувствительных показателях вроде дохода подстановка недопустима: там молчание почти всегда связано с самим ответом. Для описательных задач подстановка не нужна вовсе — достаточно считать по имеющимся ответам и показывать базу.

Читайте также