Калькулятор размера выборки

Укажите погрешность и уровень доверия, чтобы рассчитать объём опроса.

Укажите погрешность доли в процентных пунктах. Например, ±5 п.п. для результата 40% означает интервал от 35% до 45%.
п.п.
Если предварительной оценки нет, оставьте 50%: это даёт наибольший размер выборки при прочих равных.
%
Если известен размер всей группы, укажите его для поправки на конечную совокупность. Иначе оставьте поле пустым.

Нужно завершённых ответов

385

Читайте объяснение ниже

Сколько ответов нужно для опроса

Люди с анкетами выбраны из большой группы участников опроса

Для оценки доли в большой группе с погрешностью ±5 процентных пунктов и доверительным уровнем 95% обычно нужно 385 завершённых ответов. Например, если 40% опрошенных выбрали вариант А, плановая точность соответствует примерно 35–45% для всей группы. Это число относится к ответам, а не к отправленным приглашениям.

Размер выборки помогает заранее спланировать опрос: сколько человек опросить, чтобы оценить долю сторонников идеи, покупателей товара или участников с определённым мнением. Калькулятор считает именно долю, то есть ответ «да/нет» или долю одного варианта среди всех ответов. Для средней оценки, суммы расходов или среднего времени нужна другая формула.

Выберите уровень доверия, допустимую погрешность и ожидаемую долю. Если доля пока неизвестна, оставьте 50%: это самый осторожный вариант, дающий наибольшую выборку. Размер всей группы указывайте только когда он известен и ограничен, например 1000 сотрудников компании. Для жителей большого города поле можно оставить пустым.

Как работает расчёт

Представьте большую коробку с карточками «да» и «нет». Вы случайно достаёте часть карточек и по их доле оцениваете содержимое всей коробки. Чем точнее нужен ответ, тем больше карточек придётся достать. Если уменьшить допустимую погрешность вдвое, требуемое число ответов вырастет примерно в четыре раза, пока поправка на конечный размер группы не станет существенной.

Для достаточно большой совокупности применяется стандартная формула планирования доли:

n0=z2p(1−p)e2\displaystyle n_0=\frac{z^2p(1-p)}{e^2}

Здесь n₀ обозначает исходный размер выборки, p ожидаемую долю как число от 0 до 1, e допустимую погрешность тоже как долю, а z коэффициент доверительного уровня. При 95% он около 1,96, при 90% около 1,645, при 99% около 2,576. Пять процентных пунктов подставляются как 0,05, а не как число 5.

Если вся совокупность известна и невелика, результат корректируется:

n=Nn0N+n0−1\displaystyle n=\frac{Nn_0}{N+n_0-1}

N здесь число людей во всей группе. Калькулятор округляет итог вверх до целого ответа и никогда не показывает больше N. Поправка заметна, когда планируется опросить существенную часть группы. Для очень большой совокупности она почти не меняет результат.

Как выбрать погрешность и уровень доверия

Погрешность ±5 п.п. означает ширину вокруг оцененной доли, а не 5% от полученного числа. Если опрос показал 20%, то плановый интервал составляет примерно 15–25%, а не 19–21%. Для решения, где разница между вариантами составляет всего 2 п.п., точности ±5 п.п. мало: порядок вариантов может измениться в пределах погрешности.

Уровень доверия 95% описывает метод повторных случайных выборок. Если много раз провести опрос по одним правилам и каждый раз построить интервал, примерно 95% таких интервалов накроют постоянную истинную долю. Это не обещание, что любой конкретный интервал верен с вероятностью 95%, и не защита от неслучайного набора участников.

Повышение уровня доверия увеличивает требуемую выборку. При 50% ожидаемой доле и ±5 п.п. нужно 271 ответ для 90%, 385 для 95% и 664 для 99%. Когда предварительная оценка доли надёжна, её можно подставить вместо 50%. Например, для ожидаемых 20% при 95% и ±5 п.п. достаточно 246 ответов. Но если фактическая доля окажется ближе к 50%, выбранной выборки может не хватить на заявленную погрешность.

Где пригодится расчёт

Опрос жителей города. Для города с 100 000 взрослых жителей, доли 50%, доверия 95% и погрешности ±5 п.п. расчёт даёт 383 завершённых ответа. Почти столько же, сколько для неограниченной совокупности: большая численность города сама по себе не требует десятков тысяч анкет. При этом случайный отбор важнее красивого круглого числа в отчёте.

Мнение сотрудников. В компании из 1000 человек те же настройки дают 278 ответов. Опросить всех 1000 ради такой цели не обязательно, если каждый сотрудник имеет понятный шанс попасть в выборку. Доля охвата равна 27,8%, поэтому поправка на конечную группу уже заметна.

Небольшая команда. В подразделении из 80 человек для 95% и ±5 п.п. понадобятся 67 ответов, то есть почти весь отдел. Если отвечает только половина, точность из формы не сохранится. Здесь иногда проще пригласить всех и отдельно работать над полнотой ответов, чем спорить о десятых долях формулы.

Проверка редкого выбора в продукте. Если ранее около 20% пользователей включали новую функцию, при 95% и ±5 п.п. формула даёт 246 ответов для большой аудитории. Такой план годится для общей доли, но не для сравнения двух вариантов интерфейса: для проверки разницы между группами нужны ещё мощность теста и ожидаемый эффект.

Высокая точность исследования. При доверии 99%, ожидаемой доле 50% и погрешности ±3 п.п. уже нужны 1844 ответа. По сравнению с базовыми 385 это значительно дороже. Перед запуском проверьте, нужно ли различать доли настолько тонко, или практическое решение не изменится и при ±5 п.п.

Опрос аудитории с ожиданием 10%. Для доли 10%, уровня 95% и ±3 п.п. понадобится 385 завершённых анкет. Такое же число, как в базовом примере, вышло случайно из сочетания иных p и e; выводы о точности остаются разными. Если 10% было лишь догадкой, разумнее сначала провести пилотный опрос или взять осторожные 50%.

Почему нужное число ответов не гарантирует точный опрос

Формула предполагает простую случайную выборку: у каждого члена группы есть равный шанс попасть в неё. Если опрос открыт только подписчикам канала, посетителям одного сайта или людям, которые сами захотели отвечать, выборка может сместиться. Увеличение числа таких ответов уменьшает случайную погрешность, но не исправляет систематическую ошибку отбора.

Неответы тоже важны. Допустим, цель составляет 385 завершённых анкет, а ответит примерно 60% приглашённых. Тогда стоит отправить не менее 642 приглашений: 385 ÷ 0,60 округляется вверх. Это лишь план по количеству; если неответившие отличаются от ответивших по изучаемому признаку, смещение сохранится.

Для отдельных подгрупп число ответов нужно проверять заново. 385 ответов по всему городу не означают ±5 п.п. отдельно для каждого района или возрастного сегмента: в одном сегменте может оказаться лишь 40 человек. Если нужны выводы по районам, планируйте отбор и размер по каждому району, а затем учитывайте веса и дизайн исследования.

Результат этой страницы не заменяет расчёт мощности эксперимента, работу с кластерной выборкой или интервал для среднего. Когда уже есть измеренные числовые значения, посчитайте стандартное отклонение и используйте калькулятор доверительного интервала среднего для соответствующей задачи. Для доли в опросе сначала определите, какая именно группа считается совокупностью, и только потом выбирайте допустимую погрешность.

Частые вопросы

Размер ответа меняется от задачи опроса: сначала уточните совокупность и цель, затем проверьте, как будут набраны люди.

Почему при неизвестной доле берут 50%?

Произведение p × (1 − p) максимально при p = 0,5. Поэтому 50% даёт наибольший необходимый размер выборки при выбранных доверии и погрешности. Это осторожный план, а не прогноз результата опроса.

Что делать, если численность всей группы неизвестна?

Оставьте поле размера совокупности пустым. Калькулятор применит формулу для большой группы. Указание приблизительного огромного числа почти не изменит ответ, а выдумывать точную численность ради поля не нужно.

Можно ли считать ответы друзей случайной выборкой?

Обычно нет. Друзья похожи по возрасту, интересам или кругу общения и не представляют автоматически всех людей, о которых нужен вывод. Формальная погрешность такого удобного набора не описывает смещение отбора.

Почему число ответов округляется вверх?

Дробного завершённого ответа не существует. Округление вниз даст выборку меньше расчётной и может превысить выбранную границу погрешности. Поэтому результат 384,15 превращается в 385, а не в 384.

Сколько приглашений отправить, чтобы получить нужную выборку?

Разделите нужное число завершённых ответов на ожидаемую долю отклика и округлите вверх. Для 385 ответов и ожидаемых 50% это 770 приглашений. Если отклик неизвестен, начните с пилотной рассылки и пересчитайте план.

Подходит ли этот расчёт для сравнения двух вариантов?

Нет. Для различия двух долей важны минимальный значимый эффект, мощность теста, уровень ошибки и распределение участников между группами. Размер выборки для оценки одной общей доли не отвечает на вопрос, заметит ли эксперимент разницу.

Нужно ли исключать людей, которые не ответили на все вопросы?

Для конкретной доли считайте число пригодных ответов именно на соответствующий вопрос. Если из 400 анкет на него ответили 360 человек, реальный размер выборки для этого показателя равен 360, а не 400.

Можно ли уменьшить погрешность после завершения опроса?

Поменять число в настройке недостаточно. Для меньшей плановой погрешности нужны дополнительные пригодные ответы или другой корректный дизайн выборки. Уже полученные данные нельзя сделать более многочисленными округлением.

Похожие калькуляторы

Возможно вам пригодятся ещё несколько калькуляторов по данной теме:

Есть что добавить?

Напишите своё мнение, комментарий или предложение.