Правильный ответ для Москвы и России будет одинаковым - 2 400 человек.
Это противоречит наивному представлению, что чем больше исходная совокупность, тем больше должна быть выборка для исследования.
Размер выборки определяется точностью исследования, а не величиной исходной совокупности. Чем большей точности мы хотим достигнуть, тем больше должна быть выборка.
Например, если я хочу быть уверенным на 99%, что реальный процент инвесторов будет плюс-минус 1% от рассчитанного в исследовании, мне придется опросить уже 16 500 человек. Это число будет одинаковым и для района, и для Москвы, и для России в целом.
Важно другое: выборка во всех случаях должна быть случайной.
➡️ 2400 человек, случайно выбранных среди жителей района;
➡️ 2400 человек, случайно выбранных среди жителей Москвы;
➡️ 2400 человек, случайно выбранных среди жителей России.
На этом спотыкается большинство исследований.
Любая неслучайная выборка сразу делает результаты исследования ненадежными.
Самый простой пример: добровольное участие в опросе. Такая выборка по определению не может быть случайной, поскольку исследование пропускает целый пласт населения, которые просто не участвуют в опросах.
🚂 РЖД после каждой поездки просит меня заполнить небольшую анкету и получить 100 баллов бонусов за это.
Увы, анкета начинается с того, что надо заполнить официальную информацию о поездке: дату, номер поезда, вагона и места.
Почему нельзя сделать так, чтобы эти данные подставлялись сами, ведь анкета приходит автоматически после каждой поездки?
Мне обычно лень ради 100 бонусов искать билет и всю нужную информацию в нем. Наверняка я такой не один.
В итоге, этими опросами РЖД не охватывает, наверное, самых прибыльных своих клиентов - занятых людей, для которых время ценнее 100 бонусов.
В нормальных исследованиях всегда большая часть отводится тому, какие данные собирались для исследования и каким образом это делалось. Без этой информации исследование - шлак.
Post #263
288
- 👍 7
- 🔥 3