Что означает понятие репрезентативность выборки. Репрезентативность социологического исследования. Преднамеренные и непреднамеренные ошибки репрезентативности

Фактически мы начнем не с одного, а с трех вопросов: что такое выборка? когда она является репрезентативной? что она собой представляет?

Совокупность – это любая группа людей, организаций, интересующих нас событий, относительно которых мы хотим сделать выводы, а случай, или объект, – любой элемент такой совокупности 1 .Выборка – любая подгруппа совокупности случаев (объектов), выделенная для анализа. Если мы захотим изучить деятельность законодателей штата по принятию решений, мы могли бы исследовать такую деятельность в законодательных органах штатов Виргиния, Северная Каролина и Южная Каролина, а не во всех пятидесяти штатах и, исходя из этого, распространить полученные данные на генеральную совокупность, из которой были выбраны эти три штата. Если мы хотим исследовать систему предпочтений избирателей Пенсильвании, мы могли бы сделать это, опросив 50 рабочих компании “Ю. С. Стил” в Питсбурге, и распространить результаты опроса на всех избирателей штата. Аналогично, если мы хотим измерить умственные способности студентов колледжей, мы могли быпротестировать всех игроков защиты, зарегистрированных в штате Огайо в данном футбольном сезоне, и затем распространить полученные результаты на генеральную совокупность, частью которой они являются. В каждом примере мы действуем следующим образом: устанавливаем подгруппу внутри генеральной совокупности, довольно подробно изучаем эту подгруппу, или выборку, и распространяем наши результаты на всю совокупность. Это и есть основные этапы формирования выборки.

Однако представляется совершенно очевидным, что каждая из этих выборок имеет существенный недостаток. К примеру, хотя законодательные органы Виргинии, Северной Каролины и Южной Каролины и являются частью совокупности законодательных органов штатов, они в силу исторических, географических и политических причин, скорее всего, будут действовать очень схожим образом и совсем иначе, чем законодательные органы таких отличающихся от них штатов, как Нью-Йорк, Небраска и Аляска. Хотя пятьдесят рабочих-сталелитейщиков в Питсбурге действительно могут быть избирателями штата Пенсильвания, они в силу социально-экономического статуса, образования и жизненного опыта, вполне возможно, будут иметь взгляды, отличные от взглядов многих других людей, точно так же являющихся избирателями. И точно так же, хотя футболисты штата Огайо и являются студентами колледжей, они в силу самых разных причин вполне могут отличаться от других студентов. Иными словами, хотя каждая из этих подгрупп действительно является выборкой, члены каждой из них систематически отличаются от большинства остальных членов совокупности, из которой они выбраны. В качестве отдельной группы ни одна из них не является типичной с точки зрения распределения признаков мнений, мотивов поведения и характеристик в генеральной совокупности, с которой она ассоциируется. Соответственно, политологи сказали бы, что ни одна из этих выборок не является репрезентативной.

Репрезентативная выборка – это такая выборка, в которой все основные признаки генеральной совокупности, из которой извлечена данная выборка, представлены приблизительно в той же пропорции или с той же частотой, с которой данный признак выступает в этой генеральной совокупности. Таким образом, если 50% всех законодательных органов штатов собираются лишь раз в два года, приблизительно половина состава репрезентативной выборки законодательных органов штатов должна быть такого типа. Если 30% избирателей Пенсильвании принадлежат к “синим воротничкам”, около 30% репрезентативной выборки для этих избирателей (а не 100%, как в приведенном выше примере) должны быть из числа “синих воротничков”. И если 2% всех студентов колледжей являются спортсменами, приблизительно та же самая часть репрезентативной выборки студентов колледжей должна приходиться на спортсменов. Инымисловами, репрезентативная выборка представляет собой микрокосм, меньшую по размеру, но точную модель генеральной совокупности, которую она должна отражать. В той степени, в какой выборка является репрезентативной, выводы, основанные на изучении этой выборки, можно без всяких опасений считать применимыми к исходной совокупности. Это распространение результатов и есть то, что мы называем генерализуемостью.

Возможно, пояснить это поможет графическая иллюстрация. Предположим, мы хотим изучать модели членства в политических группах среди взрослого населения США. На рис.5.1 изображено три круга, разделенных на шесть равных секторов. Рис.5.1а представляет всю рассматриваемую совокупность. Члены совокупности расклассифицированы в соответствии с политическими группами (такими, как партии и группы интересов), к которым они относятся. В этом примере каждый взрослый принадлежит по меньшей мере к одной и не более чем к шести политическим группам; и эти шесть уровней членства в одинаковой степени распространены в совокупности (отсюда равные сектора). Предположим, мы хотим исследовать мотивы вступления людей в группу, выбор группы и модели участия, однако из-за ограниченности ресурсов мы в состоянии обследовать только одного из каждых шести членов совокупности. Кого же отобрать для анализа?

Рис. 5.1. Формирование выборки из генеральной совокупности

Одну из возможных выборок заданного объема иллюстрирует заштрихованная область на рис.5.1б, однако она явно не отражает структуру совокупности. Если бы мы делали обобщения на основе этой выборки, мы пришли бы к выводу: (1) что все взрослые американцы принадлежат к пяти политическим группам и (2) что все групповое поведение американцев совпадает с поведением тех, кто принадлежит именно к пяти группам. Однако мы знаем, что первый вывод не верен, и это может зародить в нас сомнение относительно валидности второго. Таким образом, выборка, изображенная на рис.5.1б, нерепрезентативна, поскольку она не отражает распределение данного свойства совокупности (часто называемогопараметром ) в соответствии с его реальным распространением. Про такую выборку говорят, что она смещена в направлении к членам пяти групп или смещена в направлении от всех остальных моделей членства в группах. Опираясь на такую смещенную выборку, мы обычно приходим к ошибочным выводам относительно генеральной совокупности.

Ярче всего это может быть продемонстрировано на примере катастрофы, постигшей в 30-е годы журнал “Литэрари дайджест”, который организовал опрос общественного мнения относительно результатов выборов. “Литэрари дайджест” представлял собой периодическое издание, в котором перепечатывались редакционные статьи из газет и другие материалы, отражавшие общественноемнение; этот журнал был очень популярен в начале века. Начиная с 1920 г. журнал проводил широкомасштабный общенациональный опрос, в ходе которого более чем миллиону человек по почте рассылались избирательные бюллетени с просьбой отметить, чья кандидатура на предстоящих президентских выборах для них предпочтительнее. В течение ряда лет результаты опроса, проводившиеся журналом, оказывались настолько точными, что опрос, проведенный в сентябре, казалось, делал ноябрьские выборы малосущественными. Да и как притакой большой выборке могла произойти ошибка? Однако в 1936 г. именно это и случилось: с большим перевесом голосов (60:40) победа была предсказана кандидату от республиканской партии Альфу Ландону. На выборах Ландон проиграл инвалиду – Франклину Д. Рузвельту – практически с тем же результатом, с которым должен был победить. Доверие к “Литэрари дайджест” было столь сильно подорвано, что вскоре после этого журнал перестал выходить. Что же произошло? Все очень просто: в голосовании, проведенном “Дайджест”, использовалась смещенная выборка. Почтовые открытки рассылались людям, чьи имена были извлечены из двух источников: телефонных справочников и списков регистрации автомобилей. И хотя прежде этот метод отбора не слишком отличался от других методов, совсем по-другому обстояло дело теперь, во время Великой депрессии 1936 г., когда менее состоятельные избиратели, наиболее вероятная опора Рузвельта, не могли позволить себе иметь телефон, не говоря уж об автомобиле. Таким образом, фактически выборка, использовавшаяся в опросе, организованном “Дайджест”, была смещена в сторону тех, кто, скорее всего, должен был выступать за республиканцев, и при этом еще удивительно, что у Рузвельта был такой хороший результат.

Как же решить эту проблему? Возвращаясь к нашему примеру, сравним выборку на рис.5.1б с выборкой на рис.5.1в. В последнем случае для анализа также отобрана шестая часть совокупности, однако каждый из основных типов совокупности представлен в выборке в той пропорции, в которой он представлен во всей совокупности. Такая выборка демонстрирует, что один из каждых шести взрослых американцев принадлежит к одной политической группе, один из шести – к двум и т.д. Такая выборка позволит также выявить другие различия между ее членами, которые могли бы соотноситься с участием в разном числе групп. Таким образом, выборка, представленная на рис.5.1в, является репрезентативной выборкой для рассматриваемой совокупности.

Конечно, данный пример является упрощенным по крайней мере с двух чрезвычайно важных точек зрения. Во-первых, большинство совокупностей, интересующих политологов, более разнообразно, чем та, что приведена в примере. Люди, документы, правительства, организации, решения и т.п. отличаются друг от друга не по одному, а по гораздо большему числу признаков. Таким образом, репрезентативная выборка должна быть такой, чтобы каждая из основных, отличная от других область была представлена пропорционально ее доле в совокупности. Во-вторых, ситуация, когда реальное распределение переменных, или признаков, которые мы хотим измерить, заранее неизвестно, встречается гораздо чаще, чем противоположная, – возможно, оно не измерялось в предшествующей переписи населения. Таким образом, репрезентативная выборка должна быть построена так, чтобы она могла точно отражать существующее распределение даже тогда, когда мы не в состоянии прямо оценить ее валидность. Процедура формирования выборки должна иметь внутреннюю логику, способную убедить нас, что, будь мы в состоянии сравнить выборку с переписью, она действительно оказалась бы репрезентативной.

Чтобы обеспечить возможность точного отражения сложной организации данной совокупности и определенную степень уверенности в том, что предлагаемые процедуры способны сделать это, исследователи обращаются к методам статистики. При этом они действуют по двум направлениям. Во-первых, используя определенные правила (внутреннюю логику), исследователи решают вопрос о том, какие именно конкретные объектыим изучать, что именно включать в конкретную выборку. Во-вторых, используя совсем другие правила, они решают, сколько объектов выбрать. Мы не будем подробно изучать эти многочисленные правила, рассмотрим лишь их роль в политологическом исследовании. Начнем рассмотрение со стратегий выбора объектов, образующих репрезентативную выборку.

Анализ и оценка репрезентативности выборки
Анализ выборки проводился при помощи рандоминизации выборочной совокупности на предмет ее однородности, отсутствия статистической ошибки, а репрезентативность оценивалась путем сравнения выборочной и генеральной совокупности работников, на возможность и обоснованность распространения выявленных взаимозависимостей на всю генеральную совокупность. Однако, следует отметить, что вопросы, связанные с репрезентативностью выборки, не достаточно для применимости данной модели, поскольку успешность применения любой модели зависит не только от ее достоверности, но и от используемого метода и условий конкретной ситуации.
Способы формирования выборочной совокупности и ее отклонение от случайной определяет систематическую ошибку, которая снижает репрезентативность выборки. Достоверность рассчитанных данных и выявленных взаимозависимостей в значительной степени определяются репрезентативностью выборочной совокупности, которая, в свою очередь, зависит от процедуры отбора исследуемых единиц - самих работников из генеральной совокупности. В данном исследовании выборочная совокупность формировались из работников современных организаций. Поскольку мотивация как явление рассматривается на индивидуальном уровне, то и выборочная совокупность представляла собой совокупность работников различных организаций. Механизм и процедура выборки работников из генеральной совокупности была многоступенчатой и комбинированной.
Многоступенчатость выборки заключалась в следующем: первая ступень - отбор организаций, на этой ступени преобладал типический отбор, а выборка строилась на выборе организаций разных как по виду бизнеса и области деятельности, так и по используемой технологии и размерам. Вторая ступень выборки представляла собой выбор функционального отдела или рабочей группы, работники которой опрашивались. На этом этапе способ отбора был близок к серийному отбору, когда выборочные совокупности - объединены в небольшие группы. Третья ступень выборки - выбор непосредственно самих работников, которые анкетировались. На этой ступени, авторы пытались приблизить выборку к случайной, то есть предоставить равные шансы работникам для участия в опросе. Таким образом, на стадии выборочной совокупности авторы стремились

Таблица П10.1
Репрезентативность выборки и возможность генерализации выводов



Распределение работающих по категориям

Выборочная
совокупность
%

Генеральная
совокупность"
%

1.

Руководители / менеджеры

31

8,6

2.

Специалисты

32

29,3

3.

Рабочие / исполнитель

37

59,1

4.

Другие специальности

-

3,2


Распределение работающих по возрасту

Выборочная
совокупность
%

Генеральная
совокупность
%

1.

15-19 лет

14

2,1

2.

20-24 лет

9,9

3.

25-29 лет

46

10,5

4.

30-39 лет

31,4

5.

40-49 лет

36

29,0

6.

59-54 лет

6,4

7.

55-59 лет

4

7,4

8.

60-72 лет

3,3


Распределение работников по уровню образования

Выборочная
совокупность
%

Генеральная
совокупность
%

1.

Нет образования

-

1,7

2.

Основное общее

10

11,8

3.

Среднее общее / среднее

34,6

4.

Среднее профессиональное / техникум

22

33,1

5.

Высшее профессиональное / высшее

68

18,8

‘ По данным Государственного комитета по статистике за 1997 г.

максимально приблизить способ отбора к случайному, что способствует формированию репрезентативной, представительной выборки.
Многоступенчатость выборки способствует сглаживанию возможных систематических ошибок, а случайность выборки определяется в большей степени выборкой непосредственно самих работников современных организаций.
Сравнение выборочной совокупности с генеральной выявило некоторые особенности, которые необходимо учитывать при генерализации полученных в исследовании выводов.
Во-первых, распределение выборочной совокупности по возрасту практически совпало с генеральной совокупностью, что является свидетельством случайности выборки работников и подтверждает правильность выбранного механизма и процедуры отбора работников.
Во-вторых, распределение работающих по категориям или должностям имеет смещение в выборке от категорий рабочие/исполнитель в категорию руководители/менеджеры. Это объясняется частично тем, что в категорию менеджеры попали работники, отвечающие за весь процесс в целом (руководители проектов, процессов), а так же работники имеющие в своем подчинении других работников (руководители групп, мастера, бригадиры).
В-третьих, уровень образования отразил в себе систематические ошибки связанные с проведением данного исследования в современных организациях г. Москвы, а также в организациях «открытых» для исследования.
Проверка репрезентативности выборки опирается на случайность в опросе самих работников, объем и представительность выборки, ее соответствие генеральной совокупности, допуская при этом наличие систематической ошибки при выборе самих организаций и отделов внутри организаций.
Другим инструментом оценки репрезентативности и однородности выборки является рандоминизация - разветвленный опрос, контролируемый на предмет изменения качественного содержания выборки и ее отличия от генеральной совокупности.
Рандоминизация
Вся выборка была разделена на две подгруппы, статистическая репрезентативность подгрупп достигается случайным их разбросом, группа А - нечетные, группа Б - четные порядковые номера анкет. Репрезентативность позволяет обобщить полученные результаты на всю генеральную совокупность.
Важно отметить, небольшие расхождения в составе полученных в ходе рандоминизации подвыборок, что говорит об однородности выборки

Таблица П10.2


Показатели
мотивации

МПБ

УАР

ПВЗ

СВЛ

УУ

ПР

ОР

Четная выборка

120

68

117

99

112

77

80

Нечетная выборка

121

75

113

103

98

81

82

Вся выборка (224)

120

71

115

101

105

79

81

Расхождение в % от среднего

0,5%

4,8%

1,7%

2,3%

6,6%

2,5%

0,8%

Среднеквадратическое отклонение a

Четная выборка

71

51

87

53

70

44

54

Нечетная выборка

73

50

84

50

65

46

52

Вся выборка (224)

77

55

96

54

70

46

56

и приближении процедуры отбора к случайной, с другой стороны, незначительные расхождения в значении соответствующих показателей мотивации работой. На основании незначительности расхождения показателей, в пределах 5 %, отклонений (см. табл. П10.2), можно сделать вывод о правильности выбранного способа отбора работников. Исправление состава выборки для точного соответствия официальным статистическим данным, не даст значимых изменений.
Таблица П10.3
Оценка оценки однородности выборки

Продолжение таблицы П10.3



Четная

Нечетная

Д

Ошибка

свыше 55 лет

5
/>2
43

3,0

Образование





Среднее

10

10

0

0,0

Техническое

24

19

12

5,0

Высшее

46

47

1

1,0

Бизнес-образование

15

16

3

1,0

Ученая степень

5

8

23

3,0

Вид образования





Гуманитарное

34

24

17

10,0

Техническое

55

57

2

2,0

Гуманитарное и техническое

11

9

10

2,0

Занимаемая должность





Исполнитель

34

40

8

6,0

Специалист

35

29

9

6,0

Менеджер

31

31

0

0,0

Стаж работы в должности





до 0.5 года

29

24

8

4,5

от 0.5 до 2 лет

40

42

2

1,8

от 2 до 5 лет

17

21

12

4,5

от 5 до 10 лет

6

7

7

0,9

свыше 10 лет

8

5

20

2,7


3,1%

В данном исследовании важно также исследовать возможные систематические ошибки при формировании выборочной совокупности, которые не зависят от числа повторений эксперимента, но способные внести коррективы и ограничения в сферу применимости предложенной модели.


Средняя удельная ошибка составляет 3,1 %, что меньше 5 %. Результаты проведенной рандоминизации и анализа на однородность выборочной совокупности показывают, что выбранный метод формирования выборки близок к случайному.

Выборка— это множество данных, взятых с помощью определённых процедур из генеральной совокупности для исследовательского анализа. Репрезентативность - это свойство воспроизведения представления о целом по его части. По иному, это возможность распространения представления о части на целое, которое эту часть включает в себя.

Репрезентативность выборки — это показатель, заключающийся в том, что выборка должна полно и достоверно отображать признаки той совокупности, частью которой она является. Её также можно определять как свойство выборки наиболее полно представлять характеристики генеральной совокупности, существенные с точки зрения цели исследования.

Допустим, что генеральная совокупность — все ученики школы (900 человек из 30 классов, по 30 человек в каждом классе). Объект исследования — отношение школьников к курению. Выборочная совокупность, состоящая из 90 учащихся только намного хуже представит всю совокупность, чем выборка из тех же 90 учеников, куда вошли бы из каждого класса по 3 ученика. Главная причина — неравное распределение по возрастам. Таким образом, в первом случае репрезентативность выборки будет низкой. Во втором случае - высокой.

В социологии говорят, что существует репрезентативность выборки и её нерепрезентативность.

В качестве примера нерепрезентативной выборки можно привести классический случай, произошедший в 1936 году в США во время президентских выборов.

Журнал «Литэрари дайджест», который до этого весьма успешно прогнозировал результаты предыдущих выборов, на этот раз ошибся в своих прогнозах, хотя разослал несколько миллионов письменных вопросов подписчикам, а также респондентам, которых они выбрали из телефонных книг и из списков регистрации автомобилей. В 1/4 бюллетеней, которые вернулись заполненные обратно, голоса распределились следующим образом: 57 % отдали первенство кандидату от республиканцев по имени Альф Лэндон, а 41 % отдали предпочтение действующему президенту - демократу Франклину Рузвельту.

В действительности, на выборах победил Ф. Рузвельт, который набрал почти 60 % голосов. Ошибка «Литэрари дайджест» была в следующем. Они захотели увеличить репрезентативность выборки. А так как они знали, что большинство их подписчиков относят себя к республиканцам, то они решили расширить выборку за счёт респондентов, выбранных ими из телефонных книг и автомобильных регистрационных списков. Но они не учли существующих реалий и фактически отобрали ещё больше сторонников республиканцев, потому что во времена иметь автомобили и телефоны мог позволить себе средний и высший класс. А это и были по большей части республиканцы, а не демократы.

Существуют различные виды выборки: простая случайная, серийная, типическая, механическая и комбинированная.

Простая случайная выборка состоит в отборе из всей совокупности изучаемых единиц наугад без какой-либо системы.

Механическую выборку применяют тогда, когда в генеральной совокупности есть упорядоченность, например, имеется некая последовательность единиц работников, избирательные списки, номера телефонов респондентов, номера квартир и домов и другое).

Типический отбор используется тогда, когда всю совокупность можно разделить на группы по типам. При работе с населением такими могут быть, например, образовательные, возрастные, социальные группы, при исследовании предприятий - отрасль или отдельная организация и др.

Серийный отбор удобен тогда, когда единицы объединены в небольшие серии или группы. Такой серией могут быть партии готовой продукции, школьные классы, и другие группы.

Комбинированная выборка предполагает использование всех предыдущих видов выборки в той или иной комбинации.

Понятие репрезентативности часто встречается в статистических отчетностях и при подготовке выступлений и докладов. Пожалуй, без нее трудно представить себе какой-либо из видов подачи информации на обозрение.

Репрезентативность - что это?

Репрезентативность отражает, насколько выбранные объекты или части соответствуют содержанию и смыслу совокупности данных, из которой они были выбраны.

Другие определения

Понятие репрезентативности можно раскрывать в разных контекстах. Но по своему смыслу репрезентативность - это соответствие черт и свойств выбранных единиц из общей совокупности, которые точно отражают характеристики всей генеральной базы данных в целом.

Также репрезентативность информации определяют как способность выборочных данных представить параметры и свойства совокупности, важные с точки зрения проводимого исследования.

Репрезентативная выборка

Принцип формирования выборки заключается в избрании наиболее важных и точно отображающих свойства общей совокупности данных. Для этого используются различные методы, которые позволяют получать точные результаты и общее представление о используя только выборочные материалы, описывающие качества всех данных.

Таким образом, нет необходимости изучать весь материал, а достаточно рассмотреть выборочную репрезентативность. Что это? Это выборка отдельных данных для того, чтобы иметь понятие об общей массе информации.

Их в зависимости от способа различают как вероятностные и невероятностные. Вероятностная - это выборка, которая производится путем вычисления наиболее важных и интересных данных, являющихся в дальнейшем представителями генеральной совокупности. Это обдуманный выбор или случайная выборка, тем не менее, обоснованная своим содержанием.

Невероятностная - это одна из разновидностей случайной выборки, составляющаяся по принципу обычной лотереи. В таком случае не учитывается мнение того, кто составляет такую выборку. Используется лишь слепой жребий.

Вероятностная выборка

Вероятностные выборки также могут подразделяться на несколько видов:

  • Одна из самых простых и понятных принципов - это нерепрезентативная выборка. К примеру, такой способ часто используется при проведении социальных опросов. При этом участники опроса не выбираются из толпы по каким-либо определенным признакам, и получение информации производится у первых 50 людей, принявших участие в нём.
  • Преднамеренные выборки отличаются тем, что имеют ряд требований и условий при отборе, однако все же полагаются на случайное совпадение, не преследуя своей целью достижение хорошей статистики.
  • Выборка на основании квот - это еще одна из вариаций невероятностной выборки, которая часто используется для исследования больших совокупностей данных. Для нее используется множество условий и норм. Подбираются объекты, которые должны им соответствовать. То есть на примере социального опроса можно предположить, что опрошены будут 100 человек, но только мнение некоторого числа людей, которые будут соответствовать установленным требованиям, будут учтены при составлении статистического отчета.

Вероятностные выборки

Для вероятностных выборок исчисляется ряд параметров, которым объекты в выборке будут соответствовать, и среди них разными способами могут избираться именно те факты и данные, которые будут представлены как репрезентативность данных выборки. Такими способами вычисления нужных данных могут быть:

  • Простая случайная выборка. Заключается в том, что среди выбранного сегмента совершенно случайным методом лотереи выбирается необходимое количество данных, которые будут являться репрезентативной выборкой.
  • Систематическая и случайная выборка дает возможность составить систему вычисления необходимых данных на основе случайно выбранного сегмента. Таким образом, если первое случайное число, которое указывает на порядковый номер данных, выбранных из общей совокупности, будет 5, то последующими данными, которые будут выбраны, могут стать, например, 15, 25, 35 и так далее. Этот пример наглядно объясняет, что даже случайный выбор может основываться на систематических вычислениях необходимых исходных данных.

Выборка потребителей

Осмысленная выборка - это способ, который заключается в рассмотрении каждого отдельного сегмента, и на основании его оценки составляется совокупность, отражающая характеристики и свойства общей базы данных. Таким образом набирается большее количество данных, соответствующих требованиям репрезентативной выборки. Можно легко отобрать некоторое количество вариантов, которые не войдут в общее число, не потеряв при этом качество отобранных данных, представляющих общую совокупность. Таким способом определяется репрезентативность результатов исследования.

Размер выборки

Не последний вопрос, который необходимо решить, - это размер выборки для репрезентативного представления генеральной совокупности. Размер выборки не всегда зависит от количества исходников в генеральной совокупности. Однако репрезентативность выборочной совокупности напрямую зависит от того, на сколько сегментов должен быть в итоге разделён результат. Чем больше таких сегментов, тем больше данных попадает в результативную выборку. Если результаты требуют общего обозначения и не требуют конкретики, тогда, соответственно, выборка становится меньше, поскольку, не вдаваясь в детали, информация излагается более поверхностно, а значит, ее прочтение будет общим.

Понятие ошибки репрезентативности

Ошибка репрезентативности - это конкретные расхождения между характеристиками генеральной совокупности и выборочных данных. При проведении любого выборочного исследования невозможно получить абсолютно точные данные, как при полном исследовании генеральных совокупностей и выборки, представленной лишь частью сведений и параметров, тогда как более детальное изучение возможно только при исследовании всей совокупности. Таким образом, неизбежны некоторые погрешности и ошибки.

Виды ошибок

Различают некоторые ошибки, которые возникают при составлении репрезентативной выборки:

  • Систематические.
  • Случайные.
  • Преднамеренные.
  • Непреднамеренные.
  • Стандартные.
  • Предельные.

Основанием для появления случайных ошибок может быть несплошной характер исследования общей совокупности. Обычно случайная ошибка репрезентативности имеет незначительный размер и характер.

Систематические ошибки между тем возникают при нарушении правил отбора данных из общей совокупности.

Средняя ошибка - это разница между усредненными значениями выборки и основной совокупностью. Она не зависит от количества единиц в выборке. Она обратно пропорциональна Тогда чем больше объем, тем меньше значение средней ошибки.

Предельная ошибка - это наибольшая возможная разница между усредненными значениями сделанной выборки и общей совокупностью. Такая ошибка охарактеризовывается как максимум вероятных ошибок при заданных условиях их появления.

Преднамеренные и непреднамеренные ошибки репрезентативности

Ошибки смещения данных бывают преднамеренными и непреднамеренными.

Тогда причинами появления преднамеренных ошибок является подход к подбору данных по методу определения тенденций. Непреднамеренные ошибки возникают еще на стадии подготовки выборочного наблюдения, формирования репрезентативной выборки. Для недопущения подобных ошибок необходимо создать хорошую основу для выборки, составляющей списки единиц отбора. Она должна полностью соответствовать целям проведения выборки, быть достоверной, охватывающей все аспекты исследования.

Валидность, надежность, репрезентативность. Расчет ошибок

Расчет ошибки репрезентативности (Мм) средней арифметической величины (М).

Среднее квадратическое отклонение: численность выборки (>30).

Ошибка репрезентативности (Мр) и (Р): численность выборки (n>30).

В том случае, когда приходится изучать совокупность, где количество выборки мало и составляет меньше 30 единиц, тогда число наблюдений станет меньше на одну единицу.

Величина ошибки прямо порциональна объему выборки. Репрезентативность информации и вычисление степени возможности составления точного прогноза отражает определенная величина предельной ошибки.

Репрезентативные системы

Не только в процессе оценки подачи информации используется репрезентативная выборка, но и сам человек, получающий информацию, использует репрезентативные системы. Таким образом, мозг обрабатывает некоторое создавая репрезентативную выборку из всего потока информации, чтобы качественно и быстро оценить подаваемые данные и понять суть вопроса. Ответить на вопрос: «Репрезентативность - что это?» - в масштабах человеческого сознания довольно просто. Для этого мозг использует все подвластные в зависимости от того, какую именно информацию необходимо вычленить из общего потока. Таким образом, различают:

  • Визуальную репрезентативную систему, где задействуются органы зрительного восприятия глаза. Люди, часто использующие подобную систему, называются визуалами. С помощью этой системы человек обрабатывает информацию, поступающую в виде изображений.
  • Аудиальная репрезентативная система. Главный орган, который используется - это слух. Информация, подаваемая в виде звуковых файлов или речи, обрабатываются именно этой системой. Люди, лучше воспринимающие информацию на слух, называются аудиалами.
  • Кинестетическая репрезентативная система представляет собой обработку потока информации, путем восприятия его с помощью обонятельных и осязательных каналов.

  • Дигитальная репрезентативная система используется вместе с другими как средство получения информации извне. восприятие и осмысление полученных данных.

Итак, репрезентативность - что это? Простая выборка из множества или неотъемлемая процедура при обработке информации? Однозначно можно сказать, что репрезентативность во многом определяет наше восприятие потоков данных, помогая вычленить из него наиболее веские и значимые.

Понятие репрезентативности в социологическом исследовании

Другими словами, репрезентативность – это качество выборки. Выборка может быть репрезентативной или нерепрезентативной. Если в социологическом исследовании применялась большая группа людей, то выборка будет репрезентативной.

Определение 2

Выборка – это отобранное определенное количество элементов генеральной совокупности. Репрезентативная выборка характерна тем, что все элементы генеральной совокупности представлены в той же пропорции.

Репрезентативность выборки социологического исследования определяется двумя случайными компонентами: ошибками, которые были допущены при регистрации и случайными ошибками.

Пример 1

Например: если объект социологического исследования сложный и имеет несколько элементов, то потребуется большее количество интервьюеров. Не всегда все интервьюеры имеют хорошую квалификацию, что может привести к ошибкам при регистрации. В отличие от этого, проведение выборочного исследования интервьюерами, которые более подготовлены и проинструктированы, ведёт к уменьшению количества ошибок, то есть к случайным ошибкам.

Построение выборки сводится к трём основным проблемам:

  • определить объем выборки (то есть построить определенную процедуру, для того чтобы выборка была репрезентативной);
  • определить объём выборки (количество, которое нужно опросить);
  • оценка качества выборки (анализ точности результатов).

Замечание 1

Важно помнить, что показатели выборки и генеральной совокупности не должны превышать 5%. Если такая пропорция нарушается, то выводы такого социологического исследования не будут соответствовать действительности.

Типы выборок

Выборки делятся на: случайные и целенаправленные.

Случайная выборка является наиболее точной и репрезентативной. Суть данной выборки в том, что благодаря случайному отбору, все единицы генеральной совокупности имеют одинаковые шансы попасть в выборочную совокупность. Такой вид выборки обычно используется перед выборами, референдумами и другими массовыми мероприятиями. Помимо того, что данная выборка даёт нам точность, она имеет сложности в применении. Для того, чтобы провести случайною выборку, социолог должен иметь список элементов генеральной совокупности, что не всегда даётся легко. Случайный отбор требует большого объема выборки для получения точных результатов.

Разновидностями случайной выборки бывают серийная, районированная, механическая и другие.

  • Серийная или гнездовая выборка имеет вид серий. Заключается в отборе отдельных элементов (семья, группа, школа, коллектив и т.д.), которые подвергаются сплошному исследованию.
  • Районированную выборку используют в тех случаях, когда весь массив данных нужно разбить на однородные части. Такими частями могут выступать районы города.
  • Принцип механической выборки заключается в том, что все элементы генеральной совокупности относят в один список и с него через равные интегралы отбирают необходимое количество респондентов. Механическая выборка имеет соотношение генеральной совокупности к выборочной. Например: Если генеральная совокупность 2000 человек, а выборочная 200, то это значит, что с общего списка отбирается каждый десятый.

Целенаправленная выборка – это вид выборки, где отбор осуществляется по критериям доступности, типичности, равенства и т.д. Целенаправленная выборка делится на стихийную, метод снежного кома и квотную.

  • Стихийная выборка – это выборка первого встречного. Минус данной выборки заключается в том, что невозможно заранее установить генеральную совокупность.
  • Метод снежного кома заключается в нарастании информации. Каждый опрашиваемый респондент даёт контакты коллег, друзей, знакомых, которые могут принять участие в исследование и т.д.
  • Квотная выборка. В данной выборке все данные являются квотой. При использовании квотной выборки респондентов подбирают целенаправленно, придерживаясь параметров квот. Характеристики, которые отбирают по квотам – это пол, образование, возраст, уровень квалификации или другие, которые определяются целями и заданиями самого социологического исследования.