Определение ско. Что такое стандартное отклонение — использование функции стандотклон для расчета стандартного отклонения в excel

При статистической проверке гипотез, при измерении линейной взаимосвязи между случайными величинами.

Среднеквадратическое отклонение:

Стандартное отклонение (оценка среднеквадратического отклонения случайной величины Пол, стены вокруг нас и потолок,x относительно её математического ожидания на основе несмещённой оценки её дисперсии):

где - дисперсия ; - Пол, стены вокруг нас и потолок,i -й элемент выборки; - объём выборки; - среднее арифметическое выборки:

Следует отметить, что обе оценки являются смещёнными. В общем случае несмещённую оценку построить невозможно. Однако оценка на основе оценки несмещённой дисперсии является состоятельной .

Правило трёх сигм

Правило трёх сигм () - практически все значения нормально распределённой случайной величины лежат в интервале . Более строго - не менее чем с 99,7 % достоверностью значение нормально распределенной случайной величины лежит в указанном интервале (при условии, что величина истинная, а не полученная в результате обработки выборки).

Если же истинная величина неизвестна, то следует пользоваться не , а Пол, стены вокруг нас и потолок,s . Таким образом, правило трёх сигм преобразуется в правило трёх Пол, стены вокруг нас и потолок,s .

Интерпретация величины среднеквадратического отклонения

Большое значение среднеквадратического отклонения показывает большой разброс значений в представленном множестве со средней величиной множества; маленькое значение, соответственно, показывает, что значения в множестве сгруппированы вокруг среднего значения.

Например, у нас есть три числовых множества: {0, 0, 14, 14}, {0, 6, 8, 14} и {6, 6, 8, 8}. У всех трёх множеств средние значения равны 7, а среднеквадратические отклонения, соответственно, равны 7, 5 и 1. У последнего множества среднеквадратическое отклонение маленькое, так как значения в множестве сгруппированы вокруг среднего значения; у первого множества самое большое значение среднеквадратического отклонения - значения внутри множества сильно расходятся со средним значением.

В общем смысле среднеквадратическое отклонение можно считать мерой неопределенности. К примеру, в физике среднеквадратическое отклонение используется для определения погрешности серии последовательных измерений какой-либо величины. Это значение очень важно для определения правдоподобности изучаемого явления в сравнении с предсказанным теорией значением: если среднее значение измерений сильно отличается от предсказанных теорией значений (большое значение среднеквадратического отклонения), то полученные значения или метод их получения следует перепроверить.

Практическое применение

На практике среднеквадратическое отклонение позволяет определить, насколько значения в множестве могут отличаться от среднего значения.

Климат

Предположим, существуют два города с одинаковой средней максимальной дневной температурой, но один расположен на побережье, а другой внутри континента. Известно, что в городах, расположенных на побережье, множество различных максимальных дневных температур меньше, чем у городов, расположенных внутри континента. Поэтому среднеквадратическое отклонение максимальных дневных температур у прибрежного города будет меньше, чем у второго города, несмотря на то, что среднее значение этой величины у них одинаковое, что на практике означает, что вероятность того, что максимальная температура воздуха каждого конкретного дня в году будет сильнее отличаться от среднего значения, выше у города, расположенного внутри континента.

Спорт

Предположим, что есть несколько футбольных команд, которые оцениваются по некоторому набору параметров, например, количеству забитых и пропущенных голов, голевых моментов и т. п. Наиболее вероятно, что лучшая в этой группе команда будет иметь лучшие значения по большему количеству параметров. Чем меньше у команды среднеквадратическое отклонение по каждому из представленных параметров, тем предсказуемее является результат команды, такие команды являются сбалансированными. С другой стороны, у команды с большим значением среднеквадратического отклонения сложно предсказать результат, что в свою очередь объясняется дисбалансом, например, сильной защитой, но слабым нападением.

Использование среднеквадратического отклонения параметров команды позволяет в той или иной мере предсказать результат матча двух команд, оценивая сильные и слабые стороны команд, а значит, и выбираемых способов борьбы.

Технический анализ

См. также

Литература

* Боровиков, В. STATISTICA. Искусство анализа данных на компьютере: Для профессионалов / В. Боровиков. - СПб. : Питер, 2003. - 688 с. - ISBN 5-272-00078-1 .

Программа Excel высоко ценится как профессионалами, так и любителями, ведь работать с нею может пользователь любого уровня подготовки. Например, каждый желающий с минимальными навыками «общения» с Экселем может нарисовать простенький график, сделать приличную табличку и т.д.

Вместе с тем, эта программа даже позволяет выполнять различного рода расчеты, к примеру, расчет , но для этого уже необходим несколько иной уровень подготовки. Впрочем, если вы только начали тесное знакомство с данной прогой и интересуетесь всем, что поможет вам стать более продвинутым юзером, эта статья для вас. Сегодня я расскажу, что собой представляет среднеквадратичное отклонение формула в excel, зачем она вообще нужна и, собственно говоря, когда применяется. Поехали!

Что это такое

Начнем с теории. Средним квадратичным отклонением принято называть квадратный корень, полученный из среднего арифметического всех квадратов разностей между имеющимися величинами, а также их средним арифметическим. К слову, эту величину принято называть греческой буквой «сигма». Стандартное отклонение рассчитывается по формуле СТАНДОТКЛОН, соответственно, программа делает это за пользователя сама.

Суть же данного понятия заключается в том, чтобы выявить степень изменчивости инструмента, то есть, это, в своем роде, индикатор родом из описательной статистики. Он выявляет изменения волатильности инструмента в каком-либо временном промежутке. С помощью формул СТАНДОТКЛОН можно оценить стандартное отклонение при выборке, при этом логические и текстовые значения игнорируются.

Формула

Помогает рассчитать среднее квадратичное отклонение в excel формула, которая автоматически предусмотрена в программе Excel. Чтобы ее найти, необходимо найти в Экселе раздел формулы, а уже там выбрать ту, которая имеет название СТАНДОТКЛОН, так что очень просто.

После этого перед вами появится окошко, в котором нужно будет ввести данные для вычисления. В частности, в специальные поля следует вписать два числа, после чего программа сама высчитает стандартное отклонение по выборке.

Бесспорно, математические формулы и расчеты – вопрос достаточно сложный, и не все пользователи с ходу могут с ним справиться. Тем не менее, если копнуть немного глубже и чуть более детально разобраться в вопросе, оказывается, что не все так уж и печально. Надеюсь, на примере вычисления среднеквадратичного отклонения вы в этом убедились.

Видео в помощь

  • Ответы на экзаменационные вопросы по общественному здоровью и здравоохранению.
  • 1. Общественное здоровье и здравоохранение как наука и область практической деятельности. Основные задачи. Объект, предмет изучения. Методы.
  • 2. Здравоохранение. Определение. История развития здравоохранения. Современные системы здравоохранения, их характеристика.
  • 3. Государственная политика в области охраны здоровья населения (Закон Республики Беларусь "о здравоохранении"). Организационные принципы государственной системы здравоохранения.
  • 4. Страховая и частная формы здравоохранения.
  • 5. Профилактика, определение, принципы, современные проблемы. Виды, уровни, направления профилактики.
  • 6. Национальные программы профилактики. Роль их в укреплении здоровья населения.
  • 7. Врачебная этика и деонтология. Определение понятия. Современные проблемы врачебной этики и деонтологии, характеристика.
  • 8. Здоровый образ жизни, определение понятия. Социальные и медицинские аспекты здорового образа жизни (зож).
  • 9. Гигиеническое обучение и воспитание, определение, основные принципы. Методы и средства гигиенического обучения и воспитания. Требования к лекции, санитарному бюллетеню.
  • 10. Здоровье населения, факторы, влияющие на здоровье населения. Формула здоровья. Показатели, характеризующие общественное здоровье. Схема анализа.
  • 11. Демография как наука, определение, содержание. Значение демографических данных для здравоохранения.
  • 12. Статика населения, методика изучения. Переписи населения. Типы возрастных структур населения.
  • 13. Механическое движение населения. Характеристика миграционных процессов, влияние их на показатели здоровья населения.
  • 14. Рождаемость как медико-социальная проблема. Методика вычисления показателей. Уровни рождаемости по данным воз. Современные тенденции.
  • 15. Специальные показатели рождаемости (показатели фертильности). Воспроизводство населения, типы воспроизводства. Показатели, методика вычисления.
  • 16. Смертность населения как медико-социальная проблема. Методика изучения, показатели. Уровни общей смертности по данным воз. Современные тенденции.
  • 17. Младенческая смертность как медико-социальная проблема. Факторы, определяющие ее уровень.
  • 18. Материнская и перинатальная смертность, основные причины. Показатели, методика вычисления.
  • 19. Естественное движение населения, факторы на него влияющие. Показатели, методика вычисления. Основные закономерности естественного движения в Беларуси.
  • 20. Планирование семьи. Определение. Современные проблемы. Медицинские организации и службы планирования семьи в рб.
  • 21. Заболеваемость как медико-социальная проблема. Современные тенденции и особенности в Республике Беларусь.
  • 22. Медико-социальные аспекты нервно-психического здоровья населения. Организация психоневрологической помощи
  • 23. Алкоголизм и наркомания как медико-социальная проблема
  • 24. Болезни системы кровообращения как медико-социальная проблема. Факторы риска. Направления профилактики. Организация кардиологической помощи.
  • 25. Злокачественные новообразования как медико-социальная проблема. Основные направления профилактики. Организация онкологической помощи.
  • 26. Международная статистическая классификация болезней. Принципы построения, порядок пользования. Значение ее в изучении заболеваемости и смертности населения.
  • 27. Методы изучения заболеваемости населения, их сравнительная характеристика.
  • Методика изучения общей и первичной заболеваемости
  • Показатели общей и первичной заболеваемости.
  • Показатели инфекционной заболеваемости.
  • Основные показатели, характеризующие важнейшую неэпидемическую заболеваемость.
  • Основные показатели "госпитализированной" заболеваемости:
  • 4) Заболевания с временной утратой трудоспособности (вопрос 30)
  • Основные показатели для анализа заболеваемости с вут.
  • 31. Изучение заболеваемости по данным профилактических осмотров населения, виды профилактических осмотров, порядок проведения. Группы здоровья. Понятие «патологическая пораженность».
  • 32. Заболеваемость по данным о причинах смерти. Методика изучения, показатели. Врачебное свидетельство о смерти.
  • Основные показатели заболеваемости по данным о причинах смерти:
  • 33. Инвалидность как медико-социальная проблема Определение понятия, показатели. Тенденции инвалидности в Республике Беларусь.
  • Тенденции инвалидности в рб.
  • 34. Первичная медико-санитарная помощь (пмсп), определение, содержание, роль и место в системе медицинского обслуживания населения. Основные функции.
  • 35. Основные принципы первичной медико-санитарной помощи. Медицинские организации первичной медико-санитарной помощи.
  • 36. Организация медицинской помощи, предоставляемой населению амбулаторно. Основные принципы. Учреждения.
  • 37. Организация медицинской помощи в условиях стационара. Учреждения. Показатели обеспеченности стационарной помощью.
  • 38. Виды медицинской помощи. Организация специализированной медицинской помощи населению. Центры специализированной медицинской помощи, их задачи.
  • 39. Основные направления совершенствования стационарной и специализированной помощи в Республике Беларусь.
  • 40. Охрана здоровья женщин и детей в Республике Беларусь. Управление. Медицинские организации.
  • 41. Современные проблемы охраны здоровья женщин. Организация акушерско-гинекологической помощи в Республике Беларусь.
  • 42. Организация лечебно-профилактической помощи детскому населению. Ведущие проблемы охраны здоровья детей.
  • 43. Организация охраны здоровья сельского населения, основные принципы оказания медицинской помощи сельским жителям. Этапы. Организации.
  • II этап – территориальное медицинское объединение (тмо).
  • III этап – областная больница и медицинские учреждения области.
  • 45. Медико-социальная экспертиза (мсэ), определение, содержание, основные понятия.
  • 46. Реабилитация, определение, виды. Закон Республики Беларусь «о предупреждении инвалидности и реабилитации инвалидов».
  • 47. Медицинская реабилитация: определение понятия, этапы, принципы. Служба медицинской реабилитации в Республике Беларусь.
  • 48. Городская поликлиника, структура, задачи, управление. Основные показатели деятельности поликлиники.
  • Основные показатели деятельности поликлиники.
  • 49. Участковый принцип организации амбулаторной помощи населению. Виды участков. Территориальный терапевтический участок. Нормативы. Содержание работы участкового врача-терапевта.
  • Организация работы участкового терапевта.
  • 50. Кабинет инфекционных заболеваний поликлиники. Разделы и методы работы врача кабинета инфекционных заболеваний.
  • 52. Основные показатели, характеризующие качество и эффективность диспансерного наблюдения. Методика их вычисления.
  • 53. Отделение медицинской реабилитации (омр) поликлиники. Структура, задачи. Порядок направления больных в омр.
  • 54. Детская поликлиника, структура, задачи, разделы работы. Особенности оказания медицинской помощи детям в амбулаторных условиях.
  • 55. Основные разделы работы участкового педиатра. Содержание лечебно-профилактической работы. Связь в работе с другими лечебно-профилактическими учреждениями. Документация.
  • 56. Содержание профилактической работы участкового врача-педиатра. Организация патронажного наблюдения за новорожденными.
  • 57. Структура, организация, содержание работы женской консультации. Показатели работы по обслуживанию беременных женщин. Документация.
  • 58. Родильный дом, структура, организация работы, управление. Показатели деятельности родильного дома. Документация.
  • 59. Городская больница, ее задачи, структура, основные показатели деятельности. Документация.
  • 60. Организация работы приемного отделения больницы. Документация. Мероприятия по профилактике внутрибольничных инфекций. Лечебно-охранительный режим.
  • Раздел 1. Сведения о подразделениях, установках лечебно-профилактической организации.
  • Раздел 2. Штаты лечебно-профилактической организации на конец отчетного года.
  • Раздел 3. Работа врачей поликлиники (амбулаторий), диспансера, консультации.
  • Раздел 4. Профилактические медицинские осмотры и работа стоматологических (зубоврачебных) и хирургических кабинетов лечебно-профилактической организации.
  • Раздел 5. Работа лечебно-вспомогательных отделений (кабинетов).
  • Раздел 6. Работа диагностических отделений.
  • 62. Годовой отчет о деятельности стационара (ф. 14), порядок составления, структура. Основные показатели деятельности стационара.
  • Раздел 1. Состав больных в стационаре и исходы их лечения
  • Раздел 2. Состав больных новорожденных, переведенных в другие стационары в возрасте 0-6 суток и исходы их лечения
  • Раздел 3. Коечный фонд и его использование
  • Раздел 4. Хирургическая работа стационара
  • 63. Отчет о медицинской помощи беременным, роженицам и родильницам (ф. 32), структура. Основные показатели.
  • Раздел I. Деятельность женской консультации.
  • Раздел II. Родовспоможение в стационаре
  • Раздел III. Материнская смертность
  • Раздел IV. Сведения о родившихся
  • 64. Медико-генетическое консультирование, основные учреждения. Его роль в профилактике перинатальной и младенческой смертности.
  • 65. Медицинская статистика, ее разделы, задачи. Роль статистического метода в изучении здоровья населения и деятельности системы здравоохранения.
  • 66. Статистическая совокупность. Определение, виды, свойства. Особенности проведения статистического исследования на выборочной совокупности.
  • 67. Выборочная совокупность, требования, предъявляемые к ней. Принцип и способы формирования выборочной совокупности.
  • 68. Единица наблюдения. Определение, характеристика учетных признаков.
  • 69. Организация статистического исследования. Характеристика этапов.
  • 70. Содержание плана и программы статистического исследования. Виды планов статистического исследования. Программа наблюдения.
  • 71. Статистическое наблюдение. Сплошное и несплошное статистическое исследование. Виды несплошного статистического исследования.
  • 72. Статистическое наблюдение (сбор материалов). Ошибки статистического наблюдения.
  • 73. Статистическая группировка и сводка. Типологическая и вариационная группировка.
  • 74. Статистические таблицы, виды, требования к построению.

81. Среднее квадратическое отклонение, методика расчета, применение.

Приближенный метод оценки колеблемости вариационного ряда - определение лимита и амплитуды, однако не учитывают значений вариант внутри ряда. Основной общепринятой мерой колеблемости количественного приз­нака в пределах вариационного ряда является среднее квадратичес­кое отклонение (σ - сигма) . Чем больше среднее квадратическое отклонение, тем степень ко­леблемости данного ряда выше.

Методика расчета среднего квадратического отклонения включает следующие этапы:

1. Находят среднюю арифметическую величину (Μ).

2. Определяют отклонения отдельных вариант от средней арифмети­ческой (d=V-M). В медицинской статистике отклонения от средней обозначаются как d (deviate). Сумма всех от­клонений равняется нулю.

3. Возводят каждое отклонение в квадрат d 2 .

4. Перемножают квадраты отклонений на соответствующие частоты d 2 *p.

5. Находят сумму произведений (d 2 *p)

6. Вычисляют среднее квадратическое отклонение по формуле:

при n больше 30, или
при n меньше либо равно 30, где n - число всех вариант.

Значение среднего квадратичного отклонения:

1. Среднее квадратическое отклонение характеризует разброс вариант относительно средней величины (т.е. колеблемость вариационного ряда). Чем больше сигма, тем степень разнообразия данного ряда выше.

2. Среднее квадратичное отклонение используется для сравнительной оценки степени соответствия средней арифметической величины тому вариационному ряду, для которого она вычислена.

Вариации массовых явлений подчиняются закону нормального распределения. Кривая, отображающая это распределение, имеет вид плавной колоколообразной симметричной кривой (кривая Гаусса). Согласно теории вероятности в явлениях, подчиняющихся закону нормального распределения, между значениями средней арифметической и среднего квадратического отклонения существует строгая математическая зависимость. Теоретическое распределение вариант в однородном вариационном ряду подчиняется правилу трех сигм.

Если в системе прямоугольных координат на оси абсцисс отложить значения количественного признака (варианты), а на оси ординат - частоты встречаемости вариант в вариационном ряду, то по сторонам от средней арифметической равномерно располагаются варианты с большими и меньшими значениями.

Установлено, что при нормальном распределении признака:

68,3% значений вариант находится в пределах М1

95,5% значений вариант находится в пределах М2

99,7% значений вариант находится в пределах М3

3. Среднее квадратическое отлонение позволяет установить значения нормы для клинико-биологических показателей. В медицине интервал М1 обычно принимается за пределы нормы для изучаемого явления. Отклонение оцениваемой величины от средней арифметической больше, чем на 1 указывает на отклонение изучаемого параметра от нормы.

4. В медицине правило трех сигм применяется в педиатрии для индивидуальной оценки уровня физического развития детей (метод сигмальных отклонений), для разработки стандартов детской одежды

5. Среднее квадратическое отклонение необходимо для характеристики степени разнообразия изучаемого признака и вычисления ошибки средней арифметической величины.

Величина среднего квадра­тического отклонения обычно используется для сравнения колеблемости однотипных рядов. Если сравниваются два ряда с разными признаками (рост и масса тела, средняя длительность лечения в стационаре и больничная летальность и т.д.), то непосредственное сопоставление размеров сигм невозможно, т.к. среднеквадратичес­кое отклонение - именованная величина, выраженная в абсолютных числах. В этих случаях применяют коэффициент вариации (Cv ) , представляющий собой относительную величину: процентное отноше­ние среднего квадратического отклонения к средней арифметической.

Коэффициент вариации вычисляется по формуле:

Чем выше коэффициент вариации, тем большая изменчивость данно­го ряда. Считают, что коэффициент вариации свыше 30 % свиде­тельствует о качественной неоднородности совокупности.

Стандартное отклонение является одним из тех статистических терминов в корпоративном мире, которое позволяет поднять авторитет людей, сумевших удачно ввернуть его в ходе беседы или презентации, и оставляет смутное недопонимание тех, кто не знает, что это такое, но стесняется спросить. На самом деле большинство менеджеров не понимают концепцию стандартного отклонения и, если вы один из них, вам пора перестать жить во лжи. В сегодняшней статье я расскажу вам, как эта недооцененная статистическая мера позволит лучше понять данные, с которыми вы работаете.

Что измеряет стандартное отклонение?

Представьте, что вы владелец двух магазинов. И чтобы избежать потерь, важно, чтобы был четкий контроль остатков на складе. В попытке выяснить, кто из менеджеров лучше управляет запасами, вы решили проанализировать стоки последних шести недель. Средняя недельная стоимость стока обоих магазинов примерно одинакова и составляет около 32 условных единиц. На первый взгляд среднее значение стока показывает, что оба менеджера работают одинаково.

Но если внимательнее изучить деятельность второго магазина, можно убедится, что хотя среднее значение корректно, вариабельность стока очень высокая (от 10 до 58 у.е.). Таким образом, можно сделать вывод, что среднее значение не всегда правильно оценивает данные. Вот где на выручку приходит стандартное отклонение.

Стандартное отклонение показывает, как распределены значения относительно среднего в нашей . Другими словами, можно понять на сколько велик разброс величины стока от недели к неделе.

В нашем примере, мы воспользовались функцией Excel СТАНДОТКЛОН, чтобы рассчитать показатель стандартного отклонения вместе со средним.

В случае с первым менеджером, стандартное отклонение составило 2. Это говорит нам о том, что каждое значение в выборке в среднем откланяется на 2 от среднего значения. Хорошо ли это? Давайте рассмотрим вопрос под другим углом – стандартное отклонение равное 0, говорит нам о том, что каждое значение в выборке равно его среднему значению (в нашем случае, 32,2). Так, стандартное отклонение 2 ненамного отличается от 0, и указывает на то, что большинство значений находятся рядом со средним значением. Чем ближе стандартное отклонение к 0, тем надежнее среднее. Более того, стандартное отклонение близкое к 0, говорит о маленькой вариабельности данных. То есть, величина стока со стандартным отклонением 2, указывает на невероятную последовательность первого менеджера.

В случае со вторым магазином, стандартное отклонение составило 18,9. То есть стоимость стока в среднем отклоняется на величину 18,9 от среднего значения от недели к неделе. Сумасшедший разброс! Чем дальше стандартное отклонение от 0, тем менее точно среднее значение. В нашем случае, цифра 18,9 указывает на то, что среднему значению (32,8 у.е. в неделю) просто нельзя доверять. Оно также говорит нам о том, что еженедельная величина стока обладает большой вариабельностью.

Такова концепция стандартного отклонения в двух словах. Хотя оно не дает представление о других важных статистических измерениях (Мода, Медиана…), фактически стандартное отклонение играет решающую роль в большинстве статистических расчетов. Понимание принципов стандартного отклонения прольет свет на суть многих процессов вашей деятельности.

Как рассчитать стандартное отклонение?

Итак, теперь мы знаем, о чем говорит цифра стандартного отклонения. Давайте разберемся, как она считается.

Рассмотрим набор данных от 10 до 70 с шагом 10. Как видите, я уже рассчитал для них значение стандартного отклонения с помощью функции СТАНДОТКЛОН в ячейке H2 (оранжевым).

Ниже описаны шаги, которые предпринимает Excel, чтобы прийти к цифре 21,6.

Обратите внимание, что все расчеты визуализированы, для лучшего понимания. На самом деле в Excel расчет происходит мгновенно, оставляя все шаги за кулисами.

Для начала Excel находит среднее значение выборки. В нашем случае, среднее получилось равным 40, которое на следующем шаге отнимают от каждого значения выборки. Каждую полученную разницу возводят в квадрат и суммируют. У нас получилась сумма равная 2800, которую необходимо разделить на количество элементов выборки минус 1. Так как у нас 7 элементов, получается необходимо 2800 разделить на 6. Из полученного результата находим квадратный корень, это цифра будет стандартным отклонением.

Для тех, кому не совсем ясен принцип расчета стандартного отклонения с помощью визуализации, привожу математическую интерпретацию нахождения данного значения.

Функции расчета стандартного отклонения в Excel

В Excel присутствует несколько разновидностей формул стандартного отклонения. Вам достаточно набрать =СТАНДОТКЛОН и вы сами в этом убедитесь.

Стоит отметить, что функции СТАНДОТКЛОН.В и СТАНДОТКЛОН.Г (первая и вторая функция в списке) дублируют функции СТАНДОТКЛОН и СТАНДОТКЛОНП (пятая и шестая функция в списке), соответственно, которые были оставлены для совместимости с более ранними версиями Excel.

Вообще разница в окончаниях.В и.Г функций указывают на принцип расчета стандартного отклонения выборки или генеральной совокупности. Разницу между двумя этими массивами я уже объяснял в предыдущей .

Особенностью функций СТАНДОТКЛОНА и СТАНДОТКЛОНПА (третья и четвертая функция в списке), является то, что при расчете стандартного отклонения массива в расчет принимаются логические и текстовые значения. Текстовые и истинные логические значения равняются 1, а ложные логические значения равняются 0. Мне трудно представить ситуацию, когда бы мне могли понадобится эти две функции, поэтому, думаю, что их можно игнорировать.

Стоит отметить, что у такого расчета дисперсии есть недостаток – она получается смещенной, т.е. ее математическое ожидание не равно истинному значению дисперсии. Подробней об этом . В то же время не все так плохо. При увеличении объема выборки она все-таки приближается к своему теоретическому аналогу, т.е. является асимптотически не смещенной. Поэтому при работе с большими размерами выборок можно использовать формулу выше.

Язык знаков полезно перевести на язык слов. Получится, что дисперсия — это средний квадрат отклонений. То есть вначале рассчитывается среднее значение, затем берется разница между каждым исходным и средним значением, возводится в квадрат, складывается и затем делится на количество значений в данной совокупности. Разница между отдельным значением и средней отражает меру отклонения. В квадрат возводится для того, чтобы все отклонения стали исключительно положительными числами и чтобы избежать взаимоуничтожения положительных и отрицательных отклонений при их суммировании. Затем, имея квадраты отклонений, мы просто рассчитываем среднюю арифметическую. Средний – квадрат – отклонений. Отклонения возводятся в квадрат, и считается средняя. Разгадка заключается всего в трех словах.

Однако в чистом виде, как, например, средняя арифметическая, или индекс, дисперсия не используется. Это скорее вспомогательный и промежуточный показатель, который необходим для других видов статистического анализа. У нее даже единицы измерения нормальной нет. Судя по формуле, это квадрат единицы измерения исходных данных. Без бутылки, как говорится, не разберешься.

{module 111}

Дабы вернуть дисперсию в реальность, то есть использовать в более приземленных целей, из нее извлекают квадратный корень. Получается так называемое среднеквадратичное отклонение (СКО) . Встречаются названия «стандартное отклонение» или «сигма» (от названия греческой буквы). Формула стандартного отклонения имеет вид:

Для получения этого показателя по выборке используют формулу:

Как и с дисперсией, есть и немного другой вариант расчета . Но с ростом выборки разница исчезает.

Среднеквадратичное отклонение, очевидно, также характеризует меру рассеяния данных, но теперь (в отличие от дисперсии) его можно сравнивать с исходными данными, так как единицы измерения у них одинаковые (это явствует из формулы расчета). Но и этот показатель в чистом виде не очень информативен, так как в нем заложено слишком много промежуточных расчетов, которые сбивают с толку (отклонение, в квадрат, сумма, среднее, корень). Тем не менее, со среднеквадратичным отклонением уже можно работать непосредственно, потому что свойства данного показателя хорошо изучены и известны. К примеру, есть такое правило трех сигм , которое гласит, что у данных 997 значений из 1000 находятся в пределах ±3 сигмы от средней арифметической. Среднеквадратичное отклонение, как мера неопределенности, также участвует во многих статистических расчетах. С ее помощью устанавливают степень точности различных оценок и прогнозов. Если вариация очень большая, то стандартное отклонение тоже получится большим, следовательно, и прогноз будет неточным, что выразится, к примеру, в очень широких доверительных интервалах.

Коэффициент вариации

Среднее квадратическое отклонение дает абсолютную оценку меры разброса. Поэтому чтобы понять, насколько разброс велик относительно самих значений (т.е. независимо от их масштаба), требуется относительный показатель. Такой показатель называется коэффициентом вариации и рассчитывается по следующей формуле:

Коэффициент вариации измеряется в процентах (если умножить на 100%). По этому показателю можно сравнивать самых разных явлений независимо от их масштаба и единиц измерения. Данный факт и делает коэффициент вариации столь популярным.

В статистике принято, что, если значение коэффициента вариации менее 33%, то совокупность считается однородной, если больше 33%, то – неоднородной. Мне здесь трудно что-то прокомментировать. Не знаю, кто и почему так определил, но это считается аксиомой.

Чувствую, что я увлекся сухой теорией и нужно привести что-то наглядное и образное. С другой стороны все показатели вариации описывают примерно одно и то же, только рассчитываются по-разному. Поэтому разнообразием примеров блеснуть трудно, Отличаться могут лишь значения показателей, но не их суть. Вот и сравним, как отличаются значения различных показателей вариации для одной и той же совокупности данных. Возьмем пример с расчетом среднего линейного отклонения (из ). Вот исходные данные:

И график для напоминания.

По этим данным рассчитаем различные показатели вариации.

Среднее значение – это обычная средняя арифметическая.

Размах вариации – разница между максимумом и минимумом:

Среднее линейное отклонение считается по формуле:

Стандартное отклонение:

Расчет сведем в табличку.

Как видно, среднее линейное и среднеквадратичное отклонение дают похожие значения степени вариации данных. Дисперсия – это сигма в квадрате, поэтому она всегда будет относительно большим числом, что, собственно, ни о чем не говорит. Размах вариации – это разница между крайними значениями и может говорить о многом.

Подведем некоторые итоги.

Вариация показателя отражает изменчивость процесса или явления. Ее степень может измеряться с помощью нескольких показателей.

1. Размах вариации – разница между максимумом и минимумом. Отражает диапазон возможных значений.
2. Среднее линейное отклонение – отражает среднее из абсолютных (по модулю) отклонений всех значений анализируемой совокупности от их средней величины.
3. Дисперсия – средний квадрат отклонений.
4. Среднеквадратичное отклонение – корень из дисперсии (среднего квадрата отклонений).
5. Коэффициент вариации – наиболее универсальный показатель, отражающий степень разброса значений независимо от их масштаба и единиц измерения. Коэффициент вариации измеряется в процентах и может быть использован для сравнения вариации различных процессов и явлений.

Таким образом, в статистическом анализе существует система показателей, отражающих однородность явлений и устойчивость процессов. Часто показатели вариации не имеют самостоятельного смысла и используются для дальнейшего анализа данных (расчет доверительных интервалов