Статистика для аналитика с нуля: как читать данные и не делать лишних выводов
Базовый маршрут по статистике для аналитика: выборка, распределение, среднее, медиана, интервал неопределённости и проверка гипотезы на рабочих примерах.
Практическая полка о статистике для аналитика: как читать распределения, оценивать неопределённость, проверять эксперименты и переводить результат в решение.
Три материала, которые задают базу для остальных.
20 материалов
Базовый маршрут по статистике для аналитика: выборка, распределение, среднее, медиана, интервал неопределённости и проверка гипотезы на рабочих примерах.
Разбираем среднее арифметическое, медиану и моду на примерах выручки, времени доставки и размера заказа: когда показатели расходятся и что писать в выводе.
Понятное объяснение дисперсии и стандартного отклонения для аналитика: как читать разброс, сравнивать сегменты и не путать вариативность с ошибкой данных.
Как использовать процентили и квантили для latency, времени доставки, чеков и пользовательского опыта: формулы, примеры, ошибки и правила интерпретации.
Как читать форму распределения в аналитике: нормальное, скошенное, двугорбое и дискретное распределения, их связь со средним, медианой и выбором метода.

Разбор на модельном наборе из 2000 заказов: правило 1,5×IQR помечает 6% заказов, из которых аномальны пять. Как отличить ошибку от редкого клиента и что делать с каждым случаем.

Разбор на учебной базе курса: связь «создал отчёт — дольше остаётся» выглядит убедительно и статистически значима, но полностью объясняется каналом привлечения. Как это увидеть в SQL и что делать дальше.
Что такое sampling error и bias, как они появляются в продуктовых данных, опросах и дашбордах и какие проверки помогают не обобщать нерепрезентативную выборку.

Что означает 95% доверительный интервал для конверсии и разницы конверсий, как его посчитать, почему он важнее p-value и какая формулировка про него неверна.

Что на самом деле измеряет p-value, почему 0,05 — не граница истины, как читать его вместе с доверительным интервалом и что делать, когда результат «незначим».
Практическое сравнение t-test и z-test для аналитика: когда использовать тест для средних, когда для долей, какие допущения проверить и чем не заменить эксперимент.
Как использовать chi-square в аналитике для категориальных признаков: таблица сопряжённости, независимость, ожидаемые частоты, effect size и практические ограничения.