Вы посчитали конверсию как долю успешных сессий среди всех сессий, но один пользователь может создавать много сессий. Какой главный риск для теста долей?

AРиск отсутствует: чем больше сессий, тем точнее оценка, и независимостью испытаний на уровне сессий можно смело пренебрегать
BДостаточно поменять z-test на точный биномиальный тест, и проблема зависимости сессий внутри пользователя автоматически исчезнет даже на больших выборках
CНарушается независимость испытаний внутри пользователя, стандартная ошибка занижается, и лучше агрегировать долю до user_id или учитывать кластеризацию
DБольшое число сессий автоматически делает p-value равным 0, поэтому различиями между сессиями одного пользователя в этой задаче можно пренебречь
Правильный ответ. Если испытания не независимы, то оценка стандартной ошибки доли и p-value могут быть неверными.

Разбор

Сессии одного пользователя обычно коррелируют, поэтому считать их независимыми испытаниями опасно. Это часто приводит к завышенной уверенности: стандартная ошибка становится слишком маленькой, и тест чаще показывает значимость. Типичный выход — считать долю на уровне пользователя или использовать методы, учитывающие зависимость внутри пользователя. Ошибка — игнорировать единицу анализа и радоваться очень значимому результату.

Можно заниматься бесплатно

Готовим вопросы…

Три вопроса по теме этой страницы, с объяснениями.

Тренировать статистику в браузере

Ещё вопросы по теме «Тесты для долей»