АНАЛИТИКА // БЕСПЛАТНЫЙ ИНСТРУМЕНТ

Калькулятор A/B-теста онлайн

Сравните долю конверсий двух независимых вариантов. Калькулятор использует двусторонний z-тест пропорций и отдельно проверяет, достаточно ли событий для приближения.

БесплатноБез регистрацииВ вашем браузере
Калькулятор A/B-теста: Сравните две конверсии и статистическую значимость.

01 // ИСХОДНЫЕ ДАННЫЕ

Попробуйте на своих данных

В полях — условный пример. Измените значения и получите результат.

Уникальные независимо распределённые участники.
Не больше одной учитываемой конверсии на участника.
Один участник не должен входить в обе группы.
Число участников, совершивших целевое действие.

02 // ВАШ РЕЗУЛЬТАТ

От данных к решению

Результат появится после загрузки инструмента.

Расчёт и обработка полей выполняются локально. Инструмент не отправляет введённые значения на сервер.

МЕТОДИКА

Как работает калькулятор a/b-теста

z = (pB − pA) / √[p × (1 − p) × (1/nA + 1/nB)], где p = (конверсии A + конверсии B) / (nA + nB)

Пример

В условном примере A: 100 из 1 000, B: 130 из 1 000. Конверсия выросла с 10% до 13%: разница +3 процентных пункта, относительный прирост +30%. Двустороннее p-value около 0,035.

Что проверяет тест

Нулевая гипотеза предполагает одинаковую вероятность конверсии вариантов. Малое p-value показывает, что наблюдаемая или более сильная разница маловероятна при этой гипотезе и выполнении условий теста. Это не вероятность того, что B лучше A.

Условия корректного сравнения

Нужны случайное распределение, независимые группы, одна метрика и заранее выбранный момент остановки. Для нормального приближения здесь требуется не менее 10 конверсий и 10 неконверсий в каждой группе. При меньших числах итог о значимости не выводится: нужен точный метод или больше наблюдений.

Как принимать решение

Смотрите не только на p-value, но и на величину эффекта, стоимость внедрения и вторичные метрики. 95% интервал разницы рассчитан методом Вальда с непулированной дисперсией, а тест — с пулированной. Эти приближения могут немного различаться у границы значимости. Многократные проверки и ранняя остановка увеличивают риск ошибочного решения.

Частые вопросы

Почему выбран порог 0,05?

Это распространённый уровень значимости для одного заранее спланированного теста. Он не заменяет расчёт мощности и план эксперимента.

Можно ли вводить число заказов вместо покупателей?

Только если у каждого участника учитывается максимум один исход. Для повторных заказов на пользователя этот тест пропорций не подходит.

Что означает отсутствие значимости?

Данных недостаточно, чтобы отвергнуть равенство долей на выбранном уровне. Это не доказательство одинаковой эффективности вариантов.

Редакция ЛИДЫ.РФ · Обновлено 13.09.2026