August 7

Насколько надежен 3 минутный all out тест для определения тренировочных зон?

На самом деле в велоспорте очень много следует математике, о чем как раз на конференции Science and Cycling многие PhD Students свои работы презентуют. Например power duration curve- зависимост мощности от временного отрезка, которая следует power law (или степенному закону).

Из этого закона мы можем вывести PD Curve (красной линией) даже если некоторые отрезки (рекорды мощности) атлетом не обновлялись (провал на минуте 45 на графике ниже).

Из этого закона много относительно легко и (иногда) очень точно смодулировать мощность атлета на 30 мин, час, 2, 3 часа, используя лишь несколько коротких максимальных ускорений (и эксель табличку) - посчитав критическую мощность (critical power- CP) - которую иногда приравнивают к ФТП (но это опять же не так). Тест на CP обычно включает в себя 2 - 3 ускорения от 1 минуты до 12 минут - в зависимости от метода. Также отсюда считаем W' - количество работы в J которое атлет может совершить ВЫШЕ своего СР.

Как вы видите на графике ниже слева колонку - смотря какие отрезки мощности мы возьмем - расчет СР будет отличаться друг от друга.

Группа из Немецкого спортивного университета в Кёльне взяла всю накопленную за эти двадцать лет литературу и посчитала, насколько трёхминутка (один лишь тест на 3 минуты! - дада есть такой тестик, валите на 3 минуты на всю мощность - последние 30 секунд и будут вашей критической мощностью) на самом деле воспроизводима и насколько она валидна.

Логика понятна — три минуты вместо пяти визитов в лабораторию, один файл, две цифры на выходе: EP (endtest power, средняя мощность последних 30 секунд) как оценка критической мощности и WEP (work above endtest power) как оценка W′. Тест придумали Burnley и Vanhatalo в 2006 году.

Свежий систематический обзор с мета-анализом даёт неудобный ответ: воспроизводимость почти идеальная, валидность — нет. И это два принципиально разных свойства измерительного инструмента, которые в тренерской практике постоянно путают.

Дизайн: 20 работ, 284 человека, двадцать лет протоколов

Поиск по PubMed и Web of Science (PRISMA 2020, отсечка 20 июня 2025 года) дал 81 запись, после дедупликации и отсева осталось 20 исследований, N = 284. Из них 15 работ про валидность, 8 про воспроизводимость, 3 про то и другое. Размеры выборок — от 6 до 53 человек, уровень подготовки от нетренированных (PL 1) до профессионалов (PL 5).

Эргометры: чаще всего Lode Excalibur Sport, дальше CompuTrainer, SRM и обычные смарт-тренажёры. Режим — линейный у 13 работ (фиксированное сопротивление, cadence плавает), изокинетический у 4 (фиксированная каденция, сопротивление подстраивается), freely geared у 3. Референсом для валидации в 10 из 15 работ служили классические CP и W′, посчитанные из 3–5 отдельных выездов до отказа (TTE), остальные сравнивали EP с 16,1-км time trial, с MMSS по лактату и V̇O₂, с мышечной оксигенацией.

Мета-анализ — random effects по Hedges' gz, с расчётом 95% prediction intervals и CLES (common language effect size — вероятность того, что у конкретного человека EP окажется выше CP). Отдельно оценена уверенность по GRADE. Забегая вперёд: именно PI и CLES здесь важнее классических доверительных интервалов, потому что тренер работает не со средним по популяции, а с одним конкретным атлетом.

Что показали цифры

Первое — воспроизводимость отличная и она не зависит почти ни от чего. ICC для EP — 0,89–0,99, коэффициент вариации от 1,2% до 3,3% . Для WEP хуже, но всё ещё прилично: ICC 0,76–0,98, но CV уже до 17,9%. Ни тип эргометра, ни режим, ни уровень подготовки на это существенно не влияли — при двух условиях: повторный тест в пределах трёх недель и полноценный ознакомительный тест до этого.

Второе — EP систематически завышает CP. В абсолютных числах: средняя разница +11,7 Вт, а вот limits of agreement — от −37,1 до +60,5 Вт. Почти сотня ватт разброса.

Третье — WEP не является оценкой W′. средняя разница −3,0 кДж, LoA от −14,1 до +8,0 кДж. Авторы обзора формулируют прямо: оценивать W′ через WEP они настоятельно не советуют.

Четвёртое — главный методологический рычаг это каденс, и он тянет в разные стороны. Выше каденс на тесте → ниже EP → лучше согласие с CP. Но для WEP всё наоборот: он ближе к W′ на низком каденсе, а на высоком занижается. Оптимизировать оба параметра одним тестом невозможно — обзор честно рекомендует заранее выбирать один целевой.

Пятое, и для дистанционной работы это самое важное. Maunder (2022) сделал трёхминутку в remote-формате, на домашних смарт-тренажёрах, без подтверждённой вербальной поддержки. EP превысил реальное максимальное метаболическое устойчивое состояние на 18 ± 11% по критерию V̇O₂ и на 20 ± 12% по лактату. Для атлета с честным ФТП 260 Вт это EP около 310 Вт. Дальше — зоны от 310, и «зона 2» уползает туда, где на самом деле уже переход из 3 в 4ую зону!!

По GRADE итог такой: воспроизводимость EP — без замечаний, воспроизводимость WEP — умеренные опасения, валидность обоих параметров — высокие, а для WEP местами тяжёлые опасения по несогласованности и неточности.

КАК ПРИМЕНИТЬ НА ПРАКТИКЕ

Тест говно. Не ставьте зоны от EP. Это главное. Если вы использовали трёхминутку как «быстрый FTP-тест», пересчитайте: в среднем вы завысили порог на 12 Вт, но у конкретного атлета ошибка может быть и −37, и +60 Вт. Атлет из моей практики делал самостоятельно всегда 3 мин тест тк вычитал его в интернете и думал что он очень даже ок - получил EP 302 Вт и расчитывал по нему зоны; мы сделали три максимальных отрезка на 3, 6 и 12 минут которые дали CP 279 Вт. Разница в 23 Вт — это вся ширина его третьей зоны, и все длинные выезды «в зоне 2» у него шли по факту на верхней границе тяжёлого домена. Через шесть недель — уплощение HRV, потеря темповых способностей и полная уверенность в том, что он «просто мало отдыхает».

Если тест всё-таки делаете — соблюдайте четыре условия из обзора: полноценный ознакомительный тест (не инструктаж, а полный прогон); каденс ≥ 100 об/мин, ; полная потеря по времени - атлет не должен видеть сколько осталось времени, сколько он ватт жмет — никакого таймера, обратного отсчёта, ватт на экране. Без пейсинга: трёхминутный тест — это не time trial, и смешивать эти понятия в инструкции атлету нельзя.

Для CP используйте отдельные максимальные отрезки. В своей практике я ставлю финальную цифру порога только по пересечению нескольких источников: CP из отрезков, mFTP, 20-минутный MMP, 45m MMP — и беру нижнюю границу сходящегося диапазона, а не самую красивую.

WEP не выбрасывайте, но переименуйте. Как оценка W′ он бесполезен, как самостоятельный proxy анаэробной ёмкости — вполне рабочая метрика для отслеживания у одного атлета, при условии, что каденс и протокол одинаковы от теста к тесту.

Если нужен V̇O₂peak — сразу после трёхминутки добавьте square wave примерно на 10% выше полученного EP. В самой трёхминутке истинный V̇O₂max достигается не всегда. Pmax из этого теста извлечь нельзя в принципе: для него нужно сопротивление от 7,5% массы тела и каденс около 110 об/мин, что несовместимо с задачей теста.

МОЙ ВЗГЛЯД

Авторы посчитали prediction intervals и CLES — а не только доверительные интервалы. Это редкость и это ровно то, что нужно практику: тренеру безразличен средний эффект по «вселенной протоколов», ему нужна вероятность промаха у одного человека, стоящего сейчас перед ним.

Теперь к неудобному. В тексте статьи корреляция пулированных EP и CP указана как r = 0,993, а на самом графике — r = 0,933. Разница не косметическая: 98,6% общей дисперсии против 87%. Схожая нестыковка в диапазоне выборок: абстракт заявляет n = 6–21, раздел результатов — n = 6–53 (одна работа Maunder с 53 участниками). Мелочь, но в мета-анализе, который сам себя позиционирует как аудит чужой методологии, такие вещи режут глаз.

Дальше — выбор эффект-сайза. Авторы считают gz на основе разницы средних и её собственного стандартного отклонения, то есть на связанных выборках, и сами оговариваются, что этот подход раздувается при высокой корреляции между измерениями. Они называют это намеренным консерватизмом. Я бы сформулировал иначе: gz = 0,408 нельзя читать как «умеренный физиологический эффект». Реальное смещение — +11,7 Вт, то есть около 4–5% от CP испытуемого. Средняя ошибка в 12 ватт была бы терпимой; ошибка «где-то между минус 37 и плюс 60» делает инструмент непригодным для индивидуального назначения зон, при том что для групповых сравнений он остаётся вполне приемлемым.

Про мотивацию. В обзоре несколько раз всплывает, что результат all-out теста зависит от «сильной вербальной поддержки», а часть работ вообще не указала, была ли поддержка. То есть оценка критической мощности атлета частично определяется тем, насколько громко кричит человек, стоящий рядом с тренажёром. Это не придирка — это фундаментальный дефект объективности метода, и он неустраним. Для дистанционного формата, где кричать некому, он превращается из теоретического в практический: у Maunder именно remote-версия дала 18–20% завышения относительно ФТП.

И самое болезненное — доступность рекомендации. Итоговый рецепт обзора: изокинетический режим, ≥100 об/мин, полное ознакомление (атлет должен вначале проехать пробный тест чтобы сделать потом тест), изоляция атлета от секундомера/ватт во время теста. Изокинетический режим есть на Lode Excalibur и SRM. У 99% практикующих тренеров и атлетов их нет, а смарт-тренажёр в ERG-режиме — это не изокинетика. Получается, что валидный вариант теста недоступен именно той аудитории, которая выбирала 3х минутный тест за счет его простоты. Честный практический вывод из этой работы жёстче, чем формулируют авторы: вне лаборатории трёхминутку для оценки CP использовать не стоит совсем.

ИТОГ

Трёхминутный all-out — превосходно воспроизводимый тест и посредственная оценка критической мощности. Это не парадокс: воспроизводимость говорит, что тест стабилен, валидность — что он показывает нужную величину, и второе из первого не следует никогда. Используйте трёхминутку так, как она того заслуживает: как отдельный, стабильный, повторяемый показатель профиля, который вы отслеживаете у своего атлета в динамике при жёстко зафиксированном протоколе. Но если вы завтра назначаете кому-то зоны — посмотрите, откуда взялась цифра порога. Если она пришла из одной трёхминутки на домашнем тренажёре без ознакомительного теста и без человека, который орёт за спиной последние тридцать секунд "PUSH IT HARD", — с вероятностью около шестидесяти процентов вы сейчас загоняете своего атлета в тяжёлый домен и называете это зоной 2.

Quittmann OJ, Piehl MA. The 3-min all-out test in cycling: a systematic review and meta-analysis on its reliability and validity. Eur J Appl Physiol. 2026 Jul 21. doi: 10.1007/s00421-026-06356-w. https://doi.org/10.1007/s00421-026-06356-w