Заметка

DORA metrics и SPACE framework: метрики, которые не ломают команду

Сколько метрик в DORA — четыре или пять? Ответ поменялся в 2025 году вместе с уровнями Elite–Low и названием самой организации.

Вопрос на собеседовании: сколько метрик у DORA. Ответ «четыре» звучит уверенно и с 2025 года неверен. Метрик пять, одна из прежних переименована, уровни Elite–Low отменены, а сама DORA больше не расшифровывается: аббревиатуру «отвязали», а годовой отчёт переименовали из Accelerate State of DevOps в State of AI-assisted Software Development.

Это не косметика. Каждое изменение пришло оттуда, где метрики чаще всего ломают команды.

Пять метрик вместо четырёх

Пятая — deployment rework rate: доля деплоев, которые никто не планировал, а выкатывать пришлось из-за инцидента в проде. Она ловит то, чего четвёрка не видела. Команда с приличной частотой релизов и низким change fail rate может половину выкатов тратить на разгребание последствий предыдущих — по старым четырём метрикам такая команда выглядит здоровой.

MTTR исчезла как название. На её месте failed deployment recovery time — время восстановления после деплоя, который потребовал немедленного вмешательства. Формулировка уже прежней: метрика говорит про деплой, а не про любой инцидент.

Дальше деталь, на которой спотыкаются почти все пересказы. Пять метрик разложены по двум группам, и раскладка контринтуитивная:

ГруппаМетрики
Throughputchange lead time, deployment frequency, failed deployment recovery time
Instabilitychange fail rate, deployment rework rate

Время восстановления лежит в пропускной способности, а не в стабильности. Логика простая: выкатить фикс — это тоже провести изменение через систему, и скорость здесь определяется тем же конвейером. В instability остались две метрики о том, насколько плохо проходят сами деплои. Сократить время восстановления помогает не отдельный «процесс реагирования», а то же, что ускоряет обычный релиз, плюс способность быстро найти причину — про инструменты этого поиска есть отдельный разбор.

Уровней больше нет

Elite, High, Medium, Low ушли. Отчёт 2025 года — кластерный анализ ответов почти пяти тысяч человек — дал семь профилей команд, в которых производительность, стабильность и самочувствие людей переплетены. На одном краю «harmonious high-achievers», сильные и по доставке, и по благополучию. На другом — команды с «foundational challenges» и запертые в «legacy bottleneck», где нестабильные системы подтачивают мораль.

Смена таблички здесь не главное. Пороги уровней пересчитывались каждый год заново: «Elite» образца 2019-го и «Elite» образца 2023-го — разные числа. Команда, которая из года в год отчитывалась «мы High», сравнивала себя с движущейся мишенью. Теперь мишени нет, а есть профиль, в который входит выгорание.

Где метрики ломают команду

DORA прямо называет два способа испортить измерение, и оба живут в типовом платформенном дашборде.

Первый — сделать метрику целью. Закон Гудхарта работает без осечек: задача «поднять deployment frequency» лечится дроблением одного релиза на пять пустых. Число вырастет, доставка останется прежней. Здоровый ход обратный — снижать цену релиза, чтобы частота выросла сама: канареечные выкаты и атомарный деплой двигают сразу и частоту, и change fail rate, потому что меняют механику, а не отчётность.

Второй — сравнивать несравнимое. DORA рекомендует применять метрики к одному приложению или сервису и предупреждает про сравнения систем разной природы. Свести метрики нескольких команд в общий рейтинг — ровно то, ради чего дашборд обычно и заводят.

Отсюда практическое правило: пять метрик меряют систему доставки, а не людей. Тренд одной команды во времени — валидное применение. Таблица лидеров между командами — нет.

Где здесь SPACE

SPACE framework (Forsgren, Storey, Maddila, Zimmermann, Houck, Butler; ACM Queue, февраль 2021) отвечает на другой вопрос: не «как быстро едет система», а «как это переживают люди». Пять измерений — Satisfaction, Performance, Activity, Communication, Efficiency & flow. Главный тезис авторов: продуктивность не сводится к одной метрике, нужны несколько измерений сразу.

Самое опасное измерение — Activity. Коммиты, пул-реквесты и деплои считаются легче всего и потому первыми попадают в отчёт наверх. Активность — контекст, а не цель: «много коммитов» не равно «много ценности», а подкрутить это число тривиально.

До 2025 года две модели делили работу: DORA мерила исходы доставки, SPACE — самочувствие. Профили команд эту границу стёрли. Благополучие теперь лежит внутри той же модели, которой меряют доставку.

Что делать с цифрами из презентаций

«Elite-команды деплоят в 208 раз чаще и имеют в 106 раз более короткий lead time» — цифры настоящие, из Accelerate State of DevOps 2019. Им семь лет, и кластеры, которые они описывают, упразднены. Такая цифра на слайде 2026 года характеризует не индустрию, а год, в котором слайд собрали.

Проверка занимает пять минут. Если в дашборде метрика называется MTTR, метрик четыре, а команды разложены по шкале Elite–Low — измерение идёт по редакции, которую авторы заменили. Названия поправить дёшево. Дороже отучиться от привычки сравнивать команды между собой: её породила именно та таблица.

© 2026 axyi.ru · CC BY 4.0