Количество PR никогда не было хорошей метрикой. С AI стало ещё хуже
Раньше объём активности хотя бы был ограничен физически: разработчик не мог за день написать бесконечное количество кода.
Теперь AI-агент вполне способен:
— создать пять PR;
— написать сотни тестов;
— сгенерировать тысячи строк кода;
— обновить десятки файлов.
Если измерять activity, продуктивность выглядит фантастически. Дашборды зеленеют, графики растут, репозиторий кипит жизнью.
Только о ценности для продукта и пользователя это ничего не говорит.
Поэтому здесь снова стоит вернуться к EngThrive. Авторы прямо позиционируют систему как попытку перейти от измерения активности к измерению результата — outcomes.
Я бы смотрел не на количество произведённых артефактов, а на то:
— как быстро изменение доходит до пользователя;
— улучшает ли оно пользовательский результат;
— сколько дефектов и откатов возникает после доставки;
— во сколько обходится изменение;
— насколько легко оно проходит путь от идеи до продакшена.
Важное ограничение: эти показатели тоже нельзя превращать в рейтинг отдельных разработчиков. Их задача — показывать состояние системы доставки, а не искать самого «эффективного» человека.
AI окончательно добивает метрики, которые и раньше были плохими.
Количество строк кода теперь просто особенно наглядный пример: производить их стало почти бесплатно. Разбираться с последствиями — всё ещё нет.
Раньше объём активности хотя бы был ограничен физически: разработчик не мог за день написать бесконечное количество кода.
Теперь AI-агент вполне способен:
— создать пять PR;
— написать сотни тестов;
— сгенерировать тысячи строк кода;
— обновить десятки файлов.
Если измерять activity, продуктивность выглядит фантастически. Дашборды зеленеют, графики растут, репозиторий кипит жизнью.
Только о ценности для продукта и пользователя это ничего не говорит.
Поэтому здесь снова стоит вернуться к EngThrive. Авторы прямо позиционируют систему как попытку перейти от измерения активности к измерению результата — outcomes.
Я бы смотрел не на количество произведённых артефактов, а на то:
— как быстро изменение доходит до пользователя;
— улучшает ли оно пользовательский результат;
— сколько дефектов и откатов возникает после доставки;
— во сколько обходится изменение;
— насколько легко оно проходит путь от идеи до продакшена.
Важное ограничение: эти показатели тоже нельзя превращать в рейтинг отдельных разработчиков. Их задача — показывать состояние системы доставки, а не искать самого «эффективного» человека.
AI окончательно добивает метрики, которые и раньше были плохими.
Количество строк кода теперь просто особенно наглядный пример: производить их стало почти бесплатно. Разбираться с последствиями — всё ещё нет.