ИИ провёл аудит работы разработчика
Недавно на созвоне с Ильясом (CTO RetailCRM) решили попробовать кое-что на живых данных.
Поставили задачу нашему агенту на базе Skillum: собери сводку по разработчику за 6 месяцев. Merge Requests, задачи в Redmine, возвраты на доработку, Time2Market (время готовности)
Цель: принять решение о повышении сотрудника.
Агент встроен в ту же среду, где работают сотрудники (Redmine, GitLab, Mattermost, HelpDesk) и имеет доступ ко всей нужной информации.
Skillum сначала уточнил методологию: как считать Time2Market, нужно ли сравнение с коллегами того же грейда. Собрал данные из нескольких систем и выдал отчёт с рекомендацией и оговорками о том, где данные ненадёжны.
По цифрам: 43 завершённые задачи за полгода (31 проектная, 9 багов, 2 техдолга), 69 внедрённых Merge Requests в 12 репозиториях, почти 50 тысяч добавленных строк кода. Объём diff — это метрика масштаба, а не качества, туда попадают и конфиги, и сгенерированный код.
Самая показательная часть: из 43 задач содержательный возврат нашёлся только в одной, около 2,3%. Но при этом агент указал: по всем 69 Merge Requests разработчик получил ноль внешних замечаний, потому что почти все MR он проверял сам — в подавляющем большинстве случаев независимого ревью просто не было.
При этом сам разработчик активно проверяет коллег — больше 200 содержательных комментариев за то же время. Агент отметил это как признак того, что сотрудник фактически выполняет роль техлида.
Хороший пример того, что среда решает. Разработка технически детерминированная область, поэтому это почва для внедрения таких механик.
Недавно на созвоне с Ильясом (CTO RetailCRM) решили попробовать кое-что на живых данных.
Поставили задачу нашему агенту на базе Skillum: собери сводку по разработчику за 6 месяцев. Merge Requests, задачи в Redmine, возвраты на доработку, Time2Market (время готовности)
Цель: принять решение о повышении сотрудника.
Агент встроен в ту же среду, где работают сотрудники (Redmine, GitLab, Mattermost, HelpDesk) и имеет доступ ко всей нужной информации.
Skillum сначала уточнил методологию: как считать Time2Market, нужно ли сравнение с коллегами того же грейда. Собрал данные из нескольких систем и выдал отчёт с рекомендацией и оговорками о том, где данные ненадёжны.
По цифрам: 43 завершённые задачи за полгода (31 проектная, 9 багов, 2 техдолга), 69 внедрённых Merge Requests в 12 репозиториях, почти 50 тысяч добавленных строк кода. Объём diff — это метрика масштаба, а не качества, туда попадают и конфиги, и сгенерированный код.
Самая показательная часть: из 43 задач содержательный возврат нашёлся только в одной, около 2,3%. Но при этом агент указал: по всем 69 Merge Requests разработчик получил ноль внешних замечаний, потому что почти все MR он проверял сам — в подавляющем большинстве случаев независимого ревью просто не было.
При этом сам разработчик активно проверяет коллег — больше 200 содержательных комментариев за то же время. Агент отметил это как признак того, что сотрудник фактически выполняет роль техлида.
Хороший пример того, что среда решает. Разработка технически детерминированная область, поэтому это почва для внедрения таких механик.