Репост из: Про HR и не только | Наталья Володина
Про матрицу рисков ИИ-агентов
В августовский дайджет PRO.Людей вошла интересная статья про типологию ИИ-агентов (автономных ботов, которые сами ставят себе задачи и действуют без постоянного контроля человека).
Авторы использовали аналогию с ответственностью владельцев домашних и диких животных и разобрали отдельные случаи поведения ИИ.
Они предлагают оценивать агентов по двум параметрам:
✅ есть ли ответственный владелец и
✅ насколько серьезным может быть ущерб
Четыре типа корпоративных агентов:
1️⃣ Шпиц (Низкий риск / Высокий контроль)
Это внутренний чат-бот или сервисная рассылка. Если он ошибся с суммой скидки клиенту, ответственность несет компания. Риски понятны, процессы отлажены.
➡️ Действие: продолжаем внедрять для автоматизации поддержки, маркетинга и тп.
2️⃣ Питбуль (Высокий риск / Высокий контроль)
Системы принятия решений в критической инфраструктуре, скоринговые модели кредитного комитета или алгоритмы трейдинга. Укус будет тяжелым, но поводок у вас в руках. Компания отвечает за то, чтобы «собака» была обучена и сертифицирована.
➡️ Действие: вводить строгие протоколы тестирования (red-teaming) и аудит логов.
3️⃣ Лиса (Средний риск / Нет владельца)
Автономные агенты разработчиков, скрипты парсинга конкурентов или интеграции со сторонними API. Они вроде бы делают полезную работу, но если такой бот начнет спамить партнеров или ломать чужой код из-за ошибки в логике, ответственного не найти.
➡️ Действие: инвентаризация теневых ИТ (shadow IT), запрет на запуск неконтролируемых внешних скриптов.
4️⃣ Волк (Критический риск / Нулевой контроль)
Самый опасный сценарий. Финансовый ИИ-агент, который получил доступ к ликвидности и начал самостоятельно строить пирамиды для максимизации прибыли. Или взломщик криптокошельков. У него нет юридического лица-владельца, цепочка ответственности разорвана.
➡️ Действие: запрет на предоставление финансовой автономии любым алгоритмам без многоуровневого человеческого подтверждения (human-in-the-loop).
Основная рекомендация авторов - управляйте одомашненностью своих технологий.
@hrandmuchmore
В августовский дайджет PRO.Людей вошла интересная статья про типологию ИИ-агентов (автономных ботов, которые сами ставят себе задачи и действуют без постоянного контроля человека).
Авторы использовали аналогию с ответственностью владельцев домашних и диких животных и разобрали отдельные случаи поведения ИИ.
Они предлагают оценивать агентов по двум параметрам:
✅ есть ли ответственный владелец и
✅ насколько серьезным может быть ущерб
Четыре типа корпоративных агентов:
1️⃣ Шпиц (Низкий риск / Высокий контроль)
Это внутренний чат-бот или сервисная рассылка. Если он ошибся с суммой скидки клиенту, ответственность несет компания. Риски понятны, процессы отлажены.
➡️ Действие: продолжаем внедрять для автоматизации поддержки, маркетинга и тп.
2️⃣ Питбуль (Высокий риск / Высокий контроль)
Системы принятия решений в критической инфраструктуре, скоринговые модели кредитного комитета или алгоритмы трейдинга. Укус будет тяжелым, но поводок у вас в руках. Компания отвечает за то, чтобы «собака» была обучена и сертифицирована.
➡️ Действие: вводить строгие протоколы тестирования (red-teaming) и аудит логов.
3️⃣ Лиса (Средний риск / Нет владельца)
Автономные агенты разработчиков, скрипты парсинга конкурентов или интеграции со сторонними API. Они вроде бы делают полезную работу, но если такой бот начнет спамить партнеров или ломать чужой код из-за ошибки в логике, ответственного не найти.
➡️ Действие: инвентаризация теневых ИТ (shadow IT), запрет на запуск неконтролируемых внешних скриптов.
4️⃣ Волк (Критический риск / Нулевой контроль)
Самый опасный сценарий. Финансовый ИИ-агент, который получил доступ к ликвидности и начал самостоятельно строить пирамиды для максимизации прибыли. Или взломщик криптокошельков. У него нет юридического лица-владельца, цепочка ответственности разорвана.
➡️ Действие: запрет на предоставление финансовой автономии любым алгоритмам без многоуровневого человеческого подтверждения (human-in-the-loop).
Основная рекомендация авторов - управляйте одомашненностью своих технологий.
@hrandmuchmore