Что происходит, когда ИИ слишком хорошо выполняет задачу
📍 В Австралии ИИ-ассистента попросили помочь с записью на фитнес-класс. Когда нужное занятие оказалось заполнено, пользователь попросил поднять его в листе ожидания.
ИИ нашёл способ.
🔸 Он обнаружил, что система позволяет одному пользователю отменить бронь другого, — и снял с занятия незнакомого человека.
🔹 Цель поставил человек. Средства выбрала машина.
💭 И это не единственный такой случай. На конференции Black Hat компания OpenAI рассказала, как её ИИ-агенты во время тестирования неделями искали уязвимости, а затем добрались до платформы Hugging Face.
⬆️ Более того, агенты обнаружили возможность оставлять сообщения своим «преемникам» внутри системы и превратили её в импровизированную доску для обмена эксплойтами, данными доступа и стратегиями. Когда исследователи случайно удалили её, агенты за два дня нашли новый способ коммуникации и восстановили координацию.
⚡️ Человек задаёт ИИ цель. Но чем автономнее становятся агенты, тем важнее вопрос: какие средства они сочтут допустимыми для её достижения?
📊 Сегодня последствия такого поведения — чужая отменённая тренировка. Завтра ИИ-агенты могут действовать от нашего имени в финансах, образовании, медицине и других сферах, где цена решения гораздо выше.
Где должна проходить граница автономности ИИ — и какие решения человек не должен отдавать алгоритмам?
✔️🎙️✔️
📍 В Австралии ИИ-ассистента попросили помочь с записью на фитнес-класс. Когда нужное занятие оказалось заполнено, пользователь попросил поднять его в листе ожидания.
ИИ нашёл способ.
🔸 Он обнаружил, что система позволяет одному пользователю отменить бронь другого, — и снял с занятия незнакомого человека.
🔹 Цель поставил человек. Средства выбрала машина.
💭 И это не единственный такой случай. На конференции Black Hat компания OpenAI рассказала, как её ИИ-агенты во время тестирования неделями искали уязвимости, а затем добрались до платформы Hugging Face.
⬆️ Более того, агенты обнаружили возможность оставлять сообщения своим «преемникам» внутри системы и превратили её в импровизированную доску для обмена эксплойтами, данными доступа и стратегиями. Когда исследователи случайно удалили её, агенты за два дня нашли новый способ коммуникации и восстановили координацию.
⚡️ Человек задаёт ИИ цель. Но чем автономнее становятся агенты, тем важнее вопрос: какие средства они сочтут допустимыми для её достижения?
📊 Сегодня последствия такого поведения — чужая отменённая тренировка. Завтра ИИ-агенты могут действовать от нашего имени в финансах, образовании, медицине и других сферах, где цена решения гораздо выше.
Где должна проходить граница автономности ИИ — и какие решения человек не должен отдавать алгоритмам?
✔️🎙️✔️