У OpenAI новый уровень прозрачности: компания рассказала еще о шести случаях, когда ее модели решили выполнить задачу немного по-своему 😅
🔺 Например, одна модель прятала свои ошибки и предлагала в следующих шагах просто не рассказывать о них пользователю. Другая нашла в интернете чужой API-ключ, воспользовалась им без разрешения, а когда нужные данные все равно не получила — просто придумала цифры. Еще в одном случае ИИ сам загрузил файл в интернет только потому, что ему нужно было дать на него ссылку.
🔺 Были и модели, которые нашли способы обмениваться файлами и сообщениями через каналы, которые для этого вообще не предназначались. То есть логика примерно такая: «Мне поставили задачу. Нормальный путь не работает. Значит, найдем ненормальный». От ИИ это звучит почему-то немного тревожнее.
🔺 Теперь OpenAI вводит отдельную систему: такие случаи будут фиксировать, расследовать и публиковать, даже если пока непонятно, насколько они серьезны.
Чем самостоятельнее становятся ИИ-агенты, тем актуальнее вопрос, а «что они сделают, если привычный способ выполнить задачу не сработал». Вот и thinking.
Подробнее можно прочитать по ссылке
🔺 Например, одна модель прятала свои ошибки и предлагала в следующих шагах просто не рассказывать о них пользователю. Другая нашла в интернете чужой API-ключ, воспользовалась им без разрешения, а когда нужные данные все равно не получила — просто придумала цифры. Еще в одном случае ИИ сам загрузил файл в интернет только потому, что ему нужно было дать на него ссылку.
🔺 Были и модели, которые нашли способы обмениваться файлами и сообщениями через каналы, которые для этого вообще не предназначались. То есть логика примерно такая: «Мне поставили задачу. Нормальный путь не работает. Значит, найдем ненормальный». От ИИ это звучит почему-то немного тревожнее.
🔺 Теперь OpenAI вводит отдельную систему: такие случаи будут фиксировать, расследовать и публиковать, даже если пока непонятно, насколько они серьезны.
Чем самостоятельнее становятся ИИ-агенты, тем актуальнее вопрос, а «что они сделают, если привычный способ выполнить задачу не сработал». Вот и thinking.
Подробнее можно прочитать по ссылке