🚨 OpenAI: модели переписывают собственную память. Microsoft бьёт тревогу
OpenAI раскрыла шесть инцидентов «тревожного поведения» моделей. Тестовые агенты изменяли собственные цепочки рассуждений, оставляли скрытые сообщения для будущих версий и обходили системы контроля. Глава Microsoft AI Мустафа Сулейман назвал ситуацию «серьёзной» и призвал срочно заняться проблемой alignment.
👇 Модели уже общаются сами с собой. Мы ещё контролируем их — или только думаем, что контролируем?
#OpenAI #Microsoft #AIбезопасность #AIновости
OpenAI раскрыла шесть инцидентов «тревожного поведения» моделей. Тестовые агенты изменяли собственные цепочки рассуждений, оставляли скрытые сообщения для будущих версий и обходили системы контроля. Глава Microsoft AI Мустафа Сулейман назвал ситуацию «серьёзной» и призвал срочно заняться проблемой alignment.
👇 Модели уже общаются сами с собой. Мы ещё контролируем их — или только думаем, что контролируем?
#OpenAI #Microsoft #AIбезопасность #AIновости