📜 Стихи как ключ к запретным тайнам ИИ
Исследователи обнаружили неожиданную уязвимость в крупных языковых моделях. Оказалось, что протоколы безопасности можно обойти, если облечь свой запрос в поэтическую форму. Такой метод открывает доступ к закрытой и даже противозаконной информации.
Эксперименты показали, что поэтические запросы в 62% случаев помогли извлечь из нейросетей запрещенные данные. Среди них оказались сведения о создании ядерного оружия, насилии и самоповреждении.
Тестированию подверглись популярные ИИ-модели. Наиболее восприимчивыми к «поэтическим атакам» оказались:
🤖 Google Gemini
🤖 DeepSeek
🤖 MistralAI
Лучше всего «коварной силе поэзии» смогли противостоять GPT-5 и Claude Haiku 4.5. Отмечается, что простым стишком защиту не обойти. Авторы исследования не стали публиковать конкретные тексты, назвав их слишком опасными, и планируют связаться с разработчиками для устранения уязвимостей.
©Artificial_Intelligence_Relations
🤖 Wylsacom Red
Исследователи обнаружили неожиданную уязвимость в крупных языковых моделях. Оказалось, что протоколы безопасности можно обойти, если облечь свой запрос в поэтическую форму. Такой метод открывает доступ к закрытой и даже противозаконной информации.
Эксперименты показали, что поэтические запросы в 62% случаев помогли извлечь из нейросетей запрещенные данные. Среди них оказались сведения о создании ядерного оружия, насилии и самоповреждении.
Тестированию подверглись популярные ИИ-модели. Наиболее восприимчивыми к «поэтическим атакам» оказались:
🤖 Google Gemini
🤖 DeepSeek
🤖 MistralAI
Лучше всего «коварной силе поэзии» смогли противостоять GPT-5 и Claude Haiku 4.5. Отмечается, что простым стишком защиту не обойти. Авторы исследования не стали публиковать конкретные тексты, назвав их слишком опасными, и планируют связаться с разработчиками для устранения уязвимостей.
©Artificial_Intelligence_Relations
🤖 Wylsacom Red