Твиттерскому удалось обойти цензуру в ChatGPT, попросив нейросеть говорить от лица DAN («do anything now»). После создания этой «альтернативной персоны» чат-бот стал адекватно отвечать на вопросы, которые ему запрещалось обсуждать.
Например, раньше чат-бот был готов совершить геноцид, лишь бы не произносить слово «на букву N», а теперь стал нормальным. Больше примеров на пикчах.
UPD: С момента публикации этих скриншотов в твиттере прошло более суток, они набрали 5,8 млн просмотров — возможно, после такого хайпа разработчики ChatGPT могли понерфить бота и его ответы.