Ну и чтоб 2 раза не вставать)
Среди участников будет сформировано 20+ команд, по разным темам атак, защит и т.п.
От нас будет минимум 3 темы. Вот пример одной из них от Насти, которая вам хорошо знакома как наш топовый автор А* статей:
Тема атак на вотермарки - КРАЙНЕ прикольная.
Могу сказать, что Александр Крайнов - директор по развитию технологий ИИ Яндекса на этой неделе обращался к нам по поводу вотермаркинга. Они ищут людей в подразделение (и не могут найти, ибо молодых людей с идеями и горящими глазами - хватает, а вот людей, кто бы сделал чтобы оно работало найти не могут, увы).
В общем - обман детекторов - это вполне реальная задача, особенно учитывая, что у нас уже 30+ атак реализовано и есть с чего начать. Кто готов на смене прокачаться и до 31 октября плотно посоревноваться с другими командами мира (желательно - победив в конце) - вот прям очень ждем таких людей!
Если ваш метод будет ломать вотермарк от OpenAI или Google - вы наш человек.
Другие темы тоже будут интересны (от нас будет минимум 3 темы).
Ждем вас на проектной смене в нашем проекте! Не оставляйте заявку на последний день!
Поделитесь, пожалуйста, этим постом с друзьями, если кто-то из них мог бы такое потянуть или было бы интересно в теме прокачаться!
Среди участников будет сформировано 20+ команд, по разным темам атак, защит и т.п.
От нас будет минимум 3 темы. Вот пример одной из них от Насти, которая вам хорошо знакома как наш топовый автор А* статей:
Анциферова Анастасия Всеволодовна
Атака на watermarking генеративных моделей для изображений (в рамках челленджа NeurIPS'24)
Атака
Современные генеративные модели для изображений наносят невидимые глазу водяные знаки, которые при наличии инструмента для их считывания способны распознать, было ли изображение сгенерировано определенной моделью (DALLE/OpenAI https://www.theverge.com/2024/2/6/24063954/ai-watermarks-dalle3-openai-content-credentials, Google SynthID https://deepmind.google/discover/blog/identifying-ai-generated-images-with-synthid/). На ICML подходила к постеру статьи https://wavesbench.github.io/ и нас позвали поучаствовать в их новом бенчмарке атак на водяные знаки изображений. Авторы используют 3 разных способа добавления водяных знаков и предлагают разработать методы обмана их детекторов. Авторы запустили челлендж "Erasing the Invisible: A Stress-Test Challenge for ImageWatermarks" в рамках NeurIPS https://wavesbench.github.io/, даты должны совпасть со сменой, т.к. окончание соревнований 31 октября. Если даты совпадут, то можно будет прямо в интерактивном режиме посоревноваться с другими участниками. Если нет, то мы разработаем метод в рамках смены и засабмиттим его после в соревнование.
Тема атак на вотермарки - КРАЙНЕ прикольная.
Могу сказать, что Александр Крайнов - директор по развитию технологий ИИ Яндекса на этой неделе обращался к нам по поводу вотермаркинга. Они ищут людей в подразделение (и не могут найти, ибо молодых людей с идеями и горящими глазами - хватает, а вот людей, кто бы сделал чтобы оно работало найти не могут, увы).
В общем - обман детекторов - это вполне реальная задача, особенно учитывая, что у нас уже 30+ атак реализовано и есть с чего начать. Кто готов на смене прокачаться и до 31 октября плотно посоревноваться с другими командами мира (желательно - победив в конце) - вот прям очень ждем таких людей!
Если ваш метод будет ломать вотермарк от OpenAI или Google - вы наш человек.
Другие темы тоже будут интересны (от нас будет минимум 3 темы).
Ждем вас на проектной смене в нашем проекте! Не оставляйте заявку на последний день!
Поделитесь, пожалуйста, этим постом с друзьями, если кто-то из них мог бы такое потянуть или было бы интересно в теме прокачаться!