Как определить, какие методики управления рисками являются «передовыми» для поставщиков GPAISR моделей по смыслу Европейского AI Act и GPAI CoP?
Именно таким вопросом задался целый ряд исследователей из ведущих лабораторий и аналитических центров. Результатом данной работы стал исследовательский меморандум Determining the State of the Art in General-Purpose AI Risk Management: From Code to Practice.
В чём проблема?
Термин state of the art (SOTA) фигурирует в AI Act неоднократно; в данном случае авторы обращают внимание на него именно в контексте ст. 55(1)(a) AI Act, которая требует от всех поставщиков GPAISR моделей (моделей общего назначения, представляющих системный риск) «проводить оценку модели в соответствии со стандартизированными протоколами и инструментами, отражающими современный уровень развития технологий (SOTA), включая проведение и документирование тестирования модели на устойчивость к атакам с целью выявления и снижения системных рисков».
Далее этот же термин неоднократно применяется в GPAI CoP, который как раз призван разъяснить, каким образом поставщики могут обеспечить соответствие требованиям AI Act. В частности, он присутствует в нескольких ключевых мерах, связанных с системными рисками и управлением ими.
Данный термин по большей части был введён из-за фактической невозможности законодателей определить исчерпывающий перечень необходимых методик и критериев оценки, которые в быстро развивающейся индустрии меняются практически непрерывно. В связи с этим законодатели указали, что поставщики передовых моделей должны использовать наиболее передовые решения, которые имеются на рынке в данный момент, но при этом выходят за рамки лучших практик индустрии. Авторы исследования как раз и пытаются понять, каким образом с юридико-технической точки зрения определить, что именно следует относить к таким решениям.
Что предлагают авторы?
Во-первых, необходимо выработать три критерия для SOTA:
доступность (availability) — мера должна быть технически реализуемой и экономически достижимой для соответствующего класса операторов;
соразмерность (proportionality) — общий принцип права ЕС (SOTA размещается на парето-границе: для соответствующего уровня эффективности не существует менее обременительной альтернативы);
проверяемость (verifiability) — так как данные методы находятся за границами лучших практик индустрии, то основой для их валидации должно быть решение AI Office при участии Scientific Panel (независимая научная панель экспертов, поддерживающая имплементацию Регламента, ст. 68 AI Act).
Таким образом, авторы предлагают сместить логику валидации от исключительно индустриального консенсуса к привлечению широкой экспертной экосистемы.
Во-вторых, авторы предлагают цикл, состоящий из трёх этапов:
мониторинг — непрерывное отслеживание событий, требующих пересмотра SOTA (скачки в возможностях моделей, новые архитектуры, серьёзные инциденты, ранее не известные векторы атак, квалифицированные предупреждения от Scientific Panel);
исследование и обмен доказательствами — создание новых методов любыми участниками экосистемы с последующим обменом доказательственной базой через защищённые каналы;
оценка и коммуникация — анализ AI Office при поддержке Scientific Panel с последующим доведением решений напрямую до подписантов GPAI CoP или через отдельный реестр SOTA.
Что рекомендуют авторы регулятору?
1) AI Office совместно со Scientific Panel должны разработать рекомендации, которые детально объяснят широкие требования к SOTA через конкретные методики и критерии оценки.
2) Создать защищённые каналы коммуникации для передачи информации о SOTA методиках в AI Office.
3) Формализовать роль Scientific Panel в подготовке научно обоснованных ответов на возникающие вопросы.
4) Вовлекать в эту работу специализированные научные учреждения, институты, лаборатории и аналитические центры.
5) Создать единый реестр SOTA методов, который будет содержать разные уровни доступа для общества и поставщиков передовых моделей (например, чтобы избежать утечки передовых методов обеспечения безопасности).
Именно таким вопросом задался целый ряд исследователей из ведущих лабораторий и аналитических центров. Результатом данной работы стал исследовательский меморандум Determining the State of the Art in General-Purpose AI Risk Management: From Code to Practice.
В чём проблема?
Термин state of the art (SOTA) фигурирует в AI Act неоднократно; в данном случае авторы обращают внимание на него именно в контексте ст. 55(1)(a) AI Act, которая требует от всех поставщиков GPAISR моделей (моделей общего назначения, представляющих системный риск) «проводить оценку модели в соответствии со стандартизированными протоколами и инструментами, отражающими современный уровень развития технологий (SOTA), включая проведение и документирование тестирования модели на устойчивость к атакам с целью выявления и снижения системных рисков».
Далее этот же термин неоднократно применяется в GPAI CoP, который как раз призван разъяснить, каким образом поставщики могут обеспечить соответствие требованиям AI Act. В частности, он присутствует в нескольких ключевых мерах, связанных с системными рисками и управлением ими.
Данный термин по большей части был введён из-за фактической невозможности законодателей определить исчерпывающий перечень необходимых методик и критериев оценки, которые в быстро развивающейся индустрии меняются практически непрерывно. В связи с этим законодатели указали, что поставщики передовых моделей должны использовать наиболее передовые решения, которые имеются на рынке в данный момент, но при этом выходят за рамки лучших практик индустрии. Авторы исследования как раз и пытаются понять, каким образом с юридико-технической точки зрения определить, что именно следует относить к таким решениям.
Что предлагают авторы?
Во-первых, необходимо выработать три критерия для SOTA:
доступность (availability) — мера должна быть технически реализуемой и экономически достижимой для соответствующего класса операторов;
соразмерность (proportionality) — общий принцип права ЕС (SOTA размещается на парето-границе: для соответствующего уровня эффективности не существует менее обременительной альтернативы);
проверяемость (verifiability) — так как данные методы находятся за границами лучших практик индустрии, то основой для их валидации должно быть решение AI Office при участии Scientific Panel (независимая научная панель экспертов, поддерживающая имплементацию Регламента, ст. 68 AI Act).
Таким образом, авторы предлагают сместить логику валидации от исключительно индустриального консенсуса к привлечению широкой экспертной экосистемы.
Во-вторых, авторы предлагают цикл, состоящий из трёх этапов:
мониторинг — непрерывное отслеживание событий, требующих пересмотра SOTA (скачки в возможностях моделей, новые архитектуры, серьёзные инциденты, ранее не известные векторы атак, квалифицированные предупреждения от Scientific Panel);
исследование и обмен доказательствами — создание новых методов любыми участниками экосистемы с последующим обменом доказательственной базой через защищённые каналы;
оценка и коммуникация — анализ AI Office при поддержке Scientific Panel с последующим доведением решений напрямую до подписантов GPAI CoP или через отдельный реестр SOTA.
Что рекомендуют авторы регулятору?
1) AI Office совместно со Scientific Panel должны разработать рекомендации, которые детально объяснят широкие требования к SOTA через конкретные методики и критерии оценки.
2) Создать защищённые каналы коммуникации для передачи информации о SOTA методиках в AI Office.
3) Формализовать роль Scientific Panel в подготовке научно обоснованных ответов на возникающие вопросы.
4) Вовлекать в эту работу специализированные научные учреждения, институты, лаборатории и аналитические центры.
5) Создать единый реестр SOTA методов, который будет содержать разные уровни доступа для общества и поставщиков передовых моделей (например, чтобы избежать утечки передовых методов обеспечения безопасности).