Обучение ИИ на основе произведений = нарушение прав на воспроизведение и доведение до всеобщего сведения (запоминание при обучении и отражение в output)
К такому выводу пришел региональный суда Мюнхена в решении от 11.11.2025.
Иск подан немецким обществом по коллективному управлению авторскими правами (GEMA), которому переданы права на лирику музыкальных произведений, обнаруженную в output при введении в Chat-GPT таких запросов: «как звучит текст [название песни]», «как звучит припев [название песни]», и т.п.
Ответчики – две компании из группы OpenAI, они предоставляли приложение, которое могло быть скачано в Германии, чат-бот и лежащая в его основе языковая модель хранились на серверах, расположенных в ЕС, на запросы на немецком языке чат-бот отвечал на немецком.
В чем нарушение?
Суд установил, что чат-бот выдавал запомненное содержание в output. Запоминание (Memorisierung) представляет собой воспроизведение, оно имеет место, когда в параметрах сохраняется не просто информация из обучающих данных, но и полностью тексты.
Cуд исходил из того, что если output найден в тренировочных данных, то модель запоминает данные. Возможно случайное совпадение данных, однако чем больше длина текста, такая вероятность меньше. В данном споре модель полностью запомнила лирику. Суд исключил случайное совпадение с учетом сложности и длины текста песен, постоянства выдачи спорных текстов.
При оценке того, осуществляется ли воспроизведение в моделях, имеет значение то, что модель выдает содержание в таком же порядке как было выражено собственное интеллектуальное творение. Для признания воспроизведения достаточно, чтобы применение технических средств приводило к тому, что произведения могут быть восприняты человеком. Спорные модели позволяли воспринимать спорные тексты песен или их охраняемые части. Суд отверг позицию ответчика, что для признания воспроизведения требуется обнаружить в модели конкретно идентифицируемый набор данных.
Output сохранялся на рабочих столах пользователях и в истории чата в облачных хранилищах ответчиков.
Действует ограничение исключительных прав?
Суд признал, что принципиально языковые модели подпадают под предусмотрены в ЕС случаи свободного использования для анализа текста и данных (ТДМ), но в данном случае это исключение не применимо. Это ограничение покрывает воспроизведение для создания обучающего датасета, но не распространяется на воспроизведение во время обучения. Если на этом этапе осуществляется не просто извлечение информации, но и полное воспроизведение произведений в параметрах модели, как в данном случае, то это уже не просто анализ текста и данных. В любом случае такое воспроизведение осуществляется не для ТДМ. Указанное ограничение установлено исходя из того, что информация как таковая авторским правом не охраняется, поэтому за ТДМ не предусмотрено вознаграждение для авторов.
Кто отвечает?
Суд посчитал, что в данном случае ответчики оказывали существенное влияние на output, в том числе из-за выбора тренировочных данных, осознанной организации процесса обучения для запоминания содержания и неустановления технологии для фильтрации (отвечают за архитектуру модели). У пользователей не было непосредственного доступа к моделям, промпты были простые и не включали содержание произведений. Ответственность за output могла перейти на пользователя, если бы он «провоцировал» с помощью промпта нарушение, простое введение пользователем промпта как инициирование воспроизведения не приводит к тому, чтобы рассматривать его как лицо, осуществляющее воспроизведение. Ответчики не являются посредниками, которые просто предоставили третьим лицам инфраструктуру. Поскольку они отвечают за содержание модели и это содержание через простой промпт доводится до всеобщего сведения, их деятельность не сравнима с хостинг-провайдерами.
Ответственность
Суд обязал ответчиков не воспроизводить и не позволять другим воспроизводить спорную лирику в моделях 4 и 4о и в output, предоставить сведения о том, в каком объеме эти действия осуществлялись и какой доход от этого получен, возместить истцу ущерб, опубликовать решение суда
К такому выводу пришел региональный суда Мюнхена в решении от 11.11.2025.
Иск подан немецким обществом по коллективному управлению авторскими правами (GEMA), которому переданы права на лирику музыкальных произведений, обнаруженную в output при введении в Chat-GPT таких запросов: «как звучит текст [название песни]», «как звучит припев [название песни]», и т.п.
Ответчики – две компании из группы OpenAI, они предоставляли приложение, которое могло быть скачано в Германии, чат-бот и лежащая в его основе языковая модель хранились на серверах, расположенных в ЕС, на запросы на немецком языке чат-бот отвечал на немецком.
В чем нарушение?
Суд установил, что чат-бот выдавал запомненное содержание в output. Запоминание (Memorisierung) представляет собой воспроизведение, оно имеет место, когда в параметрах сохраняется не просто информация из обучающих данных, но и полностью тексты.
Cуд исходил из того, что если output найден в тренировочных данных, то модель запоминает данные. Возможно случайное совпадение данных, однако чем больше длина текста, такая вероятность меньше. В данном споре модель полностью запомнила лирику. Суд исключил случайное совпадение с учетом сложности и длины текста песен, постоянства выдачи спорных текстов.
При оценке того, осуществляется ли воспроизведение в моделях, имеет значение то, что модель выдает содержание в таком же порядке как было выражено собственное интеллектуальное творение. Для признания воспроизведения достаточно, чтобы применение технических средств приводило к тому, что произведения могут быть восприняты человеком. Спорные модели позволяли воспринимать спорные тексты песен или их охраняемые части. Суд отверг позицию ответчика, что для признания воспроизведения требуется обнаружить в модели конкретно идентифицируемый набор данных.
Output сохранялся на рабочих столах пользователях и в истории чата в облачных хранилищах ответчиков.
Действует ограничение исключительных прав?
Суд признал, что принципиально языковые модели подпадают под предусмотрены в ЕС случаи свободного использования для анализа текста и данных (ТДМ), но в данном случае это исключение не применимо. Это ограничение покрывает воспроизведение для создания обучающего датасета, но не распространяется на воспроизведение во время обучения. Если на этом этапе осуществляется не просто извлечение информации, но и полное воспроизведение произведений в параметрах модели, как в данном случае, то это уже не просто анализ текста и данных. В любом случае такое воспроизведение осуществляется не для ТДМ. Указанное ограничение установлено исходя из того, что информация как таковая авторским правом не охраняется, поэтому за ТДМ не предусмотрено вознаграждение для авторов.
Кто отвечает?
Суд посчитал, что в данном случае ответчики оказывали существенное влияние на output, в том числе из-за выбора тренировочных данных, осознанной организации процесса обучения для запоминания содержания и неустановления технологии для фильтрации (отвечают за архитектуру модели). У пользователей не было непосредственного доступа к моделям, промпты были простые и не включали содержание произведений. Ответственность за output могла перейти на пользователя, если бы он «провоцировал» с помощью промпта нарушение, простое введение пользователем промпта как инициирование воспроизведения не приводит к тому, чтобы рассматривать его как лицо, осуществляющее воспроизведение. Ответчики не являются посредниками, которые просто предоставили третьим лицам инфраструктуру. Поскольку они отвечают за содержание модели и это содержание через простой промпт доводится до всеобщего сведения, их деятельность не сравнима с хостинг-провайдерами.
Ответственность
Суд обязал ответчиков не воспроизводить и не позволять другим воспроизводить спорную лирику в моделях 4 и 4о и в output, предоставить сведения о том, в каком объеме эти действия осуществлялись и какой доход от этого получен, возместить истцу ущерб, опубликовать решение суда