Репост из: Пост-
Ужас, редкие книги в единственных экземплярах уничтожают для обучения ИИ. Все из-за извращенной юридической логики и жадности IT-гигантов.
● Компании массово скупают букинистические издания, отрезают корешки, подгоняют страницы под нужный размер и через сканер преобразуют в PDF. Затем сами книги просто отправляют на переработку, а цифровой текст становится частью закрытой библиотеки компании.
► Конечно, есть безопасный способ отсканировать книгу. Но просто срезать корешки дешевле, и еще уничтожение физического оригинала дает право на владение цифровым текстом.
Предложка | Подписаться
Выясняем продолжения историй
● Компании массово скупают букинистические издания, отрезают корешки, подгоняют страницы под нужный размер и через сканер преобразуют в PDF. Затем сами книги просто отправляют на переработку, а цифровой текст становится частью закрытой библиотеки компании.
► Конечно, есть безопасный способ отсканировать книгу. Но просто срезать корешки дешевле, и еще уничтожение физического оригинала дает право на владение цифровым текстом.
► Законы США об интеллектуальной собственности предполагают, что уничтожение книги после сканирования может стать аргументом в суде. Якобы это «трансформативное использование», а значит fair use. Дополнительная копия не создается — покупатель купил один текст, оставил один текст, количество копий остается прежним. Все законно.
► Собственно, выяснилось все из-за судебного спора писателей и правообладателей с Anthropic, создателями языковой модели Claude. Букинисты и книготорговцы отмечают рост продаж, но отследить, кому именно уходят оптовые заказы, они не могут. Подозревают, что конечный покупатель — разработчики ИИ. Один из продавцов рассказал, что раньше в удачную неделю сбывал до 20 книг, с апреля их количество выросло до 100.
► На фоне спроса появились компании, которые поставляют старые книги разработчикам ИИ. Так, компания ISBNdb, которая раньше работала с библиотеками и букинистами, теперь оптом поставляет книги ИИ-лабораториям. За один заказ продаётся до миллиона книг.
— Когда системы ИИ обучаются на тексте, который сам был сгенерирован ИИ, происходит коллапс: исчезают тонкие лингвистические нюансы, накапливаются систематические ошибки, а результаты получаются шаблонными. Каждое поколение ИИ-модели, обученное таким образом, становится хуже предыдущего. Печатные книги, изданные до распространения языковых моделей, гарантированно не содержат подобных загрязнений. Уже только это является существенным плюсом, — говорится на сайте ISBNdb.
► При этом ISBNdb и другие аналогичные компании скрывают данные своих покупателей. Таким образом, имидж IT-гигантов защищён от обвинений в массовом уничтожении книг.
Предложка | Подписаться
Выясняем продолжения историй