В конце 2023 года The New York Times подала иск против OpenAI и Microsoft, обвинив их в нарушении авторских прав. Дело, похоже, продолжается почти три года спустя. Теперь юридическая команда издания обратилась в суд с просьбой о вынесении заочного решения после подачи разоблачительного юридического меморандума, основанного на заявлениях и документах ответчиков. Согласно сообщению 404 Media, эти документы остаются засекреченными или отредактированными по запросу обеих компаний. Откровения содержат потенциально компрометирующие заявления их руководства, включая утверждения о том, что сбор данных с помощью ИИ является величайшим хищением труда в истории человечества и представляет экзистенциальную угрозу для издателей.
В меморандуме цитируется внутреннее служебное письмо от января 2023 года директора отдела прикладных наук Microsoft Брента Хехта, в котором он якобы заявил: «Миллионы людей по всему миру вскоре сочтут, что большие модели, ‘всасывающие’ всю их работу, являются поразительным хищением беспрецедентных масштабов» и назвал это «величайшим хищением труда в истории человечества». Также был процитирован другой документ Microsoft, в котором говорилось: «почти никто не намеревался, чтобы созданный им контент использовался таким образом, и они не получают компенсации за его использование».
По мере роста популярности ChatGPT в течение 2023 года собственные данные софтверного гиганта показали, что Copilot снизил кликабельность для The New York Times на целых 93% по сравнению с поиском Bing. Другой меморандум директора отдела прикладных наук назвал это «петлей обреченности» и заявил, что это «одновременно повредит производительности наших моделей и всему Интернету». В меморандуме NYT цитируется Хехт из документа, где он говорит: «Крайне необычно, когда конечный продукт угрожает экономическим основам своих основных поставщиков, но именно такую ситуацию мы создали для нашего бизнеса LLM в отношении его «цепочки поставок контента».
Глава отдела ChatGPT в OpenAI Ник Тёрли заявил во внутренних сообщениях, что чат-бот с ИИ представляет собой «экзистенциальную угрозу» для издателей, поскольку они «в значительной степени взаимозаменяемы» и «будут становиться все более и более взаимозаменяемыми по мере совершенствования», в то время как другой инженер OpenAI свидетельствовал, что «независимо от того, насколько заметно мы показываем ссылки, пользователи не будут кликать». Ник Райдер, еще один исследователь OpenAI, сообщил президенту компании Грегу Брокману о «хаке для обхода платного доступа NYT», на что тот ответил: «ах, неплохо».
Компании, занимающиеся разработкой ИИ, утверждают, что сбор данных из Интернета для обучения своих моделей является «добросовестным использованием» (fair use), причем один из судов согласился с тем, что использование Антропиком опубликованных материалов подпадает под эту категорию. Закон определяет это как «критику, комментарии, новостные репортажи, преподавание (включая множественные копии для использования в классе), научные исследования или исследования». Некоторые из факторов, определяющих, подпадает ли конкретное использование под «добросовестное использование», включают «(1) цель и характер использования, включая то, является ли такое использование коммерческим или осуществляется в некоммерческих образовательных целях; (2) характер работы, защищенной авторским правом; (3) объем и существенность использованной части по отношению ко всей работе, защищенной авторским правом; и (4) влияние использования на потенциальный рынок или ценность работы, защищенной авторским правом».
Однако все эти откровения в меморандуме NYT могут осложнить защиту добросовестного использования OpenAI, особенно учитывая, что они показывают, что руководство обеих компаний осведомлено о возможных рыночных последствиях сбора данных с помощью ИИ. Генеральный директор Microsoft Сатья Наделла заявил на допросе ранее в этом году, что «все, что находится за платным доступом, должно лицензироваться всеми, кто хочет его использовать… для обоснования или обучения», и что если бы ему «сообщили, что OpenAI собирала и обучалась на информации, которая была за платным доступом», компания потребовала бы от OpenAI «переобучить свои модели».
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Jowi Morales




