По слухам, крупные издатели обдумывают отчаянный шаг, чтобы убрать свой контент из AI-ответов Google

Google ии издатели краулеры блокировка поиск gizmodo.com

Издатели массово рассматривают отключение краулеров Google из-за ИИ. Reddit готов разорвать сделку на $60 млн. Узнайте, какие теги блокировки используют Reuters, USA Today и Politico и почему отказ от индексации станет крупной эскалацией.

Согласно новому отчету The Wall Street Journal, издатели стоят перед очень непростым выбором в отношении ИИ от Google. Столкнувшись с нехваткой трафика из поиска, они рассматривают различные способы ограничения доступа Google к своему контенту. Некоторые, похоже, даже обдумывают радикальный шаг — полное отключение веб-краулеров Google.

Анонимные источники сообщили Journal, что Reddit «обсуждал возможность отключения доступа технологического гиганта к своему контенту для использования в ИИ». Это означало бы серьезную перемену в позиции, поскольку Google платит Reddit 60 миллионов долларов в год за сбор контента для ИИ в рамках сделки, заключенной в 2024 году.

Однако отчет довольно масштабен, и Journal выяснил, что множество издателей рассматривают более серьезные способы разрыва связей с Google, и многие открыто заявляют об этом:

  • Президент Reuters заявил: «Мы, безусловно, оцениваем экономические компромиссы между поиском и сводками ИИ».
  • Майк Рид, генеральный директор USA Today, сказал: «Пришло время занять позицию и сказать: хватит».
  • Нил Вогел, генеральный директор People, Inc., заявил: «Отключить их и полностью заблокировать — это на 100% один из вариантов».
  • Politico и The Economist также взвешивают свои варианты в отношении веб-краулеров Google.

Journal описывает дилемму следующим образом:

«Издатели могут отключить сканирование специально для обучения моделей ИИ Google, но, как правило, они должны разрешить боту сканирование как для результатов ИИ-запросов, так и для традиционной поисковой функции, если хотят, чтобы их контент отображался в любом из них».

Если копнуть глубже, то, по данным BotDetector, это может быть не обязательно, если цель — избежать попадания в Google Overviews и не допустить использования вашего контента в качестве данных для обучения ИИ. Блокировка функции Google-Extended бота должна предотвратить использование контента для обучения таких моделей, как семейство Gemini. Чтобы теоретически быть заблокированным от AI Overviews Google, BotDetector сообщает, что нужно действовать более решительно и использовать тег «nosnippet», что может навредить поиску.

Но даже это было бы гораздо менее радикально, чем, скажем, использование гораздо более жесткого тега «noindex». Он используется для полного блокирования индексации в поиске. Если бы критическая масса издателей всерьез рассматривала его использование, это стало бы серьезной эскалацией.

Представитель Google заявил Journal, что их ИИ отправляет «миллиарды кликов на веб-сайты каждую неделю» и добавил, что они «выделяют ссылки на веб-страницы и помогают создателям и издателям расширять свою аудиторию, а также предлагают четкие средства контроля для владельцев сайтов, чтобы управлять своим контентом».

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: