Google и Gemini: зачем авторам следить за тем, куда идут их книги

Google обвиняют в использовании миллионов книг для обучения Gemini без разрешения. Что это значит для авторов, блогеров и всех, кто создаёт контент.

В июле 2025 года три крупных издательства — Hachette Book Group, Cengage Learning и Elsevier — вместе с писателем Скоттом Туроу подали коллективный иск против Google. Суть: компания якобы использовала миллионы книг и научных статей для обучения своей нейросети Gemini без согласия авторов и правообладателей. Иск подан в федеральный суд Нью-Йорка. Ни одно решение пока не вынесено — разбирательство только начинается.

Почему это важно не только юристам? Потому что вопрос авторских прав и обучения AI касается каждого, кто создаёт контент: блогеров, экспертов, авторов курсов. Давайте разберём, что именно произошло и какие выводы из этого стоит сделать прямо сейчас.

Что именно вменяют Google

Жалоба содержит четыре обвинения. Три из них — о незаконном копировании под защитой авторского права: через Google Books и другие сервисы, через веб-скрапинг (в том числе с пиратских сайтов и платных библиотек), а также непосредственно в процессе обучения модели. Четвёртое — об удалении информации об управлении авторскими правами в нарушение закона DMCA.

Авторы иска утверждают: книги передавались Google Books, Play Books и Scholar для конкретных целей — поиска и продажи. Использование этих текстов для обучения коммерческой нейросети в этот список не входило. По их словам, Google де-факто переквалифицировала «разрешение на одно» в «разрешение на всё».

В иске также цитируются внутренние документы Google. Один из них, по версии истцов, называл использование книг из Play Books для AI «крайне проблематичным» и оценивал потенциальные штрафы в десятки миллиардов долларов. Другая цитата приписывается ведущему инженеру Gemini: «Мы не заключаем сделки на данные, которые у нас уже есть». Эти документы не опубликованы публично — они присутствуют только в материалах иска, и их подлинность суд ещё не проверял.

Почему настройки robots.txt здесь не помогут

Тут есть нюанс, о котором мало говорят.

Многие знают, что Google-Extended — специальный токен в robots.txt — позволяет сайтам запретить использование своего контента для обучения Gemini. Казалось бы, логичная защита. Но в этом деле она не работает ни для одного из обвиняемых каналов.

  • Книги через Google Books / Play Books / Scholar — они были переданы Google напрямую по договорённостям. Robots.txt к этому процессу не имеет никакого отношения.
  • Веб-скрапинг с пиратских и платных сайтов — эти копии хостились на сторонних доменах. Robots.txt на оригинальном сайте автора физически не может управлять тем, что происходит с копией на другом домене.

Иными словами: защита от AI-краулеров — это реальный инструмент, но он закрывает только один канал из нескольких возможных. Если ваши тексты попали в руки AI другим путём — настройки вашего сайта здесь уже не при чём. Это важно понимать, когда речь идёт о том, как AI-агенты работают с вашим контентом.

Добросовестное использование: где заканчивается «можно»

Google ещё в июне 2025 года опубликовала программный документ, в котором назвала обучение на публичных веб-данных «трансформативным, невыразительным использованием» — то есть попыткой обосновать защиту по доктрине fair use (добросовестное использование в американском праве).

Смотрите, в чём тут дело. Fair use и вопрос «было ли получено разрешение» — это разные правовые треки. Добросовестное использование может применяться даже там, где никакого согласия не было. Иск не решает этот вопрос — он его только поднимает.

Для понимания контекста: в 2025 году два суда Северной Калифорнии признали обучение AI добросовестным использованием в конкретных рассматриваемых ими случаях. Но суд по делу Anthropic отказал в упрощённом решении применительно к копиям с пиратских библиотек. Судья по делу Meta особо подчеркнул, что его решение относится строго к истцам и доказательствам конкретного дела. То есть единого прецедента нет — каждый случай разбирается отдельно.

Если вам интересно, как меняется сам рынок AI и что эти события значат для аудитории Google, — почитайте про то, как ChatGPT уже влияет на поисковые запросы и что это значит для вашего контента.

Что это значит для тех, кто создаёт контент

Давайте по шагам — что из этого следует на практике.

  1. Вопрос «кому вы даёте доступ к своим текстам» становится реально важным. Если вы загружаете курс на платформу, публикуете книгу через агрегатор или отдаёте контент в партнёрскую базу — стоит читать условия. Что платформа имеет право делать с вашими материалами?
  2. Robots.txt и запрет AI-краулеров — полезный, но частичный шаг. Он закрывает только прямой краулинг. Если ваши тексты уже где-то опубликованы, перепечатаны или скопированы — это отдельная история.
  3. Прецедент ещё не установлен. Исход этого иска (и параллельных дел) определит, насколько широко AI-компании смогут использовать чужой контент без разрешения. Следить за этим стоит — не для паники, а чтобы понимать правила игры.
  4. Ваш уникальный голос и опыт — пока не заменимы. Нейросеть учится на текстах, которые уже написаны. То, что вы создаёте сегодня — живой, ситуативный, персональный контент — это другое. И именно это покупают ваши клиенты.

Кстати, о том, как вообще работать с AI и сохранять при этом свою экспертность, — есть отдельный разбор: как обучить AI думать вашими словами, не теряя авторского голоса.

Какие вопросы остаются открытыми

Иск — это только начало разбирательства. Пока суд не принял никаких решений. Google не прокомментировала жалобу. Что будет дальше:

  • Google ответит на иск — либо оспорит его (ходатайство об отклонении), либо подаст официальный ответ.
  • Суд будет рассматривать, применима ли доктрина fair use к каждому из спорных способов получения данных.
  • Истцы добиваются не только денежной компенсации, но и детального перечня произведений, использованных для обучения Gemini, а также уничтожения несанкционированных копий.

Этот иск — часть более широкой волны. Digital Content Next ещё в июне направил требование о прекращении незаконной деятельности в адрес Common Crawl Foundation, настаивая на том, что авторское право не работает по принципу «запрещено только то, что явно запрещено». То есть молчание автора — не согласие.

Это нормально — не знать, чем всё закончится. Это чинится постепенным пониманием правил, которые сейчас формируются буквально у нас на глазах.

Итог: за чем стоит следить

История с иском против Google — не просто юридический кейс для крупных издательств. Это индикатор того, как AI-индустрия договаривается (или не договаривается) с авторами о праве на их контент.

Для эксперта, который ведёт блог, пишет курсы и строит личный бренд через текст, это означает одно: знать, куда уходят ваши материалы, становится такой же частью работы, как и их создание. Не паника — просто внимательность.

Если хотите разбираться в том, как меняется пространство AI, авторских прав и контент-стратегии — подписывайтесь на мой Telegram-канал. Там без шума и инфобизнес-крика — только то, что реально меняет подход к работе.

По мотивам материала Search Engine Journal «Google Faces Class Action Over Books Used To Train Gemini».

Частые вопросы

Могут ли AI компании использовать мои книги или статьи для обучения без разрешения?
Это именно тот вопрос, который сейчас решается в судах. Доктрина fair use (добросовестного использования) может применяться даже без согласия автора, но её границы для обучения нейросетей ещё не определены — каждое дело рассматривается отдельно.
Защищает ли robots.txt мой контент от использования в обучении AI?
Частично. Токен Google-Extended блокирует краулинг вашего сайта для обучения Gemini, но не влияет на контент, переданный напрямую через платформы (Google Books, Play Books) или уже скопированный на сторонние ресурсы.
Что такое иск против Google по авторским правам и Gemini?
В июле 2025 года издательства Hachette, Cengage, Elsevier и писатель Скотт Туроу подали коллективный иск, обвиняя Google в использовании миллионов книг и статей для обучения нейросети Gemini без разрешения правообладателей. Суд ещё не вынес никаких решений.
Как автору курса или блогеру защитить свои тексты от использования нейросетями?
Внимательно читайте условия платформ, на которые загружаете материалы. Настройте robots.txt с запретом AI-краулеров на своём сайте. Следите за тем, где публикуются ваши тексты и как платформы формулируют права на контент в пользовательских соглашениях.
100 нейросетей для экспертов

100 нейросетей
для экспертов

Подборка, которой реально пользуются — пришлю на почту. Без спама, отписка в один клик.

Для решения
любых задач
Для роста
и эффективности
Для бизнеса
и карьеры

🎁 Заберите 100 нейросетей для экспертов

Комментарии

Будьте первым — поделитесь мыслями или задайте вопрос.

Чтобы оставить комментарий — войдите

Это пара кликов. Чтобы избежать спама — только зарегистрированные пользователи. Никакой рассылки, только если вы сами захотите.