Игорь Градов
Игорь Градов
6 мин
ai

OpenAI и Microsoft знали о «краже труда»: рассекреченные документы раскрыли масштаб

OpenAI и Microsoft годами знали, что их модели разрушают экономику веб-издателей и создателей контента, но продолжали скрейпить данные ради коммерческой выгоды, и рассекреченные судебные документы теперь это подтверждают дословно.

Почему это важно

Суд рассекретил внутренние документы по иску The New York Times к OpenAI и Microsoft, и в них сотрудники обеих компаний прямым текстом называют происходящее «петлёй гибели» для веба и «крупнейшей кражей труда в истории человечества». Для любого, кто создаёт контент на русском языке, это не чужой американский процесс, а зеркало того, что уже происходит с вашим трафиком.

В начале июня 2025 года суд снял гриф с 92-страничного документа, поданного The New York Times в деле против OpenAI и Microsoft. Документ собрал внутренние переписки, презентации и показания топ-менеджеров обеих компаний. Газета The Verge, первой разобравшая материал, зафиксировала: компании знали о вреде и действовали осознанно.

Что именно признали внутри компаний?

Брент Хект, директор по прикладным исследованиям Microsoft, назвал сбор данных для обучения ChatGPT и Copilot «крупнейшей кражей труда в истории человечества». По его словам, позиция Microsoft в суде делает «полную пародию на саму идею добросовестного использования» (fair use, юридическая доктрина в США, которая разрешает ограниченное использование чужих материалов без лицензии).

Microsoft попыталась дистанцироваться. Пресс-секретарь Алекс Хаурек заявил The Verge, что «комментарии отражают личную точку зрения одного сотрудника, не являются правовым анализом и не представляют позицию компании». Джордан Усдан, генеральный менеджер по стратегии данных в Microsoft AI, назвал роль Хехта «намеренно оппозиционной»: его наняли, чтобы он приносил «асимметричные, футуристические и академические точки зрения».

Но дело не в одном сотруднике. Документ содержит высказывания Сатьи Наделлы (CEO Microsoft), Сэма Альтмана (CEO OpenAI), Грега Брокмана (сооснователь OpenAI) и других.

«Петля гибели» их собственными словами

Внутренний документ Microsoft описывает ситуацию так: «Наша стратегия по контенту для ИИ запустила "петлю гибели", которая одновременно ухудшит качество наших моделей и навредит всему вебу. Крайне необычно, когда конечный продукт угрожает экономическим основам своих ключевых поставщиков, но именно такую ситуацию мы создали для нашего бизнеса на больших языковых моделях в отношении его "цепочки поставок контента"».

Сатья Наделла признал, что чат-боты по сути заменили поиск и убрали необходимость переходить к первоисточнику. При этом в другом месте он же заявил, что «всё, что стоит за пейволлом (платным доступом), должно лицензироваться». Однако представитель OpenAI признал на суде, что ему «неизвестно» о каких-либо усилиях по обнаружению или удалению платного контента из обучающих данных (training data, то есть массивов текста, на которых учат модель).

Модели запоминают и воспроизводят дословно

Внутри OpenAI знали, что GPT-4 «запомнила огромный объём данных и поэтому будет безумно хороша в дословном воспроизведении». Компания признавала, что «предотвращение запоминания» важно для «минимизации нарушений авторских прав», но сотрудники фиксировали: галлюцинация (когда модель уверенно выдумывает факты) тут не главная проблема, проблема в точном копировании.

В документе приведены примеры, когда ChatGPT выдавал длинные фрагменты текста из The New York Times, Mercury News, The Denver Post, LifeHacker и Eurogamer в ответ на запросы пользователей.

Трафик падает, и они это отслеживают

Собственные эксперты OpenAI по медиа и экономике связали падение реферального трафика (переходов с поиска на сайты) для изданий вроде The New York Times напрямую с ИИ-обзорами в поиске, такими как Google AI Overviews. По их оценкам, реферальный трафик из поиска мог упасть до 60 процентов.

Ник Терли, руководитель ChatGPT в OpenAI, сформулировал это предельно честно: как только пользователь получил ответ от чат-бота, у него «нет веской причины кликать» на ссылку к первоисточнику. Внутренние документы OpenAI описывали ChatGPT как «современный газетный киоск».

Джек Кларк, директор по политике OpenAI, пошёл ещё дальше: компания «создаёт системы, которые заменяют труд людей, определяющих культуру общества».

Что делать с этим прямо сейчас, по ролям

  • Автору на Дзене и любому веб-издателю. Ваш контент уже используется для обучения моделей, даже если вы никому не давали согласия. Проверьте файл robots.txt вашего сайта: заблокируйте ботов GPTBot и CCBot, если не хотите отдавать тексты бесплатно. Это не гарантия, но хотя бы формальная позиция.

  • Копирайтеру и контент-маркетологу. «Петля гибели» работает так: ИИ забирает ваш текст, отвечает пользователю вместо вас, трафик на ваш сайт падает, вы зарабатываете меньше, производите меньше контента, модели получают меньше свежих данных, качество ответов снижается. Держите в голове эту механику, когда планируете формат. Уникальная экспертиза, которую нельзя извлечь скрейпингом (видео с лицом, закрытые сообщества, консультации), дорожает.

  • Предпринимателю в РФ и СНГ. Иск The New York Times касается американской юрисдикции, но российские модели вроде YandexGPT и GigaChat обучаются на похожих массивах данных. Правовой рамки для компенсации авторам в России пока нет. Если вы строите бизнес на контенте, фиксируйте авторство, сохраняйте метаданные и следите за развитием регулирования.

Как это выглядит на практике

В документе приведён конкретный механизм: пользователь задаёт ChatGPT вопрос, например, «перескажи статью NYT о климатическом саммите». Модель выдаёт длинный фрагмент оригинального текста, иногда дословно. Пользователь получил ответ. На сайт газеты он не пошёл. Рекламный доход издания за этот визит равен нулю. Теперь замените NYT на ваш канал на Дзене или ваш блог.

Частые ошибки

Не считайте, что запрет бота в robots.txt решает проблему: документ показывает, что OpenAI собирала данные, включая платный контент за пейволлом, и представитель компании «не знал» о попытках это фильтровать. Не верьте обещаниям «мы платим издателям»: Грег Брокман в переписке говорит о «газиллионах долларов» потенциальной прибыли от коммерческого ИИ, а не о компенсации авторам. Не путайте позицию одного сотрудника с корпоративной политикой, но и не игнорируйте её: Microsoft наняла Хехта именно для того, чтобы он говорил неудобные вещи, и он их сказал.

Мнение редакции dzen.guru

Я прочитал все 92 страницы, которые попали в открытый доступ. Самое поразительное не в цитатах, их легко обесценить как «мнение одного сотрудника». Поразительно то, что OpenAI и Microsoft внутри компании описывали свой продукт как разрушающий собственную цепочку поставок и всё равно продолжали. Для нас в dzen.guru это прямой сигнал: строить стратегию на поисковом трафике как на единственном канале уже нельзя. Подписная база, прямая аудитория, закрытые форматы. Всё, что не скрейпится одним ботом, становится вашим конкурентным преимуществом. Но честная оговорка: суд ещё не вынес решения, документы представлены одной стороной, и Microsoft оспаривает контекст цитат. Окончательную картину мы увидим после вердикта.

Постройте аудиторию, которую не заберёт ИИ

Изучите инструменты dzen.guru для прямой работы с подписчиками, чтобы трафик зависел от вас, а не от поисковых ботов

Попробовать dzen.guru

Суд по иску The New York Times к OpenAI и Microsoft ещё идёт, но внутренние документы уже сказали главное: компании знали, что ломают экосистему, и выбрали прибыль. Для каждого, кто зарабатывает текстом, это не повод паниковать, а повод перестать надеяться на чужую платформу и начать владеть своей аудиторией напрямую.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Большие языковые модели разобрали 474 712 строк автосервиса: точность 96%
ai

Большие языковые модели разобрали 474 712 строк автосервиса: точность 96%

Владимир Терехин из компании «РОЛЬФтех» описал, как его команда привела в порядок справочник автосервиса из 474 712 строк с помощью большой языковой модели, и…

6 мин
Google привязала обучение искусственному интеллекту к вузовским кредитам: уроки по 15 минут бесплатно
ai

Google привязала обучение искусственному интеллекту к вузовским кредитам: уроки по 15 минут бесплатно

Почему это важно Google впервые привязала бесплатные 15-минутные уроки по искусственному интеллекту к настоящим университетским кредитам, и теперь…

4 мин
Google расширяет команду по ИИ и экономике
ai

Google расширяет команду по ИИ и экономике

Google собрала команду нобелевских лауреатов и ведущих экономистов, чтобы в реальном времени отслеживать, как искусственный интеллект от Google меняет рынок…

5 мин