Игорь Градов
Игорь Градов
5 мин
ai

AI-контент в интернете достиг 35% новых страниц: коммерческие сайты генерируют его в 10 раз чаще

AI-контент в интернете вырос до трети всех новых веб-страниц: исследование Pew Research, опубликованное 26 июня 2026 года, впервые измерило масштаб на выборке почти в полмиллиона страниц и зафиксировало разрыв между коммерческими и некоммерческими сайтами в десять раз.

AI-контент в интернете достиг 35% новых страниц: коммерческие сайты генерируют его в 10 раз чаще
Почему это важно

Цифры касаются не трафика ботов, а самого содержания страниц: треть того, что люди читают в интернете после запуска ChatGPT, написана или существенно отредактирована нейросетью, и коммерческие домены (.com) генерируют такой контент в десять раз чаще, чем образовательные и государственные.

Исследование вышло вскоре после того, как инфраструктурный провайдер Cloudflare сообщил: бот-трафик в интернете впервые обогнал человеческий, причём раньше, чем прогнозировала сама компания. Pew Research пошла дальше и посмотрела не на то, кто просматривает страницы, а на то, что именно на них написано. Вывод авторов лаконичен: значительная часть веба теперь представляет собой ботов, читающих страницы, написанные другими ботами. Источник и метод впервые названы в этом отчёте открыто.

Показатель Значение Источник
Доля AI-контента среди страниц, опубликованных после запуска ChatGPT 35 % Pew Research, 2026
Доля AI-контента в случайной выборке (включая старые страницы) около 10 % Pew Research, 2026
Разрыв .com и .edu / .gov доменов примерно 10 к 1 Pew Research, 2026
AI-контент на .org доменах 4,6 % Pew Research, 2026
AI-контент на .edu и .gov доменах около 1 % Pew Research, 2026
Размер корпуса почти 500 000 англоязычных страниц Pew Research, 2026
Период сбора данных примерно 5 лет, начиная за пару лет до ноября 2022 Pew Research, 2026
Контрольная выборка 10 000 случайных страниц, собранных в июле 2026 Pew Research, 2026

Как именно считали?

Pew Research использовала архив Common Crawl, открытый проект, который регулярно обходит и сохраняет копии веб-страниц со всего мира. Из него исследователи извлекли почти полмиллиона англоязычных страниц за примерно пять лет, захватив период до и после выхода ChatGPT в ноябре 2022 года.

Для определения AI-авторства применили технологию компании Pangram (в отчёте упоминается как Open Pangram). Это детектор, который оценивает вероятность того, что текст написан или серьёзно переработан нейросетью. По сути, это аналог антиплагиат-систем, только заточенный не на копипаст, а на характерные паттерны генерации.

Сначала взяли случайную выборку из 10 000 страниц, собранных в июле 2026 года. Получили около 10 % с признаками AI-авторства. Но авторы сразу оговорились: случайная выборка неизбежно включает старые страницы, написанные задолго до появления генеративных инструментов, и они «разбавляют» общий процент.

Поэтому для главного вывода отфильтровали всё, что опубликовано до запуска ChatGPT, и пересчитали. Результат: 35 % новых страниц несут признаки AI-авторства.

Что именно обнаружили?

  • 35 % страниц, опубликованных после ноября 2022 года, показывают признаки того, что текст написан или существенно отредактирован ИИ.
  • Коммерческие домены (.com) генерируют AI-контент в интернете примерно в 10 раз чаще, чем образовательные (.edu) и государственные (.gov), где доля составляет около 1 %.
  • Некоммерческие организации (.org) занимают промежуточную позицию: 4,6 %.
  • Помимо детектора, Pew нашла косвенные маркеры: за последние годы на страницах выросло использование длинных тире (em dash), оксфордских запятых и характерных конструкций вроде «это не X, это Y», типичных стилистических «отпечатков» языковых моделей.

Последний пункт особенно показателен для тех, кто работает с текстом. AI-контент в интернете опознаётся не только детекторами, но и по стилистическим клише, которые нейросети воспроизводят из раза в раз.

Как это читать: оговорки и ограничения

Pangram, как и любой детектор AI-текста, допускает ложные срабатывания: может пометить человеческий текст как машинный. Pew признаёт это прямо в отчёте и говорит, что на масштабе данные «по крайней мере, верны по направлению» (directionally correct), но не претендуют на точность в каждом отдельном случае. Выборка охватывает только англоязычные страницы, поэтому напрямую переносить проценты на Рунет нельзя. Наконец, «существенная редактура ИИ» и «полностью написано ИИ» в отчёте не разделены, а это принципиально разные ситуации для оценки качества.

Что это значит для вас?

Авторам Дзена и копирайтерам. Если треть англоязычного коммерческого веба уже заполнена генеративным текстом, конкуренция за внимание читателя смещается от объёма к узнаваемости голоса. Стилистические клише нейросетей (те самые длинные тире и конструкции «это не X, а Y») становятся антипаттерном: читатель, даже не запуская детектор, начинает «считывать» шаблон. Практический шаг: пройдитесь по своим последним текстам и проверьте, нет ли в них этих маркеров, даже если вы писали сами.

Маркетологам и владельцам коммерческих сайтов. Домены .com лидируют по доле AI-контента, и это логично: именно на коммерческих площадках масштабируют описания товаров, SEO-страницы, блоги. Но когда треть конкурентов генерирует тексты нейросетью, поисковики неизбежно начнут жёстче фильтровать шаблонный контент. Кто раньше выстроит редакционный процесс с экспертизой поверх генерации, тот получит преимущество.

Предпринимателям в РФ и СНГ. Исследование Pew охватывает англоязычный веб, но тренд не знает границ. Если вы используете YandexGPT, GigaChat или зарубежные модели для наполнения сайта, имейте в виду: детекторы совершенствуются, а доля AI-контента в интернете уже достаточна, чтобы площадки и поисковики вводили маркировку или понижение в выдаче. Разумный подход: нейросеть как черновик, человек как финальный редактор с экспертизой.

Мнение редакции dzen.guru

Цифра 35 % звучит внушительно, но по моим наблюдениям, в русскоязычном коммерческом сегменте (карточки товаров, SEO-лендинги) реальная доля может быть не меньше. Просто её пока никто не измерил с такой методологией. Главное, что я вынес из отчёта: проблема не в самом AI-контенте, а в его однородности. Когда треть страниц пишет одна и та же модель с похожими промптами (запросами к нейросети), веб становится скучнее. Для авторов, которые вкладывают в текст опыт и позицию, это не угроза, а шанс: на фоне одинакового живой голос заметнее.

Исследование Pew фиксирует не прогноз, а факт: AI-контент в интернете уже составляет треть нового веба, и эта доля растёт. Для тех, кто зарабатывает текстом, вывод один: ценность переместилась от способности написать много к способности написать так, как нейросеть не умеет.

По данным Pew Research / TechCrunch

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

AI Max инструменты для бизнеса
ai

AI Max инструменты для бизнеса

Почему это важно Google впервые позволяет тестировать бюджеты и ROI сразу нескольких рекламных кампаний в одном A/B-эксперименте, а не по одной, как раньше, и…

4 мин
React Native: что это в 2026 году, когда старый мост удалён и нужен Kotlin
ai

React Native: что это в 2026 году, когда старый мост удалён и нужен Kotlin

React Native в 2026 году перестал быть простым «напиши один раз для двух платформ»: теперь это гибридный стек, где основной код живёт на TypeScript, а…

6 мин
Искусственный интеллект решает задачи, над которыми математика билась десятилетиями: академики в кризисе
ai

Искусственный интеллект решает задачи, над которыми математика билась десятилетиями: академики в кризисе

Кризис, который назревал давно, но ударил внезапно: ведущие математики мира оказались в ситуации, когда искусственный интеллект решает задачи, над которыми…

5 мин