AI-контент в интернете достиг 35% новых страниц: коммерческие сайты генерируют его в 10 раз чаще
AI-контент в интернете вырос до трети всех новых веб-страниц: исследование Pew Research, опубликованное 26 июня 2026 года, впервые измерило масштаб на выборке почти в полмиллиона страниц и зафиксировало разрыв между коммерческими и некоммерческими сайтами в десять раз.

Цифры касаются не трафика ботов, а самого содержания страниц: треть того, что люди читают в интернете после запуска ChatGPT, написана или существенно отредактирована нейросетью, и коммерческие домены (.com) генерируют такой контент в десять раз чаще, чем образовательные и государственные.
Исследование вышло вскоре после того, как инфраструктурный провайдер Cloudflare сообщил: бот-трафик в интернете впервые обогнал человеческий, причём раньше, чем прогнозировала сама компания. Pew Research пошла дальше и посмотрела не на то, кто просматривает страницы, а на то, что именно на них написано. Вывод авторов лаконичен: значительная часть веба теперь представляет собой ботов, читающих страницы, написанные другими ботами. Источник и метод впервые названы в этом отчёте открыто.
| Показатель | Значение | Источник |
|---|---|---|
| Доля AI-контента среди страниц, опубликованных после запуска ChatGPT | 35 % | Pew Research, 2026 |
| Доля AI-контента в случайной выборке (включая старые страницы) | около 10 % | Pew Research, 2026 |
| Разрыв .com и .edu / .gov доменов | примерно 10 к 1 | Pew Research, 2026 |
| AI-контент на .org доменах | 4,6 % | Pew Research, 2026 |
| AI-контент на .edu и .gov доменах | около 1 % | Pew Research, 2026 |
| Размер корпуса | почти 500 000 англоязычных страниц | Pew Research, 2026 |
| Период сбора данных | примерно 5 лет, начиная за пару лет до ноября 2022 | Pew Research, 2026 |
| Контрольная выборка | 10 000 случайных страниц, собранных в июле 2026 | Pew Research, 2026 |
Как именно считали?
Pew Research использовала архив Common Crawl, открытый проект, который регулярно обходит и сохраняет копии веб-страниц со всего мира. Из него исследователи извлекли почти полмиллиона англоязычных страниц за примерно пять лет, захватив период до и после выхода ChatGPT в ноябре 2022 года.
Для определения AI-авторства применили технологию компании Pangram (в отчёте упоминается как Open Pangram). Это детектор, который оценивает вероятность того, что текст написан или серьёзно переработан нейросетью. По сути, это аналог антиплагиат-систем, только заточенный не на копипаст, а на характерные паттерны генерации.
Сначала взяли случайную выборку из 10 000 страниц, собранных в июле 2026 года. Получили около 10 % с признаками AI-авторства. Но авторы сразу оговорились: случайная выборка неизбежно включает старые страницы, написанные задолго до появления генеративных инструментов, и они «разбавляют» общий процент.
Поэтому для главного вывода отфильтровали всё, что опубликовано до запуска ChatGPT, и пересчитали. Результат: 35 % новых страниц несут признаки AI-авторства.
Что именно обнаружили?
- 35 % страниц, опубликованных после ноября 2022 года, показывают признаки того, что текст написан или существенно отредактирован ИИ.
- Коммерческие домены (.com) генерируют AI-контент в интернете примерно в 10 раз чаще, чем образовательные (.edu) и государственные (.gov), где доля составляет около 1 %.
- Некоммерческие организации (.org) занимают промежуточную позицию: 4,6 %.
- Помимо детектора, Pew нашла косвенные маркеры: за последние годы на страницах выросло использование длинных тире (em dash), оксфордских запятых и характерных конструкций вроде «это не X, это Y», типичных стилистических «отпечатков» языковых моделей.
Последний пункт особенно показателен для тех, кто работает с текстом. AI-контент в интернете опознаётся не только детекторами, но и по стилистическим клише, которые нейросети воспроизводят из раза в раз.
Pangram, как и любой детектор AI-текста, допускает ложные срабатывания: может пометить человеческий текст как машинный. Pew признаёт это прямо в отчёте и говорит, что на масштабе данные «по крайней мере, верны по направлению» (directionally correct), но не претендуют на точность в каждом отдельном случае. Выборка охватывает только англоязычные страницы, поэтому напрямую переносить проценты на Рунет нельзя. Наконец, «существенная редактура ИИ» и «полностью написано ИИ» в отчёте не разделены, а это принципиально разные ситуации для оценки качества.
Что это значит для вас?
Авторам Дзена и копирайтерам. Если треть англоязычного коммерческого веба уже заполнена генеративным текстом, конкуренция за внимание читателя смещается от объёма к узнаваемости голоса. Стилистические клише нейросетей (те самые длинные тире и конструкции «это не X, а Y») становятся антипаттерном: читатель, даже не запуская детектор, начинает «считывать» шаблон. Практический шаг: пройдитесь по своим последним текстам и проверьте, нет ли в них этих маркеров, даже если вы писали сами.
Маркетологам и владельцам коммерческих сайтов. Домены .com лидируют по доле AI-контента, и это логично: именно на коммерческих площадках масштабируют описания товаров, SEO-страницы, блоги. Но когда треть конкурентов генерирует тексты нейросетью, поисковики неизбежно начнут жёстче фильтровать шаблонный контент. Кто раньше выстроит редакционный процесс с экспертизой поверх генерации, тот получит преимущество.
Предпринимателям в РФ и СНГ. Исследование Pew охватывает англоязычный веб, но тренд не знает границ. Если вы используете YandexGPT, GigaChat или зарубежные модели для наполнения сайта, имейте в виду: детекторы совершенствуются, а доля AI-контента в интернете уже достаточна, чтобы площадки и поисковики вводили маркировку или понижение в выдаче. Разумный подход: нейросеть как черновик, человек как финальный редактор с экспертизой.
Цифра 35 % звучит внушительно, но по моим наблюдениям, в русскоязычном коммерческом сегменте (карточки товаров, SEO-лендинги) реальная доля может быть не меньше. Просто её пока никто не измерил с такой методологией. Главное, что я вынес из отчёта: проблема не в самом AI-контенте, а в его однородности. Когда треть страниц пишет одна и та же модель с похожими промптами (запросами к нейросети), веб становится скучнее. Для авторов, которые вкладывают в текст опыт и позицию, это не угроза, а шанс: на фоне одинакового живой голос заметнее.
Исследование Pew фиксирует не прогноз, а факт: AI-контент в интернете уже составляет треть нового веба, и эта доля растёт. Для тех, кто зарабатывает текстом, вывод один: ценность переместилась от способности написать много к способности написать так, как нейросеть не умеет.
По данным Pew Research / TechCrunch

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

AI Max инструменты для бизнеса
Почему это важно Google впервые позволяет тестировать бюджеты и ROI сразу нескольких рекламных кампаний в одном A/B-эксперименте, а не по одной, как раньше, и…

React Native: что это в 2026 году, когда старый мост удалён и нужен Kotlin
React Native в 2026 году перестал быть простым «напиши один раз для двух платформ»: теперь это гибридный стек, где основной код живёт на TypeScript, а…

Искусственный интеллект решает задачи, над которыми математика билась десятилетиями: академики в кризисе
Кризис, который назревал давно, но ударил внезапно: ведущие математики мира оказались в ситуации, когда искусственный интеллект решает задачи, над которыми…
Комментарии