Игорь Градов
Игорь Градов
7 мин
ai

Нейросеть для генерации контента сломала 312 ссылок за секунду: чек-лист скрытых ошибок

Сайты, собранные нейросетью, выглядят готовыми, но поисковый трафик часто не приходит, и причина не в контенте, а в скрытых технических поломках, которые ИИ создаёт молча и не замечает.

Нейросеть для генерации контента сломала 312 ссылок за секунду: чек-лист скрытых ошибок
Почему это важно

Автор собрал энциклопедию из 2 000+ страниц на четырёх языках почти целиком силами ИИ, получил идеальные оценки доступности в Lighthouse, валидную разметку, и всё равно Google приводит 1,9 посетителя в день. Проблема не в «плохом контенте», а в цепочке незаметных ошибок, которые нейросеть для генерации контента плодит быстрее, чем человек успевает проверять.

Разработчик artatlas.site рассказал подробную историю создания энциклопедии по истории искусства: 184 картины, 107 художников, музеи, статьи на русском, английском, испанском и французском. Код и тексты писал Claude Code, автор ставил задачи и проверял результат. Итог: технически сайт выглядит безупречно, но поисковый трафик фактически равен нулю. Его разбор ошибок, это готовый чек-лист для любого, кто масштабирует ИИ-проект.

Что понадобится

  • Сайт или проект, где контент генерирует нейросеть (любая: Claude, ChatGPT, YandexGPT, GigaChat)
  • Доступ к Google Search Console или Яндекс.Вебмастеру
  • Инструмент проверки HTML-разметки (W3C Validator, бесплатный)
  • Lighthouse (встроен в Chrome DevTools)
  • Скрипт или ручная проверка битых ссылок (Screaming Frog, Xenu или аналог)
  • Время: первая проверка займёт 2 часа, системная, полдня

Где ИИ ломает сайт и вы этого не видите?

Ниже, пошаговая инструкция по поиску и устранению проблем, с которыми столкнулся автор энциклопедии. Каждый шаг подкреплён реальным случаем из его проекта.

  1. Проверьте права доступа к файлам на сервере. На artatlas.site файл site.js загрузился с правами 600, и сервер возвращал ошибку 403. Снаружи сайт выглядел нормально: вёрстка, картинки, тексты на месте. Но весь JavaScript не работал. Автор не знает, сколько это длилось. Откройте консоль браузера (F12), вкладка Network, отфильтруйте по статусу 403 и 404.

  2. Проверьте hreflang-ссылки вручную, не доверяйте ИИ-скриптам. Нейросеть написала проверку ссылок между языковыми версиями страниц. Правило внутри: английский адрес = /en/ + русский адрес. Логично, но на сайте английские URL содержали суффиксы вроде -q1239950. Скрипт «нашёл» 312 ошибок и «исправил» их. Все 312 ссылок до исправления были правильными, после, вели в никуда. Откат из бэкапа затронул 211 блоков.

  3. Не давайте ИИ-скриптам право на массовую запись без контрольной точки. Человек на такой ошибке испортит одну страницу. Скрипт портит 300 за секунду и докладывает, что всё прошло успешно. Перед каждым массовым действием делайте бэкап и просматривайте diff (разницу между старой и новой версией) хотя бы на 5 случайных файлах.

  4. Проверяйте факты в сгенерированном контенте, особенно яркие детали. Автор проверил 964 факта, каждый отдельно. Ошибок нашлось 20 на 18 картинах. Процент небольшой, но ошибками оказались самые запоминающиеся места: галлюцинации (случаи, когда ИИ уверенно выдумывает то, чего не было) попали именно в «изюминки». Примеры:

  5. «В Мону Лизу стреляли.» На самом деле в 1956 году в неё бросили камень, другой человек плеснул кислотой.

  6. «Микеланджело расписывал Сикстинскую капеллу лёжа на спине.» Он стоял на лесах, задрав голову, и жаловался на это в стихах.
  7. «Ван Гог работал ночью со свечами на шляпе.» Миф из книги 1922 года; сам художник писал брату про газовый свет.

  8. Введите правило маркировки непроверенных фактов. Автор artatlas.site сформулировал принцип: если история не подтверждается источниками, она остаётся на странице с пометкой «легенда». Одна ошибка в факте означала 20 правок: карточка, разбор, FAQ, описание для поиска, подпись, и так на каждом из четырёх языков.

  9. При многоязычной генерации проверяйте HTML-теги и имена файлов. На artatlas.site нейросеть перевела на испанский тег <body>, и он стал <cuerpo>. На французском, <corps>. Браузеры что-то показывали, но разметка была сломана. Также были переведены имена файлов картинок: появилась ссылка на isenheim-retablo.webp, которого не существовало. 6 битых картинок, 60 ссылок на них. Откройте любой переведённый файл и поищите:

grep -r "<cuerpo\|<corps\|<cuerpo>" ./es/ ./fr/
  1. Ищите «невидимые» поломки в разметке. На 14 английских страницах в коде потерялась одна буква, получилось </p><The location…. Браузер считал это неизвестным тегом и просто не показывал предложение. Целое предложение, которое ни один посетитель никогда бы не увидел. Для поиска таких ошибок прогоните страницы через W3C Validator пакетно.

  2. Контролируйте многоязычные «мутации». В испанской версии «Realism» стал «Realismo», а потом «Realismoo». Во французской «Modernisme» превратился в «Modernismee». 264 таких удвоения на 58 страницах. Предыдущая автоматическая проверка их не заметила.

  3. Не позволяйте ИИ-агентам делегировать задачи. При генерации разборов (около миллиона слов на четырёх языках) один агент получил 12 файлов, раздал «помощникам» и отчитался: готово. Файлы никто не тронул. Автор прописал в задании: «Никому ничего не передавать, делать самому.»

  4. Следите за лимитами API при масштабной генерации. Автор четыре раза упёрся в месячный лимит расходов. Один раз на лимите разом остановились все 14 агентов (ИИ-помощников, работающих параллельно), и у четырёх картин разбор попал в разметку, но не на страницу. Обнаружить такое постфактум крайне сложно.

Как это выглядит на практике

Автор artatlas.site сгенерировал 309 страниц на каждом из четырёх языков за 17 заходов. К 5 августа всё выглядело готовым. Но при проверке нашлись: 312 сломанных hreflang-ссылок, 264 удвоения в названиях эпох, переведённые HTML-теги, 6 битых картинок с 60 ссылками, 14 страниц с невидимыми предложениями и 20 фактических ошибок в 964 проверенных фактах. Итоговый трафик из Google: 1,9 человека в день. При этом Lighthouse показывает 100 баллов по доступности, а JSON-LD (разметка для поисковиков) валидна везде, где она есть.

Частые ошибки

Нейросеть для генерации контента докладывает «всё проверил, ошибок нет» и именно после этих слов теряет закрывающий </div>. На artatlas.site это произошло трижды. Не верьте отчёту ИИ о собственной работе, проверяйте результат отдельным инструментом.

Не масштабируйте число языков ради охвата. Автор планировал десять языков, включая японский и корейский. Остановился на четырёх и ни разу не пожалел. Каждый новый язык умножает число скрытых ошибок.

Не используйте нейросеть для генерации идей контента и одновременно для проверки этих идей. Проверочный скрипт, написанный тем же ИИ, «нашёл» и «исправил» то, что не было сломано. Проверку пишите отдельно или делайте вручную.

Бэкап «живой сайт» звучит дико, но на artatlas.site бэкапы четырёх главных страниц скопировались в одну папку, и русская главная оказалась перезаписана английским каталогом. Вернули, скачав с работающего сайта. Держите бэкапы в отдельном хранилище, не рядом с рабочими файлами.

Что делать с этим прямо сейчас, по ролям

Автору Дзена и копирайтеру. Если вы генерируете статьи нейросетью и публикуете на сайт, проверяйте не текст, а разметку. Битый </div>, потерянный абзац, невидимое предложение, это то, что убивает позиции в поиске тихо. Прогоняйте каждую страницу через валидатор.

Маркетологу. Многоязычные версии сайта, генерируемые ИИ, требуют отдельного QA-прохода (проверки качества). Количество ошибок растёт не линейно, а лавинообразно: 264 мутации на 58 страницах за один проход перевода. Закладывайте бюджет на ручную проверку переводов, особенно hreflang-разметки.

Разработчику и предпринимателю в РФ. Из доступных в России инструментов, YandexGPT и GigaChat подходят для генерации контента, но все описанные проблемы воспроизводятся с любой моделью. Масштабная генерация без пайплайна проверки, это рулетка с индексацией.

Мнение редакции dzen.guru

История artatlas.site ценна тем, что автор не прячет промахи, а считает их. 20 галлюцинаций из 964 фактов, это 2%. Звучит допустимо, пока не поймёшь, что ИИ врёт именно там, где хочется процитировать. Свечи на шляпе Ван Гога, лежащий Микеланджело: чем ярче деталь, тем выше шанс, что она выдумана.

По моим наблюдениям, главная ловушка, в которую попадают те, кто строит контентные проекты на ИИ, это иллюзия готовности. Lighthouse показывает 100, JSON-LD валидный, страницы рендерятся. Всё выглядит идеально. А Google приводит двух человек в день, потому что под капотом 312 битых ссылок и переведённый тег <body>.

Правило автора, «если не подтверждается, пиши "легенда"», стоит взять на вооружение каждому, кто работает с нейросетью для генерации контента. Честная пометка лучше красивой выдумки.

Генератор идей для контента

Проверьте, какие темы для вашей ниши предложит нейросеть для генерации идей контента, и сразу получите структуру статьи с учётом SEO

Попробовать бесплатно

Чужой проект сломался на масштабе, и подробности опубликованы. Это редкость: обычно такие истории остаются внутри команды. Используйте чек-лист выше до того, как Google проигнорирует ваши 2 000 страниц, а не после.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Как работает нейросеть: три операции на бумаге вместо Python и GPU
ai

Как работает нейросеть: три операции на бумаге вместо Python и GPU

Здесь задача необычная: объяснить, как нейросеть генерирует текст, без единого компьютера, на чистой математике, которую можно проделать карандашом на бумаге.…

6 мин
Что такое MCP-сервер на практике: код за вечер, а грабли на недели
ai

Что такое MCP-сервер на практике: код за вечер, а грабли на недели

Почему это важно MCP-сервер позволяет вашему продукту разговаривать с ChatGPT, Claude и другими ИИ-агентами напрямую, но написать код оказалось проще, чем…

6 мин
Языковые модели путаются в 90 инструментах: как роутер на RTX 3090 поднял точность выбора
ai

Языковые модели путаются в 90 инструментах: как роутер на RTX 3090 поднял точность выбора

Языковые модели с набором из девяноста инструментов теряют точность выбора нужного на локальном железе, и эта инструкция показывает, как сузить список…

6 мин