HQS High Quality Sir

ИИ-цирк: полевой определитель

Как распознать следы небрежной ИИ-генерации на сайте: в дизайне, текстах, коде и структуре. Чек-лист для человека и готовое задание для ИИ-агента, который пройдётся по всем параметрам за вас.

Что такое «ИИ-цирк» и почему он вредит

«ИИ-цирк» это собирательное имя для визуального и текстового мусора, который остаётся на сайте после генерации контента нейросетями «как есть», без редактуры. По отдельности каждый элемент кажется мелочью. Вместе они складываются в узнаваемый почерк, который считывают и живые посетители (сайт-однодневка), и поисковые системы (масштабируемый шаблонный контент это прямой сигнал низкого качества для Google), и рекламодатели.

Главный принцип: ни один элемент интерфейса и текста не должен существовать «для украшения» или «потому что так сгенерировалось». У всего, у бейджа, у стрелки, у цифры, у эпитета, должна быть проверяемая функция.

Как пользоваться. Человеку: читать разделы A-D как чек-лист при ревью макета или страницы. Агенту: отдать документ целиком вместе с промптом из приложения 1, там же регулярные выражения для автоскана и ловушки сканирования, чтобы агент не завалил вас ложными тревогами.

Раздел A. Дизайн и вёрстка

Девять паттернов, которые видно глазами до того, как вы прочитали хоть слово.

  • A1

    Чип-спам

    Россыпь мелких бейджей-«чипов» вокруг заголовка: «TOP AUSWAHL», «NEU», «HOT», «12 предложений», «0 категорий». ИИ-генераторы обожают заполнять пустоту капсулами. Признак: три и больше чипа на один блок; чипы, дублирующие друг друга по смыслу; чип с нулём или пустым значением («0 Kategorien» это счётчик мёртвой сущности).

    Правило: максимум один кикер или лейбл на секцию. Каждый бейдж должен сообщать факт, которого нет в заголовке.

  • A2

    Декоративные плавающие токены

    Абсолютно спозиционированные квадратики «777», «VIP», «FS», парящие вокруг hero-картинки, псевдокарточки «Hot Picks» без ссылок и функции. Выглядят как мокап из генератора лендингов. На реальных вьюпортах наезжают на текст и обрезаются.

  • A3

    Фейковая нумерация и фейковые шаги

    «01 / 02 / 03» без реальной последовательности; «шаги», которые не являются шагами; прогресс-бары без прогресса.

    Проверка: можно ли поменять блоки местами без потери смысла? Если да, нумерация декоративная.

  • A4

    Эмодзи вместо типографики

    ✅ ❌ ⚡ 🔥 в заголовках, списках и кнопках. Псевдосписки «✅ пункт<br>✅ пункт» вместо настоящего <ul>. Стрелки «→» в конце каждой ссылки и кнопки. Отдельный подвид: эмодзи-заголовок «🔥 Заголовок», почти стопроцентный маркер сырой генерации.

    Правило: смысловые списки только настоящими списками; галочки и крестики словами или семантической вёрсткой; типографские звёзды рейтинга (★) допустимый дизайн-элемент, не путать с эмодзи.

  • A5

    Смесь языков в интерфейсе

    Немецкая (русская, любая) страница с кнопками «Get Bonus», лейблами «Hot Picks», «Fast Lane», «Casino Mode», офферами «up to €100 + 30 Free Spins». ИИ мыслит английскими шаблонами и вставляет их в любой язык.

    Правило: всё, что видит пользователь, на одном языке.

  • A6

    Разнобой форматов

    «4.3» рядом с «4,5»; «2500 €» рядом с «2.500€» и «EUR 2500»; «21 Sep 2026» рядом с «29.06.2026». Каждая локаль имеет одну норму: выберите её и приведите всё, десятичный разделитель, разряды, валюту, даты, проценты (в немецком: 2.500 €, 4,8, 250 %, 21.09.2026).

  • A7

    Неон, градиенты и glow

    Фиолетово-синие градиенты, свечение вокруг кнопок, стеклянные карточки со всеми эффектами сразу: дефолтная эстетика ИИ-генераторов 2023-2025. Также: тени и радиусы «на глаз», у каждого блока свои.

    Правило: палитра из токенов, шкала радиусов и теней из 3-4 значений, один акцентный цвет на блок.

  • A8

    Картинки-заглушки и рваная сетка

    Три подвида: однотипные сгенерированные тайлы-заглушки, часто одинакового размера в байтах; случайные скриншоты разных пропорций в одном ряду карточек (300×92 рядом с 300×300); стоковые ИИ-иллюстрации «человек с ноутбуком в неоне». Все alt при этом пустые.

    Правило: один формат тайла на ряд, осмысленные alt, никаких «Screenshot_2-1.jpg» в проде.

  • A9

    Сломанная адаптивность

    ИИ-вёрстка проверяется на одном десктопном вьюпорте. Типовые симптомы на мобиле: абсолютные бейджи наезжают на заголовки, кнопка выпадает из карточки на новую строку, длинные значения обрезаются многоточием посреди слова, hero-декор перекрывает контент.

    Правило: проверять минимум на 375px и 768px.

Раздел B. Тексты

Шесть текстовых привычек модели, которые не вычитали.

  • B1

    Тире-цепочки

    «X, это Y, и вот почему»: конструкция «слово, пояснение» через длинное тире в каждом втором абзаце. Норма: одно-два тире на страницу вне заголовков. Лечится заменой на двоеточие, скобки или отдельное предложение.

  • B2

    Шаблонные риторические фигуры

    • «не только ... но и» (nicht nur ... sondern auch) в каждом разделе;
    • правило трёх: «быстро, удобно и безопасно», тройки прилагательных подряд;
    • риторический вопрос с самоответом: «Звучит отлично, правда? Но...» / «Klingt gut, oder?»;
    • вводные-паразиты: «В современном мире...», «In der heutigen Zeit...», «Стоит отметить, что...»;
    • финал-открытка: «Будущее выглядит многообещающе», «die Zukunft sieht rosig aus».
  • B3

    Эпитеты вместо цифр

    «Выгодные условия», «faire Bedingungen», «молниеносные выплаты» там, где должны стоять проверяемые числа: вейджер x35, лимит 5 €, срок 24-48 часов.

    Проверка: каждый оценочный эпитет должен быть заменяем на цифру или удаляем без потери смысла.

  • B4

    Битая локаль: транслит и потерянные буквы

    Два класса повреждений (немецкий пример, но механика универсальна). Транслит-умлауты: fuer, ueber, moeglich, grosse вместо für, über, möglich, große, модель генерировала в ASCII; ищется словарным сканом. Выпавшие буквы: «hoheren Betragen langer moglich» вместо «höheren Beträgen länger möglich», диакритика просто потеряна; автоскан по «ue/oe/ae» это не ловит, нужен словарь частотных слов без умлаутов.

    Где искать: не только тексты страниц, но и заголовки записей, мета-поля, тайтлы и дескрипшены, строки в шаблонах темы, тексты кнопок.

  • B5

    Boilerplate-дубликация

    Двадцать страниц с одинаковым абзацем-предупреждением, одинаковым FAQ и одинаковой структурой фраз, где меняется только название бренда. Поисковик видит шаблонную сетку.

    Правило: повторяемые блоки переписываются вариативно (4-5 скелетов формулировок) и наполняются фактами конкретной страницы.

  • B6

    Обрывы и артефакты генерации

    Предложение, оборванное на полуслове («...haben werden. Für » и конец текста); случайные кириллические буквы в латинском тексте («Hauptmodelли»); удвоенные пробелы и &nbsp; в случайных местах; неразрывные пробелы внутри слов.

Раздел C. Технические отпечатки в коде

Улики, которых не видно на экране, но видно в исходнике. Самые прямые из всех.

  • C1

    Атрибуты и классы чат-интерфейсов

    Прямая улика копипасты из окна чат-бота в редактор: атрибуты data-start=, data-end=, data-path-to-node=, data-index-in-node=, data-is-only-node; классы text-token..., whitespace-pre-wrap, scroll-mt-..., min-w-(--thread-content-width), markdown; dir="auto" и tabindex="-1" на абзацах, обёртки <article> вокруг каждого куска текста.

    Где искать: по всей базе, в контенте записей и в мета-полях. Мета проверяют реже, и мусор там живёт годами.

  • C2

    Обёртки текстовых редакторов

    <span style="font-weight: 400;"> вокруг каждого абзаца: след экспорта из Google Docs. Картинки, вложенные внутрь этих span.

    Осторожно: голые <span> бывают и осмысленной дизайн-разметкой (бейджи, фичи карточек). Перед массовым снятием обёрток проверить, что у span нет роли в CSS.

  • C3

    Промпт-скелет в паблише

    Опубликованная страница со служебной разметкой задания: «Untertitel: ...», «Highlights:», «CTA: Забрать бонус», «Microcopy: ...», «Вариант 2:», «[вставить название]». Автор скопировал ответ модели целиком, вместе со скелетом промпта. Ищется по характерным словам-меткам.

  • C4

    Lorem-сущности в данных

    Не только «lorem ipsum» в тексте: заглушки просачиваются в справочники. Таксономия «Производители ПО» со значениями «Vel Tech» и «Velit Egestas» (куски lorem ipsum), тестовые категории, фейковые имена авторов.

    Где искать: термы таксономий, опции, поля карточек.

  • C5

    Внутренняя кухня в интерфейсе

    Текст для разработчика, показанный пользователю: «Sortierung: Startjahr → Review-Datum → Profil-Update», «данные берутся из таксономии X», названия полей и слаги как видимый текст (/brand-vs-brand/ вместо названия).

    Правило: пользователю ценность, механика в код и документацию.

  • C6

    Ссылки на мёртвые сущности

    Фильтр по удалённой таксономии (рендерится пустым или «0 категорий»), кнопки на страницы, отдающие 404/410, сортировка по несуществующему полю. Возникает, когда структуру чистили, а шаблоны нет.

    Правило: после любого удаления сущностей обход шаблонов на упоминания.

Раздел D. Структура и данные

Уровень SEO: то, что стоит дороже всего, потому что бьёт по всему сайту сразу.

  • D1

    Слаги-клоны

    Самый дорогой паттерн: страницы разных брендов на URL вида brand-x-offer, brand-x-offer-2, ... brand-x-offer-19. CMS доклеивала «-N» к скопированному адресу, и никто не заметил. Для поисковика это шаблонная сетка-клон. Проверять фактические URL (включая механизмы кастомных пермалинков), а не только заголовки страниц.

    Лечение: честные слаги плюс 301 со старых адресов.

  • D2

    Фейковые и протухшие цифры доверия

    Рейтинги «Trustpilot 4,8 (2 340 отзывов)», не совпадающие с реальным профилем (реально 2,4), «звёзды» у брендов, чей профиль удалён за нарушения, даты «проверено вчера» на нетронутых страницах.

    Правило: каждая внешняя цифра доверия обязана быть проверяемой по ссылке и датированной («Stand: 22.09.2026»). Ложная цифра хуже отсутствующей.

  • D3

    Шаблонные тайтлы и заголовки-канцелярит

    Пятнадцать страниц с тайтлом «Brand: 5.000 € Bonus + 300 Freispiele», отличающихся одним словом; H1 с ошибками регистра («Casino bonus ohne einzahlung»); заголовки-вопросы без ответов в тексте.

  • D4

    Сироты после чисток

    Заголовок «Топ-4 лучших бонусов» без таблицы под ним (шорткод удалили, заголовок остался), пустые <p></p>, кнопки без назначения.

    Правило: после каждой массовой правки контрольный проход по осиротевшим элементам.

Раздел E. Как проверять: методика и ловушки сканера

Порядок работ и шесть ситуаций, когда сканер кричит зря.

  1. Автоскан всех публичных URL регулярками из приложения 2.
  2. Ручная верификация каждой находки в живом рендере.
  3. Поиск источника: контент, мета, шаблон или опции.
  4. Правка с бэкапом.
  5. Контрольный скан.

Известные ложные тревоги

Симптом сканераЧто это на самом деле
«Эмодзи» ★ ☆ в диапазоне U+2600-26FFТипографские звёзды рейтинга, легитимный дизайн.
«Транслит» fuer/ueber по 1-3 на страницеСлова внутри слагов в href-атрибутах (дефис = граница слова). Сканировать видимый текст, вырезав атрибуты, скрипты и стили.
«Lorem»: placeholderАтрибут placeholder= у полей форм.
Стрелки и галочки при байтовом grepМногобайтовая ловушка: байты «ü» и длинного тире пересекаются с байтами ✔ и →. Контексты проверять только UTF-8-инструментом (perl -CSD, python).
«Чип-спам»: 8-10 элементов с классом chip/pillМожет быть осмысленной системой бейджей (лицензия, рейтинги списка альтернатив). Критерий функция, а не количество классов.
Находка есть в скане, в свежем рендере нетCDN отдал устаревшую копию. Перепроверять с cache-bust параметром и не по одному разу.

Приложение 1. Промпт для ИИ-агента

Отдаётся вместе с этим документом. Одна кнопка, и текст в буфере.

Ты аудитор качества сайта. К этому заданию приложен документ «ИИ-цирк: полевой определитель». Проведи аудит сайта {URL} по всем паттернам A1-A9, B1-B6, C1-C6, D1-D4.

Порядок работы:
1. Собери все публичные URL (sitemap; если его нет, обход от главной, до 200 страниц).
2. Прогони автоскан по регулярным выражениям из приложения 2 документа: считай вхождения по каждой странице, вырезав из HTML скрипты, стили и значения атрибутов.
3. Каждую находку верифицируй в живом рендере страницы (с cache-bust параметром), сверяясь с разделом E «ложные тревоги». Находку без верификации не публикуй.
4. Для каждой подтверждённой проблемы укажи: URL, паттерн (код из документа), точную цитату или фрагмент, где живёт источник (контент страницы / мета / шаблон / настройки) и предложение по исправлению в одну строку.
5. Отдельно проверь: фактические URL всех страниц на клоны вида name-2/-3 (паттерн D1); все внешние цифры доверия на соответствие первоисточнику (D2); мобильный рендер 3-5 ключевых страниц на 375px (A9).
6. Итог оформи таблицей: URL | паттерн | фрагмент | источник | правка. Отсортируй по серьёзности: D1-D2 (SEO-риск), затем C1-C4 (прямые улики), затем A/B (качество).

Ничего не исправляй без подтверждения владельца. Не выдумывай данные для «улучшения»: если реальной цифры нет, предлагай убрать элемент, а не подставить правдоподобную.

Приложение 2. Регулярные выражения для автоскана

Все выражения для UTF-8-инструмента. Байтовый grep даст ложные срабатывания, см. раздел E.

ПаттернRegex или метод
A4 Эмодзи[\x{1F300}-\x{1FAFF}\x{2700}-\x{27BF}] и отдельно [\x{2600}-\x{26FF}] минус ★☆ (U+2605/2606)
A4 Псевдосписки(?:✅|☑|❌|✔|✖)\s; заголовки: <h[1-6][^>]*>\s*(?:🔥|✅|⭐)
A4 Стрелки-декор→\s*</(?:a|button)> и [✔✖➤➜→] в видимом тексте
A5 Смесь языков (DE)\b(?:Hot Picks|Fast Lane|up to \d|Get Bonus|Claim now|Best Choice)\b
A6 Разнобой чисел (DE)рядом на странице: \d\.\d(?!\d) (точка-десятичная) и \d,\d; \d€ без пробела
B1 Тире-цепочкисчёт \s[\x{2014}\x{2013}]\s на страницу; порог: больше 2 вне FAQ-заголовков
B4 Транслит-умлаутысловарь по видимому тексту: \b(?:fuer|ueber|moeglich\w*|gross(?:e[mnrs]?)?|koennen|zusaetzlich\w*|waehrend|taeglich\w*|muessen|natuerlich|regelmaessig\w*|Gluecksspiel)\b
C1 GPT-атрибутыdata-(?:start|end|path-to-node|index-in-node|is-only-node)=; классы: text-token|whitespace-pre-wrap|min-w-\(--thread|scroll-mt-
C2 Docs-обёртки<span style="font-weight:\s*400;?">
C3 Промпт-скелет<(?:b|strong)>\s*(?:Untertitel|Highlights|CTA|Microcopy|Вариант \d|Заголовок H1):
C4 Lorem-сущности\b(?:lorem|ipsum|dolor sit|velit|Beispieltext)\b по контенту, термам таксономий и опциям; не по атрибуту placeholder=
D1 Слаги-клоныпо списку URL: -(?:[2-9]|1[0-9])/?$, затем проверить руками, клон это или легитимная пагинация
D4 Сироты<p>\s*(?:&nbsp;)?\s*</p>; заголовок, за которым сразу следующий заголовок того же уровня

Приложение 3. Экспресс-чек-лист для ревью руками

Двенадцать вопросов. Если на все «да», цирка на странице нет.

  1. На блок не больше одного кикера или бейджа; у каждого бейджа есть функция.
  2. Ноль эмодзи в заголовках, списках, кнопках; списки настоящие ul/ol.
  3. Весь видимый UI на одном языке.
  4. Один формат чисел, дат, валют и оценок на всём сайте.
  5. Картинки в ряду одного формата; alt заполнены; заглушек и «Screenshot_N» нет.
  6. Мобильный рендер 375px: ничего не наезжает и не выпадает.
  7. Не больше 1-2 тире на страницу; ни одного «не только... но и» подряд.
  8. Каждый оценочный эпитет подкреплён цифрой или удалён.
  9. Локаль целая: умлауты и диакритика на месте, включая заголовки и мета.
  10. В коде нет data-start, text-token, span font-weight:400, промпт-скелета.
  11. Нет ссылок и фильтров на удалённые сущности; нет «внутренней кухни» в UI.
  12. URL без клонов «-2/-3»; все внешние цифры доверия проверены и датированы.

Сайт чистый, а ссылки всё равно не работают?

Значит, дело не в цирке, а в сущности: Google не считает сайт издателем и не учитывает внешние сигналы. Как это собирается за три месяца, описано на странице «Сущность сайта». Вопросы по гайду: @seohqs.