Подписывайтесь на Telegram-канал Анатолия Половинкина основателя компании TolkaDigital
Главная - Глоссарий - Клоакинг

Клоакинг

Cloaking

SEO

Клоакинг — техника черной SEO-оптимизации, при которой поисковому роботу и живому пользователю намеренно показывается принципиально разный контент. Цель — обмануть поисковый алгоритм: дать роботу «идеальную» страницу с нужными сигналами ранжирования, пока реальные посетители видят совершенно другое.

Что такое клоакинг

Клоакинг строится на автоматической идентификации источника запроса: когда к странице обращается краулер (Googlebot, Яндексбот), сервер определяет его по IP-адресу или полю User-Agent в HTTP-заголовке и отдает специально подготовленный HTML. Обычному пользователю через браузер открывается другая версия — с агрессивной рекламой, редиректом на сторонний сайт или контентом, не имеющим отношения к тому, что проиндексировал робот. Расхождение между «роботной» и «пользовательской» версией может быть минимальным — скрытые блоки с ключевыми словами — или тотальным: абсолютно другая страница с другим смыслом и другой структурой. В каждом случае механика одна и та же: обмануть систему ранжирования, показав ей контент, который та никогда бы не одобрила при прозрачной индексации. Именно поэтому клоакинг попадает в категорию black hat SEO и прямо запрещен правилами всех крупных поисковых систем. Google фиксирует его как нарушение политики вебмастера с 2000-х годов, Яндекс также квалифицирует как манипуляцию с момента появления своих принципов качества сайтов.

История клоакинга начинается практически одновременно с историей поисковых систем — в середине 1990-х годов, когда первые оптимизаторы быстро обнаружили, что краулеры «читают» страницы иначе, чем люди. Ранние схемы были примитивны: белые ключевые слова на белом фоне, нулевой размер шрифта, скрытые div-блоки с набивкой запросов и CSS-свойством visibility:hidden. Когда поисковики научились распознавать CSS-скрытие, клоакинг эволюционировал в серверную сторону: скрипты на PHP или настройки конфигурации Nginx и Apache начали определять User-Agent запроса и подавать разный HTML в зависимости от источника. К середине 2000-х схема стала настолько распространенной, что Google ввел практику ручных проверок — сотрудники сравнивали страницы, видимые краулером, с теми, что открываются в обычном браузере. Сейчас детектирование полностью автоматизировано: алгоритм сравнивает краулерскую версию с рендером через headless-браузер и с поведенческими сигналами реальных пользователей, и разрыв между ними фиксируется автоматически.

В современном digital-маркетинге клоакинг встречается в нескольких контекстах, и не все из них выглядят очевидно нарушающими правила. Легитимные платформы используют похожую технику для персонализации: пользователь из России видит цены в рублях, из Германии — в евро, краулер получает нейтральную версию. Поисковики строго разграничивают персонализацию (разрешена при условии, что краулер видит репрезентативную версию) и манипуляцию (запрещена всегда). В арбитраже трафика клоакинг применяется для прохождения модерации в рекламных сетях: модератору показывается «белая» страница, а реальному трафику — нутра, казино или МФО-оффер. Такая схема нарушает правила не только поисковиков, но и самих рекламных платформ — Google Ads и Яндекс.Директ прямо запрещают любую форму обмана системы модерации в своих пользовательских соглашениях. В e-commerce клоакинг иногда применяется недобросовестными подрядчиками для имитации SEO-результатов: контент на проиндексированной странице подменяется после получения позиций, и клиент не догадывается, что сайт уже в зоне риска серьезного фильтра.

Для маркетолога знание клоакинга — не теоретический вопрос, а практический инструмент аудита. Любой специалист, принимающий сайт от предыдущего подрядчика, обязан проверить его историю: если клоакинг применялся и ещё не был выявлен, над проектом висит риск ручного штрафа, который может прилететь в любой момент. Google Search Console показывает раздел «Ручные меры» — там фиксируются нарушения, выявленные командой Quality Raters вручную. Яндекс сигнализирует о проблемах через резкое падение видимости без очевидных технических причин или через прямые уведомления в кабинете Вебмастера. Кроме обнаружения чужих схем, маркетолог должен уметь объяснить клиенту разницу между законной персонализацией и черной манипуляцией, чтобы тот не «изобрел» клоакинг самостоятельно.

Как работает клоакинг

  1. Идентификация источника запроса. Сервер получает HTTP-запрос и сразу анализирует два параметра: IP-адрес запрашивающего и строку User-Agent. Поисковые роботы используют известные IP-диапазоны — Google публикует список своих IP-адресов через DNS-запрос к googlebot.com — и характерные строки, например «Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)». Скрипт клоакинга сверяет входящий IP с актуальным списком роботов и принимает решение о маршруте менее чем за миллисекунду, до начала отдачи контента.
  2. Маршрутизация к нужной версии страницы. Как только система определила тип посетителя, она направляет запрос к одному из двух источников контента. Роботу отдается страница с тщательно подобранными ключевыми словами, правильными метатегами, структурированными данными schema.org и оптимальной внутренней перелинковкой. Людям — коммерческая страница с агрессивным призывом к действию, партнерскими ссылками или мгновенным редиректом на оффер. Маршрутизация происходит на уровне сервера до отдачи HTML, поэтому разница абсолютно невидима в адресной строке браузера.
  3. Сервировка принципиально разного HTML. Роботу отдается HTML-документ, оптимизированный под целевые запросы: выверенный H1, нужная плотность ключевых слов в тексте, корректная разметка, ссылочный граф. Пользователю — другой документ или тот же с критическими изменениями: скрытый ключевой текст, другой заголовок страницы, JavaScript-редирект на третий ресурс. В продвинутых схемах роботная версия генерируется динамически под конкретный поисковый запрос, извлекая его из заголовка Referer входящего запроса краулера.
  4. Маскировка поведенческого расхождения. Если пользователь видит нерелевантный контент, он немедленно покидает страницу — показатель отказов растет, время на сайте падает. Поисковики анализируют поведенческие факторы и могут обнаружить расхождение между релевантностью проиндексированного контента и реальным поведением аудитории. Чтобы смягчить этот сигнал, в схемах используются промежуточные страницы с задержкой или автоматически заполняемые формы, удерживающие пользователя на несколько секунд перед редиректом.
  5. Постоянное обслуживание базы данных роботов. Поисковики регулярно меняют IP-адреса краулеров, добавляют новых ботов и используют рендеринг через headless-браузеры с обычными браузерными User-Agent. Схема клоакинга требует непрерывного обслуживания: обновления списка IP роботов, добавления новых паттернов User-Agent, адаптации к изменениям в алгоритмах детектирования.
  6. Ручная проверка через Quality Raters. Google нанимает асессоров (Quality Raters) — людей, которые вручную проверяют страницы на соответствие руководству по оценке качества поиска. Они открывают результаты из выдачи в браузере и сравнивают реальный контент с тем, что обещает сниппет. Если контент явно не совпадает или страница мгновенно перенаправляет на другой ресурс, отправляется сигнал для ручного рассмотрения. После подтверждения клоакинга ручная санкция применяется ко всему домену, и её снятие требует исправления, подачи формальной заявки и повторной проверки командой Google.

Виды клоакинга

  • IP-клоакинг. Самая распространенная форма: сервер сверяет IP входящего запроса с базой данных известных адресов поисковых роботов. Если совпадение найдено — отдается «роботная» версия страницы, если нет — версия для обычных пользователей. Базы IP публично известны, однако Google периодически использует IP коммерческих облачных провайдеров (AWS, GCP) для проверочных запросов — и тогда клоакинговый фильтр пропускает робота, показывая ему «человеческую» версию, что немедленно фиксируется как расхождение.
  • User-Agent клоакинг. Система анализирует строку User-Agent в HTTP-заголовке вместо IP-адреса. Googlebot идентифицируется по подстроке «Googlebot», Яндексбот — по «YandexBot». Реализовать технически проще, чем IP-фильтр, но и обойти детектированием легче: Google с 2015 года рендерит страницы через Chromium с типичным браузерным User-Agent, поэтому User-Agent фильтр не защищает от проверки рендером. На практике большинство схем комбинируют оба метода — IP и User-Agent одновременно — для повышения точности идентификации.
  • JavaScript-клоакинг. Сервер отдает один HTML-документ всем посетителям, но JavaScript после загрузки страницы определяет тип посетителя и динамически меняет содержимое DOM. До 2015 года это работало против Google, потому что Googlebot не исполнял JS. Сегодня Googlebot полностью рендерит JavaScript через headless Chrome и видит итоговое состояние DOM, поэтому JS-клоакинг практически бесполезен против Google.
  • Referer-клоакинг. Сервер анализирует HTTP-заголовок Referer — откуда пришел пользователь. Если реферер указывает на поисковую выдачу (например, содержит google.com/search или yandex.ru/search), посетитель видит одну страницу; если переход прямой или из другого источника — другую. Техника применяется, когда цель — подменить контент именно для органического трафика, не затрагивая прямые заходы или рекламные каналы. Google детектирует это при проверочных запросах без реферера или с подставным реферером на неизвестный домен.
  • CSS и HTML-клоакинг. Исторически первая форма манипуляции: скрытый текст с ключевыми словами, белые символы на белом фоне, элементы с position:absolute вынесенные за пределы видимой области экрана. Технически сервер отдает один и тот же HTML всем, но контент физически скрыт от людей при визуальном рендеринге. Поисковики распознают это с начала 2000-х и применяют санкции наравне с серверным клоакингом. В legacy-проектах с историей более 10 лет такие следы иногда находят при аудите темы или плагинов.
  • Редиректный клоакинг. Пользователи перенаправляются с проиндексированной страницы на другой URL через мгновенный JavaScript-редирект или meta refresh. Роботу отдается оригинальная страница с правильным контентом, а человек в течение 0.1-0.3 секунды перебрасывается на совершенно другой ресурс — нередко на сторонний домен. Широко применяется в дорвей-схемах: сотни страниц оптимизированы под узкие запросы, весь трафик консолидируется на одном лендинге. Google прямо указывает на такие редиректы как на одну из форм клоакинга в официальных правилах для вебмастеров.

Сравнение клоакинга и A/B-тестирования

Параметр Клоакинг A/B-тестирование
Цель Манипуляция алгоритмом ранжирования — обмануть поисковик Улучшение пользовательского опыта — найти более конверсионный вариант страницы
Что видит краулер Специально подготовленный контент, недоступный реальным пользователям Один из вариантов теста — тот же, что видит часть реальных посетителей
Официальный статус Прямо запрещен правилами Google, Яндекс, всех крупных рекламных платформ Разрешен при соблюдении правил: rel=canonical, без скрытия вариантов от краулера
Риск санкций Ручная мера или алгоритмический фильтр; восстановление занимает от 2 до 12 месяцев Нет риска при корректной реализации; Google официально описывает правила A/B-тестирования
Прозрачность для поисковика Нулевая — разные страницы специально создаются, чтобы их не сравнивали Полная — краулер может увидеть любой из вариантов, и это не скрывается

Пример использования

Региональный интернет-магазин нутрицевтиков с трафиком около 42 000 органических визитов в месяц нанял SEO-подрядчика, который для ускорения роста применил IP-клоакинг. Роботу отдавались страницы с детально проработанными текстами о составе продуктов и клинических исследованиях, реальным пользователям — агрессивные лендинги с таймером обратного отсчета и без обязательных предупреждений о биологически активных добавках. За 4 месяца схема дала результат: 87 коммерческих запросов вышло в топ-10, выручка выросла на 34% к предыдущему кварталу — на первый взгляд чистый успех.

На пятом месяце сайт получил ручную меру Google после проверки Quality Rater. Органический трафик за 10 дней упал с 42 000 до 1 900 визитов — потеря 95%. Восстановление заняло 11 месяцев: 3 месяца на полное удаление клоакинговой схемы и приведение всех страниц к единому контенту, 2 месяца на подачу и рассмотрение запроса на пересмотр санкции в Google Search Console, ещё 6 месяцев алгоритмического «заморозка», пока позиции восстанавливались постепенно. Итоговые потери выручки за период санкции превысили прирост за 4 месяца клоакинга в 7 раз — классический сценарий, когда краткосрочный тактический выигрыш разрушает долгосрочный органический актив.

Частые вопросы

Как поисковики обнаруживают клоакинг, если контент специально скрыт от их роботов?

Обнаружение работает через несколько независимых механизмов, каждый из которых сложно обойти одновременно. Первый — рендеринг через headless-браузер: Google с 2015 года рендерит страницы через Chrome, отправляя запросы с обычными браузерными User-Agent и IP-адресами облачных провайдеров — клоакинговый скрипт не идентифицирует их как ботов и показывает «человеческую» версию, которую и фиксирует Google. Второй — ручные Quality Raters: сотрудники открывают результаты из поисковой выдачи в браузере и сравнивают реальный контент с тем, что обещает сниппет. Третий — поведенческие аномалии: если проиндексированный контент не соответствует реальности, показатель отказов будет нетипично высоким для данной тематики и позиции, а сеансы короче нормы — это статистическая аномалия, которую алгоритм фиксирует автоматически. Наконец, конкуренты или пользователи могут отправить жалобу через форму обратной связи для вебмастеров, и такие жалобы рассматриваются с высоким приоритетом.

Законно ли показывать разный контент пользователям из разных стран или с разных устройств?

Да, геотаргетинг и адаптация под устройства — полностью законные техники, если краулер получает репрезентативную версию контента. Google прямо описывает это в руководстве по интернационализации: при правильном использовании hreflang и настройки геотаргетинга в Search Console показ разных языковых версий не квалифицируется как клоакинг. Яндекс придерживается того же принципа в своих правилах. Ключевой критерий один: краулер должен видеть тот же контент, что и пользователь с аналогичными параметрами запроса — той же страны, того же языка, того же типа устройства. Нарушением становится только ситуация, когда роботу показывается контент, который реальный пользователь в принципе увидеть не может. На практике: спокойно меняйте валюту, язык, цены и региональные офферы под аудиторию — это не клоакинг; не прячьте от краулера ключевой контент, который влияет на ранжирование — это уже нарушение.

Что делать, если сайт получил ручную санкцию за клоакинг?

Первый шаг — немедленная техническая диагностика: найти и полностью удалить весь код, отвечающий за показ разного контента разным источникам запросов. Это включает проверку серверных конфигурационных файлов (.htaccess, nginx.conf), PHP-скриптов, сторонних плагинов, JavaScript-библиотек и шаблонов темы. После удаления кода нужно вручную проверить все затронутые страницы через инструмент «Проверка URL» в Google Search Console — убедиться, что рендер краулера и реальная страница идентичны. Только после подтвержденного технического исправления подают запрос на пересмотр через раздел «Ручные меры» в Search Console: в запросе важно описать конкретно, что нарушало правила, какие именно изменения внесены и в какие сроки. Google рассматривает такие заявки от нескольких дней до нескольких недель; повторная подача без реального исправления только затягивает процесс. Для Яндекса алгоритм аналогичный — исправление плюс заявка через инструменты Вебмастера.

Все термины