Контент-аудит сайта: что оставить, обновить, объединить и удалить
Контент-аудит — не генеральная уборка, после которой половина сайта отправляется в корзину. Это способ понять роль каждой страницы: какую задачу человека она решает, приносит ли поисковый спрос или продажи, не спорит ли с соседними URL и стоит ли вкладываться в её развитие. Хороший аудит заканчивается не отчётом на сто вкладок, а очередью конкретных действий с ответственными, сроками и понятной проверкой результата.
Особенно полезен аудит сайту, который рос несколько лет: публикации выходили разными командами, услуги переименовывались, фильтры создавали сотни адресов, а старые статьи никто не пересматривал. В такой ситуации «написать ещё пятьдесят текстов» часто менее выгодно, чем привести в порядок уже накопленное. Но действовать по одному только трафику опасно: страница с десятью визитами может закрывать важное возражение перед покупкой, а популярная статья — приводить аудиторию, которая никогда не станет клиентом.
Шаг 1. Соберите инвентаризацию URL
Начните с единого списка адресов. Не полагайтесь только на sitemap: в нём обычно нет старых, ошибочных и намеренно исключённых страниц. И не считайте выгрузку из аналитики полной — URL без посещений там просто не появятся. Надёжная инвентаризация собирается из нескольких источников:
- sitemap.xml и CMS — страницы, которые сайт считает актуальными;
- краулер — всё, до чего можно дойти по внутренним ссылкам, вместе с кодами ответа, canonical, robots и глубиной клика;
- Яндекс Вебмастер и Google Search Console — адреса в поиске, исключённые страницы, показы, клики и запросы;
- система аналитики — визиты, вовлечение, конверсии и доход за достаточно длинный период;
- серверные логи и внешние ссылки — страницы, которые посещают роботы или на которые ссылаются другие сайты, даже если внутри проекта они забыты.
Сведите адреса к одному виду: уберите UTM-метки и якоря, отдельно пометьте HTTP/HTTPS, www/без www, слеш на конце и параметры. Дубли не нужно молча удалять из таблицы — именно они могут показать проблему с каноникализацией. Для первичной техники пригодятся SEO-анализ страницы, проверка цепочек редиректов и материал о том, как находить дубли страниц.
Как дедуплицировать список, не скрывая проблемы
Храните два поля: исходный URL и нормализованный URL. Первое нужно для проверки редиректа и источника, второе — для группировки. При нормализации приведите регистр хоста к одному виду, удалите якорь и известные метки рекламы, приведите завершающий слеш и регистр пути к выбранным правилам. Не удаляйте без разбора параметры фильтрации: цвет или город могут менять товары и интент, а не быть техническим шумом.
Затем сгруппируйте строки по нормализованному адресу, но оставьте в группе все варианты и их источники. Так видно, что один материал попал в отчёт пять раз из-за меток, а другой реально доступен по двум адресам с кодом 200. Отдельно ищите содержательные дубли: сравнивайте title, H1, длину и отпечаток основного текста. Два разных URL с одинаковым ответом — не одна строка, а пара кандидатов на merge, canonical или разведение интентов.
Шаг 2. Добавьте данные, которые помогают принять решение
Универсальной цифры «меньше 100 визитов — удалить» не существует. Сезонный материал лучше оценивать минимум за 12–16 месяцев, новость — за короткий жизненный цикл, а страницу услуги — ещё и по звонкам или заявкам. На уровне каждого URL полезно собрать четыре слоя данных.
Показы, клики, запросы, позиция, органические визиты, конверсии, ассистированные продажи.
Код ответа, index/noindex, canonical, наличие в sitemap, глубина клика, входящие внутренние ссылки.
Интент, полнота ответа, авторство, источники, дата проверки фактов, устаревшие интерфейсы и цены.
Четвёртый слой — бизнес-роль. Страница может привлекать новый спрос, прогревать, отвечать на вопрос перед покупкой, собирать лиды или обслуживать существующего клиента. Запишите эту роль словами. Если команда не может объяснить, для кого создан URL и что посетитель должен получить на нём, это сильный сигнал для пересмотра.
Проверяйте не только абсолютные значения, но и динамику. Статья, потерявшая 40% кликов после устаревания, — хороший кандидат на обновление. URL с растущими показами и позицией 8–15 может дать быстрый прирост после улучшения ответа и сниппета. А две страницы, которые поочерёдно ранжируются по одному запросу, стоит проверить на каннибализацию ключевых слов.
Сравнивайте страницы с сопоставимыми страницами
Средняя цифра по всему сайту почти бесполезна. Карточка товара, инструкция и страница контактов устроены по-разному: у них разные источники переходов, время чтения и ожидаемое действие. Сначала разбейте инвентарь на типы и тематические кластеры, затем ищите аномалии внутри каждой группы. Так видно, что одна инструкция потеряла спрос из-за устаревшего интерфейса, а не потому, что «все статьи читают хуже».
Отдельно пометьте страницы без внутренних ссылок и URL, находящиеся глубже трёх-четырёх переходов от важных разделов. Нулевой трафик у такой страницы ещё не доказывает отсутствие спроса: возможно, робот и посетитель просто не могут нормально её найти. Сначала восстановите логичную навигацию, дождитесь данных и лишь затем решайте судьбу материала. Такой подход защищает от ложного вывода «страница никому не нужна», когда настоящая проблема находится в структуре сайта.
Как читать метрики без ложных выводов
Любая цифра нуждается в контексте. Показы могут расти при падении CTR, если страница стала появляться по новым, но менее точным запросам. Средняя позиция может ухудшиться по той же причине, хотя кликов будет больше. Низкое время на странице с коротким справочным ответом может означать успех, а не разочарование. Поэтому смотрите разбивку по запросам, типам устройств, регионам и целевым действиям, а не только общую строку.
Резкое изменение не считайте доказательством причины, пока не сверили даты. Проверьте сезонность по прошлому году, потерю спроса по кластеру, изменения в шаблоне, перенос аналитики, рекламные кампании и апдейты поиска. Сравнивайте не только период с периодом, но и долю URL внутри своего кластера: если просели все страницы о теме, проблема может быть в спросе; если только один материал — ищите его собственное отличие.
Конверсию тоже нельзя трактовать буквально. Проверьте, была ли цель технически доступна на всём периоде, не учитывает ли она микродействие вроде скролла и есть ли лаг между чтением и покупкой. Для статей полезно смотреть ассистированные конверсии и переходы к коммерческим страницам. Недостаток данных обозначайте как «нужна проверка», а не как нулевую ценность.
Матрица решений: keep, update, merge, delete или noindex
Решение принимают на пересечении трёх вопросов: нужна ли страница людям или бизнесу, есть ли у неё самостоятельный поисковый интент и можно ли сделать её лучшей версией без создания ещё одного URL. Ни один столбец аналитики не заменяет эту проверку.
- Keep — оставить. Страница решает самостоятельную задачу, актуальна и приносит измеримую либо стратегическую пользу. «Оставить» не означает забыть: назначьте дату следующей проверки.
- Update — обновить. Интент и потенциал есть, но ответ устарел, недостаточно конкретен, плохо оформлен или имеет слабый сниппет. Обновление старого URL обычно разумнее публикации дубля; подробный процесс есть в руководстве по обновлению старого контента.
- Merge — объединить. Несколько страниц конкурируют за одну задачу либо каждая отвечает на неё лишь частично. Выберите главный URL, перенесите действительно полезные фрагменты, настройте 301-редирект с каждого старого URL и замените внутренние ссылки. Не перенаправляйте всё подряд на главную.
- Delete — удалить. У страницы нет задачи, спроса, конверсий, ссылок и уникальной ценности, а улучшение не оправдано. Для окончательно удалённого материала нормален 404 или 410. Перед удалением проверьте, не является ли он частью пользовательского пути.
- Noindex — сохранить вне поиска. Подходит страницам, нужным пользователю, но не предназначенным для поисковой выдачи: некоторым служебным результатам, внутреннему поиску, состояниям кабинета. Для дублей и вариантов URL чаще правильнее canonical или устранение причины генерации, а не механический noindex.
Как выполнять решения безопасно
До любого изменения сохраните HTML или версию страницы, её title, description, H1, канонический адрес, входящие ссылки и метрики за базовый период. В журнале укажите URL, дату, решение, причину, исполнителя и критерий отката. Без этого команда не отличит эффект редактуры от сезонности и не сможет быстро вернуть полезную версию.
Keep и update: защитите то, что уже работает
Для keep назначьте не просто статус, а триггер пересмотра: дату, изменение продукта или падение ключевого показателя. Перед update выгрузите запросы и зафиксируйте основной интент. Обновляйте факты, шаги, примеры, источники и иллюстрации, но не вырезайте блоки, которые точно отвечают на стабильные запросы, только ради нового дизайна. Сохраняйте URL, если его нет оснований менять. Сначала проверьте одну или несколько страниц кластера, прежде чем масштабировать шаблонную редактуру.
Merge: карта переноса важнее самого редиректа
Выберите целевой URL по соответствию интенту, удобству адреса, истории показов, внешним ссылкам и конверсиям, а не по длине текста. Для каждого исходного URL запишите, какие факты, медиа, FAQ и полезные комментарии нужно перенести. После публикации проверьте 301 без цепочки, код 200 у цели, self-canonical, sitemap, hreflang при наличии и замену внутренних ссылок. Сохраните таблицу «источник → цель»: она поможет найти ошибку и не потерять маршруты при следующем релизе.
Delete и noindex: сначала контрольная группа
Перед delete ещё раз проверьте внешние и внутренние ссылки, прямые и ассистированные конверсии, переходы из писем и закладок, юридическую и сервисную роль. Если есть равноценный ответ, используйте тематический 301; если аналога нет, не маскируйте удаление редиректом на главную. Для noindex убедитесь, что робот может прочитать метатег: запрет обхода в robots.txt может этому помешать. Уберите такой URL из sitemap, но оставьте нужные людям ссылки.
Начните с 10–20 однотипных URL и наблюдайте их отдельно от остального кластера. Откат нужен, если исчезли ценные переходы, появились неожиданные 404, сломался путь к цели или решение оказалось основано на неполных данных. Для update откат — возврат версии; для merge — исправление карты редиректов и возврат неперенесённых блоков; для delete — восстановление URL из бэкапа. Само по себе удаление страниц не гарантирует роста позиций: цель — убрать ненужный путь, не имитировать SEO-улучшение.
Контрольный лист перед релизом
Для каждой партии изменений соберите короткую карту релиза. Она нужна не для отчётности, а чтобы не потерять небольшую, но критичную деталь. Пройдите пункты дважды: на тестовом окружении и сразу после публикации.
- Содержание. Целевая страница отвечает на исходный интент; при объединении перенесены все уникальные факты; таблицы, файлы, формы и медиа открываются; старые цифры и обещания убраны. Редактор и эксперт отмечают это раздельно.
- Поисковая техника. Код ответа, robots, canonical, hreflang, title, description и H1 соответствуют решению; в sitemap нет удалённых и noindex-URL; 301 ведут сразу на тематическую цель. Краулер не должен найти новых цепочек и ссылок на устаревшие адреса.
- Путь посетителя. Меню, хлебные крошки, оглавление, кнопки и связанные материалы ведут куда нужно; основное действие работает на телефоне и компьютере; удаление не разрывает важный сценарий. Для сложного сценария запишите короткое видео или приложите скриншоты.
- Измерение. Цели и события продолжают передаваться; аннотация о релизе попала в аналитику; списки update, merge, delete и noindex сохранены как сегменты. Для каждого сегмента записаны ожидаемое направление изменения, дата первой проверки и порог для разбора.
- Откат. Бэкап доступен, карта редиректов и версия контента приложены к задаче, ответственный знает порядок возврата. Откат не запускают по любому колебанию позиции: его критерий — проверяемая ошибка или существенная потеря полезной функции.
После релиза разделите сигналы на три уровня. Красный — техническая ошибка, потеря конверсионного пути или редирект не туда — исправляйте сразу. Жёлтый — неожиданная динамика показов или запросов без явной поломки — разбирайте сегмент. Зелёный — техника исправна, задача решается, а динамика вкладывается в ожидаемый диапазон — продолжайте наблюдение. Эта схема не заменяет анализ, но не даёт срочным ошибкам потеряться в общем отчёте.
Шаблон рабочей таблицы
Одна строка должна приводить к одному проверяемому действию. Не перегружайте таблицу десятками метрик, которые никто не использует. Ниже — минимальный набор; трафик и показы берите за выбранный период, а решение дополняйте коротким основанием.
| URL | Задача / интент | Показы и клики | Конверсии | Индекс / техника | Решение | Действие и KPI | Ответственный / срок |
|---|---|---|---|---|---|---|---|
| /staryj-gajd.html | Настроить сервис | 8 400 / 190, снижение | 7 заявок | В индексе, 200 | Update | Обновить шаги и скрины; вернуть CTR и клики | Анна / 12.08 |
| /tema-2.html | Тот же интент, что /tema.html | 1 100 / 18 | 0 | Оба URL ранжируются | Merge | Перенести уникальный блок, 301, заменить ссылки | Илья / 19.08 |
| /search/?q=... | Внутренний результат | Спроса нет | Не применяется | Тысячи параметров | Noindex | Закрыть от индексации, сохранить поиск для людей | Разработка / 26.08 |
Для крупных сайтов добавьте к таблице тип шаблона, кластер, число внутренних и внешних ссылок, дату последней содержательной редакции, потенциальный риск и сложность работ. Удобно хранить также ссылку на задачу и снимок страницы до изменения.
Пример мини-аудита: пять URL — пять разных решений
Представим сайт сервиса с небольшим кластером о выборе тарифа. Одинаковый порог по трафику дал бы здесь пять ошибочных выводов. Вместо этого аудитор проходит по цепочке «задача → сигналы → риск → действие».
- /tarify/ — keep. Страница даёт основную долю заявок, информация актуальна, а запросы соответствуют выбору плана. Её не переписывают ради аудита, а назначают квартальную проверку цен и условий.
- /kak-vybrat-tarif/ — update. У гайда есть стабильные показы и переходы к тарифам, но таблица сравнения описывает старую линейку. Команда сохраняет URL и запросные блоки, обновляет сценарии и добавляет примеры.
- /tarif-dlya-malogo-biznesa/ и /vybor-tarifa-dlya-biznesa/ — merge. У адресов один интент, похожие запросы и поочерёдная смена URL в выдаче. Второй материал имеет полезный калькулятор. Его переносят на более сильный URL, затем настраивают 301 и заменяют ссылки.
- /akciya-2022/ — delete с проверкой. Акция закончилась, прямых и ассистированных конверсий нет. На старый URL ссылается одно партнёрское письмо, поэтому сначала партнёру передают актуальный адрес. Тематической замены нет, поэтому после удаления адрес отвечает 410, а не ведёт на главную.
- /search/?q=tarif — noindex. Внутренний поиск нужен посетителю, но генерирует много нестабильных комбинаций. Шаблон сохраняют доступным, добавляют noindex, убирают эти URL из sitemap и проверяют, что robots.txt не мешает увидеть директиву.
После релиза команда не складывает все пять строк в один график. Keep служит контролем, update оценивается по тому же URL, у merge суммируют исходные показатели, а для delete и noindex проверяют, не возникли ли потери. Только так можно понять, какое решение сработало и где нужна корректировка.
Как расставить приоритеты, чтобы аудит не остался таблицей
Начинайте не с самых плохих URL, а с наибольшей ожидаемой отдачи. Один из вариантов скоринга приведён ниже. Точные коэффициенты не важны — важна одинаковая логика сравнения.
- Защитите сильные страницы. Пометьте URL, которые уже дают значимую долю трафика или продаж. Их меняют аккуратно, с сохранением интента и измерением до/после.
- Возьмите быстрые возможности. Страницы с показами, позициями рядом с первой страницей выдачи, устаревшими фактами или низким CTR часто дают эффект быстрее нового контента.
- Разберите конфликты. Объединение двух конкурирующих материалов может собрать сигналы и улучшить путь пользователя, но требует карты редиректов и обновления перелинковки.
- Затем очищайте хвост. Массовое удаление начинайте с небольшого пилота, а не с тысячи URL за вечер.
Скоринг: как превратить мнение в повторяемое решение
Оцените каждую страницу по шкале от 0 до 3 по четырём осям: потенциал спроса, бизнес-ценность, величина исправимого дефекта и уверенность в данных. Отдельно поставьте от 1 до 3 за трудозатраты и риск. Пример формулы: (спрос + ценность + дефект + уверенность) ÷ (трудозатраты + риск). Формула не предсказывает трафик, а делает видимым, почему одна задача попала выше другой.
Заранее опишите шкалу. Три балла за спрос могут означать устойчивые показы по нескольким целевым запросам; ноль — отсутствие показов и подтверждённого спроса. Три за ценность — прямые продажи или обязательная сервисная роль; один — косвенная помощь. Низкая уверенность в данных должна снижать приоритет необратимого действия, а не подталкивать к нему.
После расчёта примените защитные флаги. URL с значимыми внешними ссылками, большой долей выручки, юридической функцией или нестабильной аналитикой не должен автоматически попасть в массовую задачу, даже если его балл высок. Его передают на ручное согласование. Раз в месяц сравнивайте прогноз с результатом и пересматривайте веса, если формула стабильно поднимает задачи без реальной отдачи.
Что автоматизировать, а что оставить человеку
Скриптам и краулерам можно доверить сбор URL, нормализацию, поиск одинаковых title и H1, проверку кодов ответа, цепочек, canonical, robots, sitemap и внутренних ссылок. Автоматика также хорошо помечает аномалии: например, падение кликов более чем на 30% или страницы без единой входящей ссылки. Эти метки создают очередь для проверки, но не готовое решение.
Человек должен оценить самостоятельность интента, полноту ответа, верность фактов, бизнес-роль, ценность внешних ссылок и уместность merge или delete. Даже высокая текстовая похожесть не доказывает дубль: две договорные формы могут иметь одинаковую основу, но разные юридические функции. На масштабе используйте правило: машина находит кандидата, а ответственный специалист подтверждает действие.
План на 30, 60 и 90 дней
Первые 30 дней: карта и безопасный пилот
Соберите все источники URL, нормализуйте адреса, согласуйте бизнес-роли и сохраните базовые показатели. Разметьте хотя бы самые важные разделы и выберите пилот: несколько обновлений, одно-два объединения и небольшую группу явно бесполезных страниц. Настройте журнал изменений в аналитике. Цель периода — не максимальное число правок, а проверка критериев на реальных страницах.
Дни 31–60: страницы с наибольшим потенциалом
Обновите материалы с доказанным спросом, улучшите источники, примеры и структуру ответа. Выполните согласованные объединения: перенос контента, 301, замена ссылок, sitemap и проверка кодов ответа. Параллельно устраните шаблонные причины дублей. Через две-четыре недели после первых работ сравните индексацию, показы и пользовательские действия с исходной линией.
Дни 61–90: масштабирование и редакционный ритм
Распространите подтверждённые решения на следующий кластер, почините сиротские страницы и навигацию. Удаляйте или закрывайте только проверенные группы. Назначьте каждому важному типу страниц период пересмотра: цены и интерфейсы — чаще, фундаментальные руководства — реже. В результате аудит должен превратиться в регулярный процесс, а не повторяться раз в три года как аварийная уборка.
Кто за что отвечает в команде
Контент-аудит плохо работает как личный SEO-проект. Специалист видит показы и дубли, но может не знать, что старая инструкция нужна службе поддержки, а непопулярная страница услуги закрывает крупную сделку раз в квартал. Согласуйте роли до начала разметки:
- SEO-специалист собирает URL и поисковые данные, находит каннибализацию, проверяет canonical, индексацию и редиректы. Он формулирует гипотезу, но не единолично решает бизнес-роль страницы.
- Аналитик проверяет качество целей, атрибуцию, ассистированные конверсии, сезонность и базовую линию. Его задача — показать ограничения данных, а не создать видимость точности.
- Редактор и предметный эксперт оценивают точность, полноту ответа, источники, тон и удобство сценария. Эксперт подтверждает факты, редактор превращает их в понятный материал.
- Владелец продукта или раздела определяет бизнес-задачу, критичные сценарии и допустимый риск. Он согласует merge и delete для коммерческих и сервисных URL.
- Разработчик и QA внедряют редиректы, noindex, ссылки и sitemap, затем проверяют коды ответа, цепочки, canonical, аналитику и мобильный сценарий. Им нужна карта изменений, а не формулировка «почистить старое».
У каждой строки должны быть один исполнитель и один принимающий. Коллективная ответственность без имени обычно означает, что никто не проверит задачу после релиза. Для рисковых решений назначьте отдельное согласование, для шаблонных — выборочный QA.
Как не накапливать контентный долг снова
Профилактика начинается до публикации. В брифе указывайте аудиторию, задачу, отличие от существующих URL, ожидаемое действие, владельца и дату первой проверки. Новый материал по той же задаче не должен выходить, пока команда не объяснила, почему нельзя обновить существующий.
Добавьте триггеры внепланового пересмотра: изменение цены или закона, закрытие продукта, редизайн интерфейса, падение кликов или конверсий выше согласованного порога. Раз в месяц проверяйте новые сиротские URL, битые ссылки, неожиданные индексируемые параметры и страницы без владельца. Раз в квартал разбирайте один тематический кластер глубже.
В редакционном бэклоге отделите публикации от обслуживания. Если все ресурсы направляются только на создание новых текстов, долг вернётся независимо от качества аудита. Зарезервируйте постоянную долю времени на обновления, объединения и техническую гигиену. Мерьте не число удалённых URL, а долю значимых страниц с понятным владельцем, актуальным ответом и датой следующей проверки.
Как контролировать результат
Смотрите на группы действий отдельно. У update измеряйте клики, запросы, CTR, позиции и конверсии того же URL. У merge — сумму показателей всех старых страниц против нового основного адреса. У delete/noindex — корректное исключение ненужных URL из индекса без потери полезного трафика; обход оценивайте отдельно. Общий рост сайта не доказывает успех конкретного решения: на него одновременно влияют сезонность, реклама, апдейты и новые публикации.
Для более честного сравнения сохраните контрольную группу похожих URL, которые пока не меняли. Она не создаёт идеальный эксперимент, но помогает заметить общий сезонный спад. Сравнивайте медиану, а не только среднее: одна крупная страница иначе скроет потери десятка небольших. В отчёте храните и абсолютные цифры, и доли: «минус 50 кликов» и «минус 2%» описывают разный масштаб.
Проверяйте результат через 2, 4, 8 и 12 недель. Поиск переобходит страницы не мгновенно, поэтому вывод на третий день почти всегда преждевременный. Следите за кодами ответа, попаданием основного URL в индекс, ошибками редиректов, изменением запросов и конверсий. Если важная обновлённая страница теряет не только позиции, но и соответствие исходному интенту, верните полезные блоки или пересмотрите редактуру, не дожидаясь квартального отчёта.
Контент-аудит завершён, когда у команды нет «ничейных» URL: для каждой значимой страницы понятны аудитория, задача, решение, следующий шаг и способ проверки. Тогда сайт растёт не количеством опубликованных файлов, а долей страниц, которые действительно заслуживают внимания людей.