Часы работы пн-пт 9:00 — 18:00
Адрес г. Тула, ул. Некрасова, 7, оф. 315

Технический SEO-аудит: полное руководство

Технический SEO-аудит простыми словами: краулинговый бюджет, Core Web Vitals, редиректы, дубли страниц. Термины, инструменты проверки и статьи в одном месте.

Технический SEO-аудит: карта скрытых дефектов, которые душат ваш трафик

Представьте, что ваш сайт — это высококлассный бутик на тихой улице. Витрины сверкают, товар лучший, но в дверях постоянно заедает замок, а вывеску загораживает дерево. Посетители видят магазин, но не могут войти. В SEO роль такого замка и дерева выполняют технические ошибки: битые ссылки, неправильные редиректы, «тяжелые» скрипты или закрытые от индексации разделы. Контент может быть гениальным, но если поисковый робот не может его считать или считает слишком медленно — позиций не будет. Регулярный технический аудит — это не прихоть, а гигиена, без которой любой сайт постепенно теряет видимость. Давайте разберем, что именно нужно проверять и почему это критично для вашего бизнеса.

Почему технические ошибки важнее, чем кажется: анатомия краулингового бюджета

Поисковые системы (Яндекс и Google) работают по простому принципу: миллионы роботов сканируют интернет, перемещаясь по ссылкам. Каждый сайт получает определенный «краулинговый бюджет» — это количество страниц, которое робот готов обойти за одно посещение. Бюджет не бесконечен. Условно говоря, если на сайте 10 000 страниц, а робот может обойти только 500, он будет выбирать. По какому принципу? По приоритету: важные страницы (главная, категории с сильными ссылками) — сначала, второстепенные (фильтры, сортировки, служебные) — потом, а мусор (склейки, дубли) — вообще пропустит.

Теперь ключевой момент: если на сайте есть десятки тысяч мусорных URL с параметрами сортировки, которые вы не закрыли в файле robots.txt или в настройках CMS, робот тратит свой бюджет на их обход. Ему не хватает времени на новые статьи или важные страницы товаров. В итоге новые полезные страницы могут ждать индексации неделями, а то и месяцами. Более того, если в «мусоре» есть битые ссылки (коды 404), это создает негативный сигнал. Логика поисковика проста: если владелец не следит за сайтом, значит, контент тут недостоверный. Поэтому первая задача аудита — найти все «дыры», через которые утекает бюджет: ненужные параметры, пустые категории, служебные разделы. Закрыли их в robots.txt — и краулинговый бюджет перераспределяется в пользу продающих страниц.

Связка факторов: как одна ошибка тянет за собой другую (цепная реакция)

Запомните главное правило технического SEO: ошибки почти никогда не существуют в вакууме. Один дефект провоцирует другой, и в итоге вы получаете системный сбой. Разберем показательный сценарий.

Шаг 1. Допустим, вы изменили структуру ЧПУ (человеко-понятных URL) на сайте. Старые адреса страниц перестали работать, и появились новые. Без правильной настройки 301-редиректов (постоянное перенаправление со старых адресов на новые) все старые ссылки из внешних источников (каталоги, соцсети, форумы) начинают отдавать код 404 (не найдено).

Шаг 2. Большое количество 404-ошибок сильно замедляет скорость ответа сервера и увеличивает нагрузку на него, особенно если на странице есть тяжелые скрипты отслеживания. Робот тратит время на обработку ошибок, а реальная страница загружается с задержкой.

Шаг 3. Посетитель (и робот) получает медленный ответ сервера. Это прямое попадание в критерии Core Web Vitals — совокупность показателей скорости и стабильности визуала. Если скорость падает, поисковик понижает сайт в мобильной выдаче (сейчас это приоритет). Позиции падают, трафик падает.

Шаг 4. Из-за падения позиций и поведенческих факторов (люди уходят с медленных страниц) поисковик начинает хуже относиться к сайту в целом. Он увеличивает «период недоверия»: реже заходит на сайт, хуже переиндексирует новые статьи.

Таким образом, одна ошибка в редиректах провоцирует медленный сервер, падение скорости и, как итог, потерю индексации и позиций. Вот почему аудит должен быть комплексным: вы не просто проверяете один файл, вы ищете причинно-следственные связи.

Практический чек-лист: с чего начать самостоятельный аудит прямо сейчас

Вы можете запустить собственную диагностику за пару часов, не будучи программистом. Вам понадобится доступ к панели Яндекс.Вебмастер и Google Search Console (для проверки индексации), а также браузер и калькулятор. Действуйте по шагам:

  • Шаг 1. Проверка индексации. Зайдите в панели вебмастеров в раздел «Страницы в поиске» / «Индексирование». Посмотрите, сколько страниц вы подали на индексацию (как правило, это все URL) и сколько реально проиндексировано. Если разница больше 20-30%, у вас серьезная проблема с краулинговым бюджетом. Углубитесь: в отчете можно увидеть, какие разделы не попали в индекс. Часто это категории, доступные только с внутренней навигации, — робот о них просто не узнал.
  • Шаг 2. Сканирование сайта. Используйте любой доступный краулер (например, бесплатные онлайн-сервисы). Запустите обход и посмотрите на коды ответов сервера. Ваша цель — найти: 404 ошибки (битые ссылки), 500-е ошибки (сбои сервера), цепочки редиректов (когда URL «А» редиректит на «Б», а «Б» на «В»). Цепочки из 2+ редиректов нужно чистить — они не передают вес страницы. Обязательно проверьте, что URL с www и без www, с http и https работают одинаково (отдают главную или контент, а не 404).
  • Шаг 3. Анализ sitemap.xml и robots.txt. Откройте файл sitemap.xml. Проверьте: все ли указанные в нем URL живы (не отдают 404), нет ли там мусорных ссылок и корректно ли указана дата последнего обновления. Затем откройте robots.txt. Убедитесь, что там не закрыт от индексации основной контент (например, /css/ и /js/ должны быть открыты, а /admin/ или /cart/ — закрыты). Важная деталь: если вы закрываете CSS или JS файлы, вы лишаете робота возможности видеть, как выглядит страница, что с 2021 года стало критично для мобильного ранжирования (Google). Ведите логику: robots.txt должен закрывать мусор, но не ресурсы, создающие контент.
  • Шаг 4. Дубли контента. Откройте любую категорию товаров и посмотрите, не открывается ли она по нескольким URL: с параметром ?page=, с фильтром по цене, с UTM-метками. Если да, то это дубли. Самый простой способ их обуздать — прописать в CMS корректные теги canonical (ссылка на основную версию страницы) или закрыть параметры в панели вебмастера. Не полагайтесь только на robots.txt для скрытия дублей — canonical работает надежнее.
  • Шаг 5. Мета-теги и микроразметка. Выборочно проверьте title (заголовок) и description (описание) на ключевых страницах. Они должны быть уникальными и содержать ключевые запросы. Что касается микроразметки — проверьте в валидаторе, корректно ли размечена товарная страница (цена, наличие, отзывы). Без микроразметки вы теряете расширенные сниппеты (звезды рейтинга, цену) — снижается кликабельность в выдаче.

Скорость загрузки и Core Web Vitals: работа с тройным стандартом

Core Web Vitals — это совокупность трех параметров, которые измеряют реальный пользовательский опыт: LCP (скорость загрузки основного контента, не более 2,5 секунд), INP (задержка при взаимодействии, не более 200 мс) и CLS (визуальная стабильность, сдвиги элементов не более 0,1). Для SEO это критично, потому что поисковики буквально «замеряют» эти показатели на реальных устройствах пользователей. Если они в красной зоне, сайт автоматически попадает в список «медленных» для мобильных устройств.

Как связать это с техническим аудитом? Вы должны посмотреть на свои показатели в отчете «Core Web Vitals» в панели вебмастера. Если LCP тормозит, причин обычно три: огромная героическая картинка, некэшируемые шрифты или тяжелый сервер. Если CLS плывет — это незаданные размеры для изображений (они «разъезжаются» при загрузке) или динамическая вставка рекламы. INP тормозит из-за неоптимизированного JavaScript — скрипты, которые блокируют интерфейс. Диагностика здесь сводится к простому правилу: откройте страницу в инструментах разработчика браузера (F12), вкладка Network, и посмотрите на вес каждого файла. Статьи на 5 мегабайт — это всегда ошибка. Сожмите изображения в формат WebP/AVIF, подключите отложенную загрузку (lazy loading) для картинок, которые ниже первого экрана, и объедините все маленькие CSS/JS файлы в один большой — это даст прирост в 10-20% скорости без покупки нового сервера.

Помните про свойство нашего времени: от скорости загрузки зависит и краулинговый бюджет (медленный сайт с большой задержкой ответа сервера робот покидает быстрее — он не будет ждать). Поэтому решение проблемы скорости напрямую улучшает индексацию: робот успевает обойти больше страниц за сессию, а пользователи меньше бросают страницы на загрузке — поведенческий фактор улучшается.

План регулярных проверок: как не допустить регресса

Технический аудит — это не разовая акция на один день. Это цикличный процесс. Рекомендую выстроить следующий ежемесячный минимум: просмотреть отчеты об индексации в панелях вебмастеров (количество страниц в индексе не должно падать без объективных причин), проверить логи сервера на 404 ошибки (заведите мониторинг на почту), и раз в квартал прогонять краулер для поиска битых ссылок и цепочек редиректов. Особое внимание уделяйте периодам обновлений (новины, акции, смена дизайна) — именно тогда возникают «склейки» и дубли. Следите за тем, чтобы все новые разделы имели дерево ссылок (хлебные крошки) и попадали в sitemap.xml. Если вы будете делать это регулярно, вы предотвратите 90% проблем до того, как они ударят по трафику.

Главный вывод: технический аудит — это не «страшилка» программистов, а ваш личный контроль над финансовым потоком. Каждая секунда загрузки, каждая закрытая страница в индексе — это деньги, которые вы теряете. Начните с малого — с проверки индексации и 404-ошибок. Как только вы увидите масштаб проблемы, остальное станет вопросом техники и времени.

Термины из глоссария

robots.txt
robots.txt — это текстовый файл в корне сайта, который предписывает поисковым роботам, какие страницы и разделы разрешено сканировать, а какие — нет. Он работает как директива, а не как технический запрет: нарушение игнорируется ботами. Файл составляется по стандарту де-факто и содержит правила для конкретных агентов (например, Googlebot или YandexBot). Основная задача robots.txt — управлять краулинговым бюджетом: не тратить время робота на служебные страницы, дубли или личные кабинеты. Это не инструмент защиты от индексации (для этого используется noindex), а способ оптимизации процесса обхода. Отсутствие файла — не ошибка, но его наличие помогает правильно распределить ресурсы поисковика и быстрее индексировать важный контент.
Sitemap.xml
Sitemap.xml — это файл на сайте в формате XML, который содержит список всех важных страниц ресурса с указанием их адресов (URL), дат последнего обновления и приоритета. Он помогает поисковым системам, таким как Google и Яндекс, быстрее находить и индексировать новые или изменённые страницы, особенно если сайт имеет сложную структуру, большое количество разделов или динамические страницы. Файл не влияет напрямую на ранжирование, но улучшает техническое здоровье сайта, делая процесс обхода и индексации более эффективным. Sitemap.xml обычно размещается в корне сайта (например, example.com/sitemap.xml) и может быть создан автоматически через CMS или специальные плагины. Его наличие обязательно для крупных интернет-магазинов, новостных порталов и сайтов с большим количеством страниц.
Canonical (rel=canonical)
Canonical (rel=canonical) — это HTML-атрибут тега <link>, который указывает поисковым системам предпочтительный (канонический) URL страницы, когда существует несколько версий одного и того же контента. Он помогает консолидировать сигналы ранжирования, избежать проблем с дублированным контентом и корректно индексировать страницы. Атрибут размещается в разделе <head> и выглядит как <link rel="canonical" href="https://example.com/page/">. Использование canonical особенно важно для интернет-магазинов (фильтры, сортировки, параметры UTM), блогов (пагинация, версии для печати) и CMS, которые генерируют дубли на разных URL. Правильно настроенный канонический тег не блокирует индексацию, а лишь передает вес страницы на основной адрес, что улучшает видимость сайта в поиске.
Редирект 301
Редирект 301 — это HTTP-статус, который сообщает поисковым системам и браузерам, что страница навсегда переехала на новый URL. Он передает до 100% веса ссылок и авторитета старого адреса новому, делая его главным. Без него пользователи попадают на ошибку 404, а поисковики теряют позиции. Используется при смене домена, переносе сайта на HTTPS, объединении дублей или перестройке структуры. В отличие от 302 (временный), 301 гарантирует, что поисковые системы обновят индекс и будут показывать новый адрес в выдаче. Это базовый инструмент SEO-оптимизации, позволяющий сохранить трафик и ранжирование при любых изменениях URL.
LCP (Largest Contentful Paint)
LCP (Largest Contentful Paint) — это метрика скорости загрузки сайта, которая измеряет время от начала загрузки страницы до момента, когда в видимой области экрана появляется самый крупный элемент контента: изображение, видео, блок текста или фон. Она показывает, как быстро пользователь видит основное содержимое страницы, а не пустую рамку или загрузочный индикатор. LCP является одним из трех ключевых показателей Core Web Vitals, которые Google использует для оценки пользовательского опыта и ранжирования в поисковой выдаче. Хорошим считается значение 2,5 секунды или меньше. Если LCP больше 4 секунд, это сигнал о проблемах с производительностью, которые требуют оптимизации.
CLS (Cumulative Layout Shift)
CLS (Cumulative Layout Shift) — это метрика Google, которая измеряет визуальную стабильность страницы. Она показывает, насколько сильно элементы контента (текст, изображения, кнопки) сдвигаются в процессе загрузки. Чем выше значение CLS, тем больше страница «прыгает» у пользователя: например, когда вы читаете статью, и внезапно картинка сверху подгружается и сдвигает текст вниз. Для оценки CLS используется шкала от 0 до 1, где 0 — идеально стабильная страница, а значение больше 0.25 считается плохим и негативно влияет на ранжирование в поисковой выдаче. CLS является частью набора Core Web Vitals, который Google использует для оценки пользовательского опыта. Показатель рассчитывается как сумма всех неожиданных сдвигов в течение жизни страницы, но только тех, которые происходят без участия пользователя. Улучшение CLS — это задача веб-разработчика: нужно задавать размеры для изображений и видео, резервировать место под рекламу и динамические элементы, а также правильно загружать шрифты.
TTFB (Time to First Byte)
TTFB (Time to First Byte) — это метрика, измеряющая время от момента, когда браузер отправил HTTP-запрос на сервер, до получения первого байта ответа. Она показывает, насколько быстро сервер обрабатывает запрос и начинает передавать данные. Чем меньше TTFB, тем лучше. Значение TTFB включает в себя время на DNS-запрос, установку TCP-соединения, обработку запроса сервером и начало передачи ответа. Нормальным считается TTFB до 200-500 мс, всё, что больше 600 мс, уже замедляет загрузку страницы. На TTFB влияют скорость хостинга, настройки сервера, использование кэширования, сложность серверной логики и удаленность пользователя от сервера. Улучшение TTFB — важная задача технического SEO, поскольку этот показатель напрямую влияет на пользовательский опыт и ранжирование в поисковых системах.
SSL-сертификат
SSL-сертификат — это цифровой документ, который подтверждает подлинность сайта и шифрует данные между браузером пользователя и сервером. Он обеспечивает безопасную передачу информации, такой как логины, пароли и платежные данные, через HTTPS-протокол. Наличие SSL-сертификата стало стандартом для любого сайта: без него браузеры показывают предупреждение «Не защищено», что отпугивает посетителей и негативно влияет на ранжирование в Google. Сертификат содержит информацию о владельце домена, публичный ключ и срок действия. Устанавливается на хостинг, после чего сайт переходит на защищенное соединение. Различают три основных типа: DV (проверка домена), OV (проверка организации) и EV (расширенная проверка). Для большинства проектов достаточно DV-сертификата, который можно получить бесплатно через Let's Encrypt.
Mobile-First Indexing
Mobile-First Indexing (мобильно-ориентированное индексирование) — это подход Google к ранжированию и индексации сайтов, при котором поисковый робот в первую очередь использует мобильную версию страницы как основной источник контента и данных для оценки. Это означает, что если у вашего сайта есть отдельная версия для смартфонов (например, на поддомене m.site.com), то Googlebot будет сканировать именно её, а не десктопную. Введённый в 2018 году, этот подход стал ответом на рост мобильного трафика, который сегодня превышает 60% всех запросов в мире. Для владельцев сайтов ключевое следствие простое: мобильная версия должна содержать тот же контент, что и десктопная, иначе страницы могут потерять позиции в выдаче. Mobile-First Indexing не означает, что десктопные страницы игнорируются — они по-прежнему используются для оценки UX на больших экранах, но именно мобильная версия определяет, что попадает в индекс.
Дубли страниц
Дубли страниц — это одинаковые или почти одинаковые версии одного и того же документа, доступные по разным URL-адресам. Они возникают из-за технических особенностей сайта: параметров в ссылках, версий для печати, зеркал с www и без, фильтров каталога. Для поисковых систем дубли — это проблема: они вынуждены тратить краулинговый бюджет на бесполезные страницы, а вместо одной сильной страницы в индексе могут оказаться несколько слабых, что размывает ссылочный вес и снижает позиции. Чтобы избежать этого, используют 301-редиректы, канонические теги rel="canonical" и правильную настройку robots.txt. Отсутствие работы с дублями ведет к снижению видимости сайта, поэтому их устранение — обязательный этап технического SEO.

Хотите не разбираться самостоятельно, а поручить это специалистам?