Обсудить проект

Страницы-сироты: как найти страницы без входящих ссылок

Страницы-сироты — страницы, на которые не ведёт ни одной внутренней ссылки. Разбираю, чем они опасны, как их найти краулером и Search Console и что с ними делать.

Vladislav Krivorutsko12 августа 2026 г.9 мин чтения
Содержание

TL;DR — коротко о главном

  • Страница-сирота (orphan page) — страница сайта, на которую не ведёт ни одной внутренней ссылки; попасть на неё можно только по прямому URL или из sitemap
  • Краулер сам по себе такие страницы не найдёт: обычный обход идёт по ссылкам, поэтому сироты видны только при сверке обхода со sitemap, логами и данными Search Console
  • Сироты бывают двух видов: ценные страницы, которые случайно выпали из структуры, и мусор, который вообще не должен быть в индексе — лечатся они по-разному
  • Самые частые источники сирот — миграции сайта, удалённые разделы каталога, посадочные страницы под рекламу и автогенерируемые архивы CMS
  • Правильный порядок работы: сначала решить, нужна ли страница вообще, и только потом ставить на неё ссылки

Короткий ответ

Страница-сирота (orphan page) — это страница сайта, на которую не ведёт ни одной внутренней ссылки. Открыть её можно только по прямому URL или найти в sitemap, но ни пользователь, перемещаясь по сайту, ни краулер, идущий по ссылкам, до неё не доберутся.

Опасность не в санкциях — их за это нет. Опасность в том, что такая страница не получает внутреннего веса, обходится Googlebot редко и обновления на ней замечаются с большой задержкой. Найти сирот одним краулером невозможно по определению: нужно сравнить обход по ссылкам со списками URL из sitemap, Search Console, логов и аналитики.


Чем сирота отличается от других проблемных страниц

Термин часто смешивают с соседними, а лечатся они по-разному.

Тип страницыЧто с ней не такКод ответа
Страница-сиротаНет ни одной входящей внутренней ссылки200
Битая страницаНе существует, ссылки на неё ведут в никуда404 / 410
Страница глубокого уровняСсылки есть, но до неё 5+ кликов от главной200
Страница вне индексаСсылки есть, но она закрыта noindex или canonical200
Тупиковая страница (dead end)На неё ссылаются, но с неё нет исходящих ссылок200

Практическая разница: битая страница видна в любом отчёте об ошибках, а сирота выглядит абсолютно здоровой. Она отдаёт 200, у неё нормальный title, она может даже приносить трафик — просто в разы меньше, чем могла бы. Именно поэтому сироты живут на сайтах годами.

Отдельно стоит развести сироту и страницу с одной входящей ссылкой из футера. Формально вторая не сирота, но по количеству получаемого веса разница между ними невелика — об этом я подробно писал в статье про внутреннюю перелинковку сайта.


Почему сироты — это плохо

Три эффекта, и они разного размера.

Страница почти не получает внутреннего веса. Вес приходит на сайт по внешним ссылкам и расходится по внутренним. Страница без входящих ссылок стоит вне этого потока: у неё есть только то, что она может получить напрямую извне, а на типичной странице услуги или карточке товара внешних ссылок нет вовсе.

Краулер приходит редко. Googlebot обходит сайт по ссылкам, а sitemap использует как список кандидатов. По моим наблюдениям, страницы без входящих ссылок переобходятся заметно реже остальных: правки на них Google замечает с задержкой в недели, а не в дни. На небольшом сайте это терпимо, на каталоге в десятки тысяч URL — уже вопрос краулингового бюджета.

Мусор попадает в индекс незаметно. Обратная сторона: сироты бывают не только полезными. Тестовые копии страниц, старые версии посадочных, страницы вложений WordPress, архивы по тегам — всё это часто существует именно как сироты. Их никто не видит в структуре, поэтому никто и не замечает, что они индексируются.

Четвёртый эффект — организационный, но самый неприятный. Страница-сирота обычно означает, что кто-то потратил время на её создание, а потом она выпала из структуры. То есть это уже оплаченная работа, которая не приносит результата.


Как найти страницы-сироты: пять источников

Ключевая мысль: краулер один не справится. Screaming Frog, Sitebulb или мой собственный краулер идут по ссылкам — страница без входящих ссылок для них не существует. Нужна сверка нескольких списков URL.

  1. Обход сайта по ссылкам. Стартуете с главной, краулер собирает всё, до чего дошёл. Это ваш «список связанных страниц» — база для сравнения.
  2. Sitemap.xml. Загружаете отдельно и сравниваете с обходом. Всё, что есть в sitemap, но не найдено краулером, — прямой кандидат в сироты. Это самый быстрый способ, но он видит только то, что CMS сама положила в sitemap.
  3. Отчёт «Индексирование страниц» в Search Console. Экспортируете список известных Google URL. Здесь всплывают страницы, о которых не знает ни sitemap, ни краулер, — например, старые URL, на которые где-то остались внешние ссылки.
  4. Логи сервера. Самый полный источник: показывает все URL, к которым реально обращался Googlebot. На больших сайтах это единственный способ увидеть картину целиком, но и работы с ним больше.
  5. GA4 и отчёт по посадочным страницам. Показывает URL, на которые реально приходили люди. Если страница приносит трафик, но не найдена краулером — это сирота, причём ценная.

Дальше вся работа сводится к операции «вычитание списков»: URL из источников 2–5 минус URL из обхода = кандидаты. Именно кандидаты, а не готовый диагноз: часть отсеется на проверке.

Что отсеять сразу, чтобы не тратить время:

  • URL с параметрами (?utm_source=, ?sort=), если они склеены canonical;
  • страницы, закрытые в robots.txt — краулер их не обошёл не потому, что нет ссылок;
  • пагинация и фильтры, если они генерируются скриптом и краулер не исполнял JavaScript;
  • страницы, ссылки на которые стоят в блоках, подгружаемых через JS. Это отдельная и частая история: ссылка в разметке есть, но краулер без рендеринга её не видит, и страница выглядит сиротой, не будучи ею.

Последний пункт стоит проверять всегда, прежде чем что-то чинить: половина «сирот» на сайтах со сложным фронтендом — это ложные срабатывания краулера без исполнения JavaScript.


Откуда сироты берутся

ИсточникКак это выглядитЧто обычно нужно делать
Миграция сайтаЧасть URL перенесли, ссылки на них не восстановилиВернуть в структуру или склеить 301
Чистка каталогаКатегорию убрали из меню, карточки товаров осталисьРешить судьбу карточек: перенести или закрыть
Посадочные под рекламуСтраницы намеренно не в навигацииОставить как есть, но убрать из индекса
Автогенерация CMSАрхивы по датам, тегам, авторам, вложения WordPressЗакрыть noindex, убрать из sitemap
Старые акции и лендингиКампания закончилась, ссылки сняли, страница осталась410 или редирект на актуальный раздел
Импорт товаровТовары загрузили в базу, но не привязали к категорииПривязать к категории
Ручные правки шаблонаСсылку убрали из блока при редизайнеВернуть ссылку

Отдельно про посадочные страницы под Google Ads. Их часто специально держат вне навигации — и это нормально, если страница закрыта от индексации. Проблема начинается, когда рекламная посадочная индексируется и начинает конкурировать с основной страницей услуги за один и тот же запрос. Тогда к сиротству добавляется каннибализация запросов, и разбираться приходится уже с двумя проблемами сразу.


Что делать с найденными сиротами

Порядок важен: сначала решение о судьбе страницы, потом ссылки. Обратный порядок приводит к тому, что вы старательно перелинковываете страницы, которых на сайте быть не должно.

  1. Отсортируйте кандидатов по ценности. Есть ли у страницы показы в Search Console, приходил ли на неё трафик, есть ли внешние ссылки. Страница с показами — точно не мусор.
  2. Ответьте на вопрос: у страницы есть свой кластер запросов? Если да — она нужна. Если она отвечает тому же интенту, что и другая страница, — это дубль.
  3. Нужные страницы встройте в структуру. Пункт в нужной категории, контекстные ссылки из 2–3 релевантных материалов, если уместно — место в меню. Ориентир по глубине: не больше трёх кликов от главной.
  4. Дубли склейте. 301 на основную страницу, если контент действительно тот же; canonical, если обе версии зачем-то нужны.
  5. Мусор уберите. Страницы, которых не должно быть в индексе, — noindex и вон из sitemap; страницы, которых не должно быть вовсе, — 410. Ставить noindex и одновременно оставлять URL в sitemap не нужно: вы отправляете Google противоречивые сигналы.
  6. Проверьте, не повторится ли это. Если сироты появились из-за шаблона или импорта, поштучная правка ничего не решает — чинить нужно источник.

Шаг 3 стоит делать не по одной странице, а сразу пакетом: если из структуры выпали 40 карточек одной категории, чинится это одним изменением шаблона категории, а не сорока правками.


Что я вижу на своих проектах

Цифру «сироты дают +N% трафика» я не назову — её не существует, и любая конкретика здесь была бы выдуманной. Но закономерности повторяются.

Сироты почти всегда появляются пачками, а не по одной. Если нашли одну — ищите остальные из той же партии: обычно у них общий источник, будь то миграция или импорт. Поштучная правка в такой ситуации — худший вариант расхода времени.

Больше половины найденных сирот на типичном сайте оказываются мусором. Архивы тегов, страницы вложений, тестовые копии. Это не разочарование, а нормальный результат: чистка индекса от них полезнее, чем перелинковка пары забытых статей.

Ценные сироты чаще всего находятся среди старого контента. Статья, которая была в блоге три редизайна назад, до сих пор собирает показы — просто на неё уже никто не ссылается. Такие страницы дают самый быстрый эффект от возврата в структуру, потому что у них уже есть история в индексе.

Про границы применимости. На сайте из 20 страниц вся эта методика избыточна: там достаточно просмотреть карту сайта глазами. Она начинает окупаться примерно от сотни URL, а на каталоге в десятки тысяч становится обязательной регулярной процедурой. И ещё: возврат сироты в структуру не сделает страницу релевантной, если она изначально не отвечает интенту. Перелинковка усиливает то, что работает, а не создаёт смысл с нуля — если структура сайта собрана не под спрос, начинать надо с неё.

Самый честный тест на сироту: попробуйте дойти до страницы с главной, пользуясь только ссылками. Если не получилось за пять минут — у Google тоже не получится.


Чек-лист: разбор сирот за один заход

  1. Прокраульте сайт с главной страницы, с исполнением JavaScript, если фронтенд на нём построен.
  2. Выгрузите sitemap.xml и сравните со списком найденных URL.
  3. Экспортируйте отчёт «Индексирование страниц» из Search Console и добавьте к сравнению.
  4. Возьмите посадочные страницы из GA4 за последние 12 месяцев — они покажут ценные сироты.
  5. Вычтите из объединённого списка всё, что нашёл краулер по ссылкам.
  6. Отсейте ложные срабатывания: robots.txt, параметры, ссылки в JS-блоках.
  7. Разделите остаток на «нужное» и «мусор» по наличию своего кластера запросов.
  8. Нужное встройте в структуру — категорией, меню, контекстными ссылками.
  9. Мусор закройте noindex или отдайте 410 и уберите из sitemap.
  10. Найдите общий источник партии сирот и почините его, а не только следствия.
  11. Повторите проверку через квартал — и обязательно после любой миграции или редизайна.

Если после этого выяснится, что сироты появляются снова после каждого обновления каталога, вопрос уже не в SEO, а в том, как устроена генерация страниц: это веб-разработка, и решается она на уровне шаблонов, а не ручной перелинковки.

Частые вопросы

Что такое страница-сирота простыми словами?
Это страница сайта, на которую не ведёт ни одной внутренней ссылки с других страниц того же сайта. Она существует и открывается по прямому адресу, но ни человек, ни краулер не могут дойти до неё, перемещаясь по сайту. В англоязычной терминологии — orphan page. Не путайте с битой страницей: сирота отдаёт нормальный код 200, проблема только в связности.
Вредят ли страницы-сироты SEO?
Сами по себе они не наказываются, но теряют почти весь внутренний вес и обходятся краулером редко, поэтому ранжируются заметно хуже своих возможностей. Отдельный риск — сироты, которые не должны были попасть в индекс: тестовые страницы, старые версии посадочных, дубли карточек. Они размывают тематику сайта и тратят краулинговый бюджет впустую.
Как найти страницы-сироты на сайте?
Одним краулером — нельзя: он идёт по ссылкам и по определению не увидит страницу без входящих ссылок. Нужно сравнить список URL из обхода со списками из других источников: sitemap.xml, отчёт «Страницы» в Search Console, логи сервера, отчёт по посадочным страницам в GA4, выгрузка URL из CMS или базы. Всё, что есть в этих списках, но отсутствует в краулинге по ссылкам, — кандидаты в сироты.
Считается ли ссылка из sitemap.xml внутренней ссылкой?
Нет. Sitemap — это подсказка Google о том, какие URL существуют, а не элемент структуры сайта. Google заявляет, что sitemap помогает обнаружить страницы, но не заменяет ссылки: приоритет обхода и распределение внутреннего веса задаёт именно связность. Страница, которая есть только в sitemap, остаётся сиротой.
Что делать со страницами-сиротами: удалять или перелинковывать?
Сначала решить, нужна ли страница. Если у неё есть свой кластер запросов и она отвечает интенту — встроить её в структуру: ссылки из релевантных разделов и статей, пункт в нужной категории. Если страница дублирует другую — склеить через 301 или canonical. Если она не нужна ни людям, ни поиску — отдать 410 или закрыть от индексации и убрать из sitemap.
Откуда вообще берутся страницы-сироты?
Чаще всего из четырёх источников: миграция сайта, когда часть URL перенесли, а ссылки на них — нет; чистка каталога, когда категорию убрали из меню, но страницы товаров остались; посадочные страницы под рекламу, которые намеренно не ставят в навигацию; автогенерация CMS — архивы по датам, тегам, авторам, страницы вложений WordPress.

Выводы

Страницы-сироты — не отдельная болезнь, а симптом того, что структура сайта и его фактическое содержимое разошлись. Поэтому чинить их поштучно бесполезно: через полгода после следующей миграции или чистки каталога появится новая партия. Полезнее один раз свести список всех URL из краула, sitemap, Search Console и аналитики, разделить найденное на «нужное» и «мусор» — и дальше проверять этот стык раз в квартал. Если разбираться в этом некогда, техническая часть работы — это [SEO-продвижение](/seo), с которого я обычно и начинаю проект.

Автор статьи

Владислав Криворучко — основатель ADLAB
Владислав Криворучко

Основатель ADLAB OÜ · SEO и Google Ads

Больше 20 лет в поисковом трафике и монетизации, на эстонском рынке — с 2017 года. Работаю один: сам провожу аудит, строю стратегию и веду проекты — без подрядчиков и шаблонов. Пишу только о том, что проверил на своих и клиентских сайтах.

  • 20+ лет в поисковом трафике
  • 50+ проектов под ключ
  • Собственные сайты в конкурентных нишах
  • SEO для ru/et/en в одной выдаче
Подробнее обо мне

Читать дальше