Обсудить проект

Семантическое ядро на эстонском без знания языка

Как собрать семантическое ядро на эстонском, не владея языком: откуда брать сид-фразы, что ломают падежи и составные слова, как проверять ключи выдачей.

Vladislav Krivorutsko29 августа 2026 г.10 мин чтения
Содержание

TL;DR — коротко о главном

  • Переводить русское ядро на эстонский нельзя: перевод даёт грамматически верную фразу, которую в Google никто не набирает
  • Основной источник эстонских формулировок — не словарь и не переводчик, а титулы, H1 и меню эстоноязычных сайтов из топ-10 по вашей теме
  • Эстонский склеивает слова и ставит первую часть в родительный падеж: правильная форма запроса выглядит как hambaarsti vastuvõtt, а не hambaarst vastuvõtt
  • Частотности в Эстонии низкие и показываются диапазонами, поэтому решение о странице принимается по выдаче и деньгам, а не по цифре из Планировщика
  • Финальные формулировки для текста я всегда отдаю на проверку носителю; само ядро собирается и без владения языком

Короткий ответ

Семантическое ядро на эстонском собирается без знания языка при одном условии: вы берёте формулировки не из переводчика, а из мест, где их уже написали носители. Это титулы и H1 эстоноязычных сайтов из топ-10, автоподсказки google.ee, отчёт по запросам в Search Console и Планировщик ключевых слов Google Ads с языком «эстонский».

Перевод русского ядра не работает по той же причине, по которой не работает перевод страниц: переводчик выдаёт грамматически верную фразу, а люди набирают другую. Плюс к этому в эстонском 14 падежей, а составные слова пишутся слитно: первая часть уходит в родительный падеж, поэтому машинально собранный список ключей часто состоит из форм, которых в выдаче Google не существует.


Почему перевод русского ядра не работает

Я много раз получал от клиентов таблицу «вот наши ключи, переведите на эстонский». Проблема не в качестве перевода: Google Translate и DeepL справляются с грамматикой эстонского вполне прилично. Проблема в том, что запрос — это не предложение, а привычка набора, и она у каждого языка своя.

Три типичных расхождения, которые я вижу постоянно:

  • Разный уровень обобщения. Там, где по-русски ищут «услуги стоматолога», по-эстонски чаще ищут конкретную процедуру или прайс: hambaravi hinnad, implantaadi hind. Перевод даёт вывеску, спрос идёт на действие.
  • Заимствование вместо термина. Официальный эстонский термин для поисковой оптимизации звучит как otsingumootori optimeerimine, но заметная часть спроса идёт на короткое SEO teenus. Если собирать ядро по словарю, короткая форма в него не попадёт вообще.
  • Другой порядок слов и склейка. Русское «ремонт автомобилей в Таллинне» на эстонском живёт как autoremont Tallinnas: одно слово вместо двух и падежное окончание у города.

Отсюда принцип, который я применяю на всех многоязычных проектах: ядро для каждого языка собирается заново, а не переводится. В Google это три разные выдачи с разными конкурентами. Это то же правило, которое я разбирал в статье о том, на каком языке продвигать сайт в Эстонии: языковая версия — самостоятельный сайт, а не папка с переводами.


Что в эстонском ломает привычный сбор семантики

Особенность языкаКак выглядит на практикеЧто делать при сборе
14 падежейkoduleht даёт kodulehe tegemine, Tallinn даёт TallinnasФормы одного смысла сводить в один кластер, страницу делать одну
Составные слова пишутся слитноautoremont, hinnapäring, veebiarendusНе разбивать составное слово пробелом: раздельное написание — не запрос, а ошибка
Первая часть в родительном падежеhambaarsti vastuvõtt, а не hambaarst vastuvõttПроверять форму по выдаче, а не собирать её из словарных статей
Заимствования конкурируют с терминамиSEO teenus против otsingumootori optimeerimineСобирать оба варианта и смотреть, какой даёт релевантную выдачу
Диакритика õ, ä, ö, üчасть пользователей набирает без неё с иностранной раскладкиВ тексте писать правильно, в URL — транслитерация без спецсимволов
Малый рынокдесятки показов в месяц — рабочая частотностьНе отбрасывать низкочастотные ключи по цифре: в Эстонии там живут деньги

Планировщик Google Ads по эстонским запросам почти всегда показывает диапазоны, а не точные значения, и для узких B2B-тем разница между «10–100» и «100–1000» решает всё. Поэтому цифра у меня работает не как критерий, а как сортировка: она помогает расставить приоритеты внутри уже собранного списка, но решение о создании страницы принимается по выдаче и по коммерческой ценности запроса.


Пять источников эстонских формулировок

1. Источникититулы топ-10подсказки google.eeSearch ConsoleПланировщик Ads2. Расширениесинонимызаимствованиягорода, модификаторывопросные формы3. Проверкавыдача google.eeязык результатовтип страниц в топеисправления Google4. Кластеризацияформы одного смыслав один кластер5. Структуракластер = страницаэстонские URLПеревод русского ядра в этой схеме не участвует ни на одном шаге

1. Титулы, H1 и меню эстоноязычных конкурентов. Самый честный источник: это фразы, которые носители сами выбрали для продажи услуги. Я выгружаю топ-10 по нескольким базовым запросам краулером и складываю все title, H1 и пункты меню в один список. Через двадцать сайтов становится видно, какие формулировки повторяются у всех, — это и есть головные фразы кластера.

2. Автоподсказки и «Похожие запросы» в google.ee. Открывайте выдачу с эстонским интерфейсом и регионом Эстония. Подсказки показывают реальные наборы пользователей, а блок «Похожие запросы» внизу выдачи выводит соседние формулировки, которых не будет ни в одном словаре.

3. Отчёт «Эффективность» в Search Console. Если у сайта уже есть хотя бы одна эстонская страница, там лежит золото: запросы, по которым вас уже показывают, включая формы, до которых вы бы не додумались. Я всегда начинаю с этого отчёта, когда захожу на существующий проект.

4. Планировщик ключевых слов Google Ads. Язык эстонский, регион Эстония. Даёт расширение списка и порядок величины частотности. Отдельно полезен отчёт по поисковым запросам уже работающих кампаний: там видно, что люди набирали на самом деле, а не что предполагал планировщик. Это, кстати, один из аргументов запускать рекламу до SEO на новом для себя рынке.

5. Проверка формы слова по словарю. Если сомневаетесь, существует ли составное слово и как оно пишется, сверяйтесь со словарём Института эстонского языка (Sõnaveeb): он показывает нормативное написание и падежные формы. Это не источник запросов, а фильтр от собственных выдумок.


Как проверить, что фраза живая

Собранный список всегда содержит мусор: формы, которые никто не набирает, и слова, у которых в эстонском другой смысл. Проверка занимает около минуты на фразу и делается прямо в выдаче Google.

  1. Наберите запрос в google.ee с эстонским языком интерфейса.
  2. Посмотрите на язык результатов. Если в топе английские или финские страницы, фраза либо не эстонская, либо спрос слишком мал, чтобы Google собрал по ней локальную выдачу.
  3. Проверьте, не исправил ли вас Google. Строка «Возможно, вы имели в виду» или молчаливая подмена запроса означает, что вы держите в руках нерабочую форму.
  4. Оцените тип страниц в топе. Если в выдаче каталоги и карточки, запрос коммерческий, и статья по нему не выйдет. Если статьи и форумы, наоборот.
  5. Отметьте, кто ранжируется. Если топ занят крупными порталами и маркетплейсами, вы конкурируете не с профильными сайтами, а с медиа, и цена входа совсем другая.

Пятый пункт особенно важен на малом рынке: в Эстонии фраза с диапазоном «10–100» в Планировщике может приводить клиента на несколько тысяч евро, а красивый общий запрос вполне может оказаться навигационным к конкретному бренду.


Что делать с падежами при кластеризации

Главный вопрос, который мне задают: нужно ли делать отдельные страницы под hambaravi hind и hambaravi hinnad. Нет. Google для эстонского, как и для русского, приводит словоформы к лемме, и обе фразы почти всегда дают одну и ту же выдачу. Разными их показывают только инструменты подбора, потому что они считают строки, а не смыслы.

Рабочее правило: если из первой десятки Google по двум фразам совпадает 5 URL и больше, это один кластер и одна страница. Ровно тот же критерий, что я описывал в статье про кластеризацию запросов; язык здесь ничего не меняет, меняется только количество форм, которые нужно свести вместе.

А вот что действительно требует отдельных страниц, так это разные интенты, спрятанные за похожими словами. veebilehe tegemine (создание сайта) и veebilehe korrashoid (поддержка сайта) выглядят как соседние фразы, но Google показывает по ним разные компании: это две услуги и две посадочные страницы. Когда кластеры собраны, из них строится структура сайта, и на многоязычном проекте структура эстонской версии может отличаться от русской — это нормально.


Мой порядок работы на эстонских проектах

Я веду проекты на трёх языках с 2017 года и делаю это в одинаковой последовательности.

  1. Сначала эстонская версия, потом остальные. В эстонской выдаче лежит основной объём коммерческого спроса в стране, и структура обычно строится от неё.
  2. Сбор сид-фраз из выдачи, а не из головы. Двадцать-тридцать конкурентов, все title и H1 в таблицу.
  3. Расширение через подсказки и Планировщик. На этом шаге список вырастает в несколько раз, в основном за счёт хвоста.
  4. Ручная чистка. Здесь незнание языка мешает больше всего, поэтому сомнительные фразы я проверяю выдачей, а не интуицией.
  5. Кластеризация по совпадению выдачи и распределение фраз по страницам.
  6. Проверка носителем на этапе текста, а не ядра. Ядро состоит из фраз, взятых в реальной выдаче, и лингвистической проверки не требует. А вот текст страницы, написанный по этим фразам, я всегда отдаю прочитать носителю: на естественности формулировок нейросеть и неноситель ошибаются одинаково уверенно.

Честная граница применимости: этот процесс отлажен для сайтов услуг и небольших каталогов, где речь идёт о десятках и сотнях страниц. Для магазина на десятки тысяч товаров ручная проверка выдачи по каждой фразе нереальна: там работает другой подход, ближе к programmatic SEO с шаблонами и выборочной проверкой.

Ошибка, которую я допускал сам: собирал эстонское ядро по аналогии с русским, зеркаля структуру. Получались страницы под фразы, у которых в эстонской выдаче Google не было ни спроса, ни конкурентов, просто потому, что услуга на этом рынке продаётся другими словами. Теперь я сначала смотрю, какие страницы вообще существуют в эстонском топе, и только потом решаю, какие делать у себя.


Что проверить перед тем, как считать ядро готовым

  • В списке нет фраз, полученных только переводом: у каждой есть подтверждение из выдачи, подсказок или Search Console.
  • Составные слова написаны слитно, первая часть стоит в родительном падеже.
  • Формы одного смысла собраны в один кластер, а не размазаны по страницам.
  • Заимствованный и терминологический варианты проверены оба, выбран тот, у которого релевантная выдача.
  • Низкочастотные ключи не выброшены механически по цифре из Планировщика.
  • Эстонские и русские кластеры не пытаются жить на одной странице: языковые версии связываются через hreflang, а не склеиваются.

Если хотя бы один пункт не выполняется, ядро придётся переделывать после первых же данных из Search Console, и это будет дороже, чем сделать проверку сейчас.

Частые вопросы

Можно ли просто перевести русское или английское семантическое ядро на эстонский?
Нет, и это самая частая ошибка при выходе на эстонский рынок. Переводчик выдаёт грамматически корректную фразу, но люди ищут другими словами: вместо буквального перевода «услуги стоматолога» эстонец наберёт hambaarsti vastuvõtt или hambaravi hinnad. Перевод годится только как черновая гипотеза, которую потом проверяют по реальной выдаче и подсказкам google.ee.
Где брать эстонские формулировки запросов, если я не говорю по-эстонски?
Основных источников пять: титулы и H1 эстоноязычных сайтов из топ-10, автоподсказки и блок «Похожие запросы» в google.ee, отчёт «Эффективность» в Search Console, если у сайта уже есть хоть какой-то эстонский трафик, Планировщик ключевых слов Google Ads с языком «эстонский» и регионом «Эстония», а также отчёт по поисковым запросам уже работающих рекламных кампаний. Все они дают формулировки, написанные носителями, а не переводчиком.
Как эстонские падежи влияют на сбор ключевых слов?
В эстонском 14 падежей, и в составных выражениях первое слово почти всегда стоит в родительном падеже: kodulehe tegemine, hambaarsti vastuvõtt. Google при ранжировании обычно сводит формы к одной лемме, но инструменты подбора показывают их как разные строки с разной частотностью. Практический вывод простой: склеивайте формы одного смысла в один кластер вручную и не создавайте под каждую форму отдельную страницу.
Нужно ли писать эстонские буквы õ, ä, ö, ü в ключевых словах?
В тексте страницы — обязательно, иначе она читается как написанная не носителем. При подборе семантики учитывайте, что часть пользователей набирает запрос без диакритики с иностранной раскладки, и Google эти варианты в основном сводит вместе. Отдельные страницы под написание без диакритики делать не нужно, а вот в URL транслитерация без специальных символов остаётся нормальной практикой.
Сколько запросов реально есть в эстонской нише?
Заметно меньше, чем ожидают клиенты, привыкшие к крупным рынкам: население страны около 1,3 миллиона, и в узких B2B-темах десятки показов в месяц уже дают рабочую частотность. Планировщик Google Ads вдобавок показывает такие запросы диапазонами. Поэтому в Эстонии я почти никогда не принимаю решение о создании страницы только по частотности: смотрю на выдачу, на коммерческую ценность запроса и на то, есть ли под него отдельный ответ.
Что делать, если эстонская и русская версии сайта конкурируют между собой?
Это не конкуренция за один запрос, а две параллельные выдачи: эстоноязычная и русскоязычная. Страницы разных языков не считаются дублями, склеивать их атрибутом canonical нельзя: их связывают через hreflang, а canonical каждая версия ставит на саму себя. Проблема возникает только тогда, когда обе версии сделаны переводом друг друга и не попадают ни в один язык запросов.

Выводы

Незнание эстонского сбору семантики не мешает. Мешает привычка получать формулировки из переводчика вместо выдачи. Все рабочие фразы уже написаны носителями: в титулах конкурентов, в подсказках google.ee, в отчёте по запросам Search Console. Ваша задача в том, чтобы собрать их, а не сочинить. Дальше всё как обычно: кластеризация, структура, посадочные страницы. Если нужен внешний взгляд на эстоноязычную часть проекта, это часть того, что я делаю в рамках [SEO-продвижения](/seo).

Автор статьи

Владислав Криворучко — основатель ADLAB
Владислав Криворучко

Основатель ADLAB OÜ · SEO и Google Ads

Больше 20 лет в поисковом трафике и монетизации, на эстонском рынке — с 2017 года. Работаю один: сам провожу аудит, строю стратегию и веду проекты — без подрядчиков и шаблонов. Пишу только о том, что проверил на своих и клиентских сайтах.

  • 20+ лет в поисковом трафике
  • 50+ проектов под ключ
  • Собственные сайты в конкурентных нишах
  • SEO для ru/et/en в одной выдаче
Подробнее обо мне

Читать дальше