Короткий ответ
Семантическое ядро на эстонском собирается без знания языка при одном условии: вы берёте формулировки не из переводчика, а из мест, где их уже написали носители. Это титулы и H1 эстоноязычных сайтов из топ-10, автоподсказки google.ee, отчёт по запросам в Search Console и Планировщик ключевых слов Google Ads с языком «эстонский».
Перевод русского ядра не работает по той же причине, по которой не работает перевод страниц: переводчик выдаёт грамматически верную фразу, а люди набирают другую. Плюс к этому в эстонском 14 падежей, а составные слова пишутся слитно: первая часть уходит в родительный падеж, поэтому машинально собранный список ключей часто состоит из форм, которых в выдаче Google не существует.
Почему перевод русского ядра не работает
Я много раз получал от клиентов таблицу «вот наши ключи, переведите на эстонский». Проблема не в качестве перевода: Google Translate и DeepL справляются с грамматикой эстонского вполне прилично. Проблема в том, что запрос — это не предложение, а привычка набора, и она у каждого языка своя.
Три типичных расхождения, которые я вижу постоянно:
- Разный уровень обобщения. Там, где по-русски ищут «услуги стоматолога», по-эстонски чаще ищут конкретную процедуру или прайс:
hambaravi hinnad,implantaadi hind. Перевод даёт вывеску, спрос идёт на действие. - Заимствование вместо термина. Официальный эстонский термин для поисковой оптимизации звучит как
otsingumootori optimeerimine, но заметная часть спроса идёт на короткоеSEO teenus. Если собирать ядро по словарю, короткая форма в него не попадёт вообще. - Другой порядок слов и склейка. Русское «ремонт автомобилей в Таллинне» на эстонском живёт как
autoremont Tallinnas: одно слово вместо двух и падежное окончание у города.
Отсюда принцип, который я применяю на всех многоязычных проектах: ядро для каждого языка собирается заново, а не переводится. В Google это три разные выдачи с разными конкурентами. Это то же правило, которое я разбирал в статье о том, на каком языке продвигать сайт в Эстонии: языковая версия — самостоятельный сайт, а не папка с переводами.
Что в эстонском ломает привычный сбор семантики
| Особенность языка | Как выглядит на практике | Что делать при сборе |
|---|---|---|
| 14 падежей | koduleht даёт kodulehe tegemine, Tallinn даёт Tallinnas | Формы одного смысла сводить в один кластер, страницу делать одну |
| Составные слова пишутся слитно | autoremont, hinnapäring, veebiarendus | Не разбивать составное слово пробелом: раздельное написание — не запрос, а ошибка |
| Первая часть в родительном падеже | hambaarsti vastuvõtt, а не hambaarst vastuvõtt | Проверять форму по выдаче, а не собирать её из словарных статей |
| Заимствования конкурируют с терминами | SEO teenus против otsingumootori optimeerimine | Собирать оба варианта и смотреть, какой даёт релевантную выдачу |
| Диакритика õ, ä, ö, ü | часть пользователей набирает без неё с иностранной раскладки | В тексте писать правильно, в URL — транслитерация без спецсимволов |
| Малый рынок | десятки показов в месяц — рабочая частотность | Не отбрасывать низкочастотные ключи по цифре: в Эстонии там живут деньги |
Планировщик Google Ads по эстонским запросам почти всегда показывает диапазоны, а не точные значения, и для узких B2B-тем разница между «10–100» и «100–1000» решает всё. Поэтому цифра у меня работает не как критерий, а как сортировка: она помогает расставить приоритеты внутри уже собранного списка, но решение о создании страницы принимается по выдаче и по коммерческой ценности запроса.
Пять источников эстонских формулировок
1. Титулы, H1 и меню эстоноязычных конкурентов. Самый честный источник: это фразы, которые носители сами выбрали для продажи услуги. Я выгружаю топ-10 по нескольким базовым запросам краулером и складываю все title, H1 и пункты меню в один список. Через двадцать сайтов становится видно, какие формулировки повторяются у всех, — это и есть головные фразы кластера.
2. Автоподсказки и «Похожие запросы» в google.ee. Открывайте выдачу с эстонским интерфейсом и регионом Эстония. Подсказки показывают реальные наборы пользователей, а блок «Похожие запросы» внизу выдачи выводит соседние формулировки, которых не будет ни в одном словаре.
3. Отчёт «Эффективность» в Search Console. Если у сайта уже есть хотя бы одна эстонская страница, там лежит золото: запросы, по которым вас уже показывают, включая формы, до которых вы бы не додумались. Я всегда начинаю с этого отчёта, когда захожу на существующий проект.
4. Планировщик ключевых слов Google Ads. Язык эстонский, регион Эстония. Даёт расширение списка и порядок величины частотности. Отдельно полезен отчёт по поисковым запросам уже работающих кампаний: там видно, что люди набирали на самом деле, а не что предполагал планировщик. Это, кстати, один из аргументов запускать рекламу до SEO на новом для себя рынке.
5. Проверка формы слова по словарю. Если сомневаетесь, существует ли составное слово и как оно пишется, сверяйтесь со словарём Института эстонского языка (Sõnaveeb): он показывает нормативное написание и падежные формы. Это не источник запросов, а фильтр от собственных выдумок.
Как проверить, что фраза живая
Собранный список всегда содержит мусор: формы, которые никто не набирает, и слова, у которых в эстонском другой смысл. Проверка занимает около минуты на фразу и делается прямо в выдаче Google.
- Наберите запрос в google.ee с эстонским языком интерфейса.
- Посмотрите на язык результатов. Если в топе английские или финские страницы, фраза либо не эстонская, либо спрос слишком мал, чтобы Google собрал по ней локальную выдачу.
- Проверьте, не исправил ли вас Google. Строка «Возможно, вы имели в виду» или молчаливая подмена запроса означает, что вы держите в руках нерабочую форму.
- Оцените тип страниц в топе. Если в выдаче каталоги и карточки, запрос коммерческий, и статья по нему не выйдет. Если статьи и форумы, наоборот.
- Отметьте, кто ранжируется. Если топ занят крупными порталами и маркетплейсами, вы конкурируете не с профильными сайтами, а с медиа, и цена входа совсем другая.
Пятый пункт особенно важен на малом рынке: в Эстонии фраза с диапазоном «10–100» в Планировщике может приводить клиента на несколько тысяч евро, а красивый общий запрос вполне может оказаться навигационным к конкретному бренду.
Что делать с падежами при кластеризации
Главный вопрос, который мне задают: нужно ли делать отдельные страницы под hambaravi hind и hambaravi hinnad. Нет. Google для эстонского, как и для русского, приводит словоформы к лемме, и обе фразы почти всегда дают одну и ту же выдачу. Разными их показывают только инструменты подбора, потому что они считают строки, а не смыслы.
Рабочее правило: если из первой десятки Google по двум фразам совпадает 5 URL и больше, это один кластер и одна страница. Ровно тот же критерий, что я описывал в статье про кластеризацию запросов; язык здесь ничего не меняет, меняется только количество форм, которые нужно свести вместе.
А вот что действительно требует отдельных страниц, так это разные интенты, спрятанные за похожими словами. veebilehe tegemine (создание сайта) и veebilehe korrashoid (поддержка сайта) выглядят как соседние фразы, но Google показывает по ним разные компании: это две услуги и две посадочные страницы. Когда кластеры собраны, из них строится структура сайта, и на многоязычном проекте структура эстонской версии может отличаться от русской — это нормально.
Мой порядок работы на эстонских проектах
Я веду проекты на трёх языках с 2017 года и делаю это в одинаковой последовательности.
- Сначала эстонская версия, потом остальные. В эстонской выдаче лежит основной объём коммерческого спроса в стране, и структура обычно строится от неё.
- Сбор сид-фраз из выдачи, а не из головы. Двадцать-тридцать конкурентов, все title и H1 в таблицу.
- Расширение через подсказки и Планировщик. На этом шаге список вырастает в несколько раз, в основном за счёт хвоста.
- Ручная чистка. Здесь незнание языка мешает больше всего, поэтому сомнительные фразы я проверяю выдачей, а не интуицией.
- Кластеризация по совпадению выдачи и распределение фраз по страницам.
- Проверка носителем на этапе текста, а не ядра. Ядро состоит из фраз, взятых в реальной выдаче, и лингвистической проверки не требует. А вот текст страницы, написанный по этим фразам, я всегда отдаю прочитать носителю: на естественности формулировок нейросеть и неноситель ошибаются одинаково уверенно.
Честная граница применимости: этот процесс отлажен для сайтов услуг и небольших каталогов, где речь идёт о десятках и сотнях страниц. Для магазина на десятки тысяч товаров ручная проверка выдачи по каждой фразе нереальна: там работает другой подход, ближе к programmatic SEO с шаблонами и выборочной проверкой.
Ошибка, которую я допускал сам: собирал эстонское ядро по аналогии с русским, зеркаля структуру. Получались страницы под фразы, у которых в эстонской выдаче Google не было ни спроса, ни конкурентов, просто потому, что услуга на этом рынке продаётся другими словами. Теперь я сначала смотрю, какие страницы вообще существуют в эстонском топе, и только потом решаю, какие делать у себя.
Что проверить перед тем, как считать ядро готовым
- В списке нет фраз, полученных только переводом: у каждой есть подтверждение из выдачи, подсказок или Search Console.
- Составные слова написаны слитно, первая часть стоит в родительном падеже.
- Формы одного смысла собраны в один кластер, а не размазаны по страницам.
- Заимствованный и терминологический варианты проверены оба, выбран тот, у которого релевантная выдача.
- Низкочастотные ключи не выброшены механически по цифре из Планировщика.
- Эстонские и русские кластеры не пытаются жить на одной странице: языковые версии связываются через hreflang, а не склеиваются.
Если хотя бы один пункт не выполняется, ядро придётся переделывать после первых же данных из Search Console, и это будет дороже, чем сделать проверку сейчас.
