Обсудить проект

hinnaguru.ee: справочник цен на открытых данных Эстонии

Запустил справочник цен и поставщиков услуг в Эстонии на данных Äriregister и EMTA. Что открытые реестры показывают о фирмах и почему топ-10 Google — не список лучших.

Vladislav Krivorutsko11 августа 2026 г.10 мин чтения
Содержание

TL;DR — коротко о главном

  • hinnaguru.ee отвечает на два вопроса сразу: сколько услуга стоит в Эстонии и кому её поручить
  • Данные не собраны вручную, а взяты из государственных реестров: Äriregister и список налоговых должников EMTA — обе выгрузки открыты и бесплатны
  • Ключевая цифра, которой нет ни в одном каталоге, — оборот фирмы именно в этой сфере деятельности, а не по компании целиком
  • Топ-10 Google по запросу услуги и список крупнейших фирм ниши совпадают слабо: часть заметных игроков в выдаче не видна вообще
  • Проект открыт для индексации только что, трафика и позиций пока нет — это разбор архитектуры и данных, а не кейс с результатами

Что это за проект

hinnaguru.ee — справочник цен и поставщиков услуг в Эстонии. Человек приходит с вопросом «сколько стоит переезд и кому его поручить» и получает ответ на одной странице: реальные цены с прайсов фирм, диапазон и медиана, а рядом — список поставщиков с данными из государственных реестров.

Отличие от привычного каталога в одном: фирмы там не платят за попадание в список и данные о них не с их слов. Стаж, число работников, оборот в этой сфере деятельности и наличие налогового долга берутся из открытых выгрузок Äriregister и Maksu- ja Tolliamet, у каждого значения стоит дата и источник. На сегодня разобрано 66 услуг, в списках 1096 фирм и 3487 позиций прайсов.

Сразу оговорю границы: сайт открыт для индексации только что. Ни трафика, ни позиций, ни заявок у меня показать пока нечего — и я не буду делать вид, что есть. Эта статья про то, как проект устроен и что вскрылось в данных, а не про результаты.


Откуда он вырос: люди не хотят оставлять заявки

Предыдущий мой проект в этой же нише был маркетплейсом заявок: пользователь описывает задачу, фирмы откликаются. Заявок почти не оставляли. Разбор показал неприятную вещь: аудитория приходила не за посредничеством. Она приходила за двумя вещами — понять, сколько это должно стоить, и получить контакт исполнителя. Форма между этими двумя шагами была не сервисом, а препятствием.

Отсюда главное архитектурное решение hinnaguru.ee: форм заявки нет вообще. Контакты фирм открыты, ссылка на сайт фирмы — прямая, посредником проект не встаёт. Это сознательно отрезает самый очевидный способ монетизации (продажу лидов) в обмен на то, что страница честно отвечает на вопрос, с которым пришёл человек.

Урок здесь общий и он не про справочники: если пользователи не совершают целевое действие, вопрос не всегда в кнопке и не всегда в конверсии. Иногда предлагаемое действие просто не то, за которым пришли. Это тот же разговор, что и про разрыв между трафиком и заявками — только с ответом «убрать форму», а не «переделать форму».


Что реально дают открытые данные Эстонии

Это самая недооценённая часть. Эстония отдаёт машиночитаемые выгрузки бесплатно и под свободной лицензией, а пользуются ими единицы.

ИсточникЛицензияЧто даёт
Äriregistri avaandmedCC BY 4.0Название, рег. код, KMKR, дата регистрации, адрес, виды деятельности, число работников, оборот в разбивке по видам деятельности, годовые отчёты
Maksu- ja Tolliameti maksuvõlglaste nimekiriCC BY-SA 3.0Налоговая задолженность, обновляется ежедневно
Сайты самих фирмПрайсы, состав услуги, реквизиты для сопоставления с реестром

В базе проекта лежит весь реестр целиком — 376 043 юридических лица. Реестр обновляется раз в неделю, список должников — ежедневно.

Ключевая строка в этой таблице — оборот в разбивке по видам деятельности. Именно она превращает справочник из очередного списка телефонов в инструмент. Общий оборот фирмы отвечает на вопрос «насколько она большая вообще», а не на вопрос «занимается ли она тем, за чем я пришёл, и в каком объёме».


Главная находка: топ-10 Google — не список лучших фирм ниши

Первую услугу — переезды — я прогнал по конвейеру вручную, до того как он был написан, именно чтобы посмотреть, разойдутся ли данные с выдачей. Разошлись, и сильнее, чем я ожидал.

Что видно на данных и не видно в выдаче:

  • Фирма с оборотом 1,3 млн € делает в этой нише 86 тысяч — 6,6%. Это транспортная компания, переезды у неё попутное направление. В выдаче она выглядит как крупный игрок, в нише — меньше, чем небольшая фирма со 160 тысячами, которая занимается только переездами.
  • Фирма с оборотом 1,4 млн € именно на переездах не нашлась ни на одной из пяти страниц выдачи. Её нашёл добор из реестра по коду деятельности. Сайт слабый, SEO нет — для Google её почти не существует.
  • Фирма с положительными отзывами в выдаче имела налоговую задолженность в пять знаков. В выдаче это не видно никак.
  • Фирма, зарегистрированная год назад, с оборотом 17 700 €, стояла в выдаче рядом с двадцатилетними.

Вывод, который я забираю из этого как SEO-специалист: выдача ранжирует сайты, а не бизнесы. Это очевидно на словах, но когда кладёшь рядом две колонки — позицию в выдаче и оборот в нише, — становится видно, насколько слабо они связаны. Для владельца слабого сайта в сильной фирме это хорошая новость: конкуренты в топе часто держатся там не размером бизнеса, а тем, что кто-то занялся их сайтом. Как выглядит такой разрыв изнутри ниши, я показывал в разборе ниши казино-аффилиатов — там та же картина другими средствами.


Что оказалось сложнее, чем было в техзадании

Честная часть. Конвейер выглядел просто на бумаге: взять выдачу, разобрать сайты, связать с реестром, забрать цены. На первом же ручном прогоне вылезло четыре вещи, которых в ТЗ не было.

1. Связать сайт с юрлицом вдвое сложнее, чем кажется. Регистрационный код на сайте — «самый надёжный признак» — нашёлся у 5 сайтов из 10. Номер KMKR добавил ещё троих, включая единственную фирму с полноценным прайсом. Итог: 8 из 10. Два сайта не отдали ни кода, ни KMKR вообще.

2. Сетки доменов оказались массовым явлением. У одной фирмы обнаружилось четыре разных домена по одной услуге, у двух других — по два. Без дедупликации по регистрационному коду список получился бы вдвое длиннее и вдвое бесполезнее: одна и та же фирма занимала бы полстраницы под разными названиями.

3. Два юрлица на одном сайте. Один сайт показал сразу два регистрационных кода — разные фирмы, разные уезды, разный год регистрации. Взять первый попавшийся означало приписать данные не тому.

4. Цены в одних и тех же единицах несравнимы. Шесть строк формально в €/час, но 25 €/ч — это грузчик без машины, а 68 €/ч — грузчик с фургоном 14 м³. Средняя по такому набору врёт в обе стороны. Пришлось вводить состав услуги: сегодня на странице переездов медиана считается отдельно по составу — «фургон до 15 м³ + 1 работник» и так далее, а цены без указанного состава помечаются как несравнимые и в расчёт медианы не идут. Из 34 фирм цены в каком-либо виде публикуют 13.

Отдельная мелочь, которая окупилась неожиданно хорошо: домены фирм из реестра искались не платными запросами к поисковой выдаче, а перебором очевидных вариантов имени с проверкой рег. кода на самом сайте. Четыре попадания из пятнадцати — бесплатно.


Почему это programmatic SEO, а не «нагенерировать страниц»

66 страниц услуг собраны по одному шаблону из базы — формально это ровно то, что называют programmatic SEO. Разница с обычным пониманием термина в источнике данных: страницы строятся не из перестановок слов в шаблоне, а из данных, которых нет у конкурентов. Страница услуги существует, потому что под неё собраны реестр, прайсы и статистика ниши, а не потому, что в списке было ещё одно название.

Из этого следуют правила, которые я держу жёстко:

  1. Порог публикации. Меньше трёх поставщиков — страница не публикуется: она не отвечает на вопрос «кому поручить».
  2. Секция появляется, когда есть данные. Пустой блок сообщает читателю, что проект не знает того, о чём взялся рассказывать.
  3. Не выдумывать. Нет цены — так и написано «нет». Не удалось определить юрлицо — не связывать. Приписать фирме чужие данные хуже, чем не показать данные вовсе.
  4. Никаких оценочных суждений. «Работает с 2011 года» — факт. «Надёжная фирма» — суждение, за которое приходит претензия.

Подробнее о том, где эта граница проходит и за что Google наказывает генерацию страниц, — в отдельной статье про programmatic SEO. Здесь же скажу коротко: масштаб сам по себе не проблема, проблема — масштаб без данных.

Технически это Next.js со статической генерацией и PostgreSQL, конвейеры сбора вынесены в отдельные скрипты на Python. Два конвейера — загрузчик реестров и анализатор сайтов — намеренно разделены: первый ходит по расписанию и ломается от смены формата выгрузки, второй запускается по одной услуге и ломается от чужого редизайна. Смешать их значило бы получить систему, которая встаёт целиком от любой из двух причин.


Что из этого может забрать читатель

Даже если справочник вам не нужен, открытые данные полезны прямо сейчас.

Если вы выбираете подрядчика в Эстонии — десять минут на проверку:

  1. Найдите фирму в Äriregister по названию или регистрационному коду.
  2. Посмотрите год регистрации и сдавались ли годовые отчёты за последние годы. Пропуски — сигнал.
  3. Посмотрите оборот именно по той сфере деятельности, за которой вы пришли, а не общий.
  4. Проверьте фирму в списке налоговых должников EMTA.
  5. Сверьте, что регистрационный код на сайте фирмы совпадает с тем, что вы смотрите, — сайт и юрлицо связаны далеко не всегда очевидно.

Если вы сами оказываете услуги — посмотрите на себя теми же глазами. Опубликован ли на сайте регистрационный код, есть ли прайс с составом услуги, видно ли, сколько лет вы работаете. Это не про SEO напрямую, это про то, что данные о вас уже публичны и однажды окажутся сведены в таблицу рядом с конкурентами — вопрос только в том, кто это сделает первым.

Если вы делаете контентный проект — сначала ищите данные, которых нет у конкурентов, и только потом думайте о структуре и текстах. Разобраться, из чего собирать структуру сайта, проще, когда понятно, чем ваша страница будет отличаться от десяти таких же. Если такого источника нет, программная генерация страниц не спасёт.


Чего проект намеренно не делает

Границы важнее возможностей, поэтому перечислю прямо.

  • Не продаёт место в списке. Ни за платный профиль, ни за рекламу. Платный профиль даёт логотип и своё описание — и ни одной позиции вверх.
  • Не оценивает качество работы. Балл на странице описывает полноту и прозрачность публичных данных, а не то, хорошо ли фирма делает работу. Отзывы не собираются.
  • Не посредничает. Обращение идёт напрямую в фирму, проект не сторона сделки.
  • Ничего не удаляет. Отбракованное остаётся в базе с причиной — для перепроверки и для честной строки «в нише N фирм, показываем M».
  • Пока только на эстонском. Услуги ищут преимущественно на эстонском, и распылять силы до проверки модели незачем. Почему я вообще ставлю этот вопрос отдельно — в статье про выбор языка для продвижения в Эстонии.

Ближайшая проверка — не трафик, а данные: сколько услуг проходят порог в три поставщика с проверенными реквизитами. Если ниша не набирает трёх, страницы у неё не будет, каким бы вкусным ни выглядел запрос.


Что дальше

План на ближайшее время простой: расширять список услуг, доводить долю фирм с сопоставимыми ценами и смотреть, как индексируется то, что уже опубликовано. О результатах напишу отдельно, когда они появятся, — с цифрами, а не с ощущениями.

Если вам нужен такой же контентный проект на данных — от сбора и модели до веб-разработки и поискового продвижения — это ровно тот тип работы, который я делаю и на своих проектах, и на клиентских. Разница только в том, что на своих я сначала рискую собственным временем.

Результаты

Услуг разобрано

66

страниц с ценами и поставщиками

Фирм в списках

1096

с данными из реестров

Позиций прайсов

3487

с ссылкой на источник и датой

Юрлиц в базе

376 043

весь Äriregister целиком

Частые вопросы

Что такое hinnaguru.ee?
Это справочник цен и поставщиков услуг в Эстонии. По каждой услуге собрана одна страница: диапазон и медиана цен с прайсов фирм, список поставщиков с данными из государственных реестров — стаж, число работников, оборот в этой сфере деятельности, наличие налогового долга — и объяснение, из чего складывается цена. Форм заявки на сайте нет: контакты фирм открыты, и посетитель обращается к фирме напрямую.
Откуда берутся данные о фирмах?
Из двух государственных источников. Открытые данные Äriregister (лицензия CC BY 4.0) дают название, регистрационный код, номер KMKR, дату регистрации, виды деятельности, число работников и оборот в разбивке по видам деятельности. Список налоговых должников Maksu- ja Tolliamet (CC BY-SA 3.0) даёт задолженность. Цены берутся с публичных прайсов на сайтах самих фирм, у каждой цены стоит ссылка на страницу-источник и дата сбора.
Можно ли самому проверить эстонскую фирму по открытым данным?
Да, и это бесплатно. Разово фирму удобно смотреть в Äriregister и в списке налоговых должников EMTA на сайте налогового департамента. Смотреть стоит на четыре вещи: год регистрации, сдавались ли годовые отчёты за последние годы, число работников и оборот именно по той сфере деятельности, за которой вы пришли. Массовая работа требует уже выгрузок открытых данных и базы — вручную это не делается.
Почему оборот в конкретной сфере деятельности важнее общего?
Потому что общий оборот отвечает на другой вопрос. Фирма может показывать больше миллиона евро оборота и делать интересующую вас услугу попутно на несколько десятков тысяч — в моей выборке по переездам такой случай дал 6,6% от общего оборота. Клиент видит «крупная компания», а в самой нише она меньше, чем небольшая фирма, которая занимается только этим. Разбивка по видам деятельности есть в открытых данных Äriregister, и именно она отвечает на вопрос «а этим они вообще занимаются?».
Значит ли топ-10 в Google, что это лучшие фирмы ниши?
Нет, и это хорошо видно на данных. Выдача ранжирует сайты, а не фирмы: в топ попадает тот, кто вложился в сайт и SEO. При сверке выдачи с реестром по коду деятельности регулярно находятся заметные по обороту фирмы, которых в выдаче нет ни на одной из первых пяти страниц, — обычно у них слабый сайт или его почти нет. Обратное тоже верно: часть сайтов в топе принадлежит фирмам, у которых в этой сфере минимальный оборот.
Как определяется порядок фирм в списке и продаётся ли место?
Место в списке не продаётся ни за какие деньги — на этом держится смысл проекта. Порядок задаётся расчётом, формула которого полностью выписана на странице методики: 100 баллов из семи частей — стаж, регулярность годовых отчётов, размер в этой сфере деятельности, работники, налоговый долг, публикация прайса и прозрачность сайта. Важная оговорка: этот балл описывает полноту и прозрачность публичных данных, а не качество работы. Отзывы проект не собирает и качество исполнения не оценивает.
На каком языке сайт и будет ли русская версия?
Первая версия только на эстонском — это осознанное решение, а не нехватка времени: услуги ищут преимущественно на эстонском, и распылять ресурс на три языка до того, как проверена сама модель, смысла нет. Структура данных готова принять второй язык, так что русская версия возможна, но только после того, как эстонская покажет, что модель работает.

Выводы

Главный вывод из этой работы не про справочник, а про данные: в Эстонии публично доступно достаточно, чтобы за один вечер выяснить о потенциальном подрядчике больше, чем он расскажет о себе на своём сайте, — и почти никто этим не пользуется. Оборот в конкретной сфере деятельности, стаж, число работников и налоговый долг лежат в открытых выгрузках Äriregister и EMTA под свободной лицензией. Если вы выбираете исполнителя — потратьте десять минут на проверку. Если вы сами исполнитель — посмотрите, что открытые данные говорят о вас, потому что скоро на них будут смотреть и ваши клиенты.

Автор статьи

Владислав Криворучко — основатель ADLAB
Владислав Криворучко

Основатель ADLAB OÜ · SEO и Google Ads

Больше 20 лет в поисковом трафике и монетизации, на эстонском рынке — с 2017 года. Работаю один: сам провожу аудит, строю стратегию и веду проекты — без подрядчиков и шаблонов. Пишу только о том, что проверил на своих и клиентских сайтах.

  • 20+ лет в поисковом трафике
  • 50+ проектов под ключ
  • Собственные сайты в конкурентных нишах
  • SEO для ru/et/en в одной выдаче
Подробнее обо мне

Читать дальше