Arutame projekti

Roomamiseelarve: millal see päriselt loeb

Roomamiseelarve pole enamiku saitide probleem. Selgitan, mille järgi aru saada, et Googlebot ei jõua saiti läbi käia, ja mis seda päriselt ravib.

Vladislav Krivorutsko1. september 20266 min lugemist
Sisukord

TL;DR — lühidalt peamisest

  • Roomamiseelarve on see, kui palju URL-e Googlebot su saidil teatud aja jooksul läbi käia jõuab ja tahab
  • Kuni paari tuhande lehega saidil pole see peaaegu kunagi indekseerimisprobleemi põhjus — vaata pigem sisu kvaliteeti ja duplikaate
  • Päris kandidaadid: suured filtritega kataloogid, kalendrid, saidisisene otsing ja parameetrid URL-is
  • Diagnoos tehakse Search Console'i roomamisstatistika ja serverilogide järgi, mitte silma järgi
  • Eelarvet ei juhita limiidi tõstmisega, vaid prügi vähendamisega: vähem kasutuid URL-e tähendab rohkem külastusi olulistele

Lühike vastus

Roomamiseelarve on see, kui palju sinu saidi URL-e Googlebot teatud aja jooksul läbi käia jõuab. Probleemiks muutub see harva: kuni paari tuhande aadressiga saidil on indekseerimata lehtede põhjus peaaegu alati muu — nõrk sisu, duplikaadid või siselinkide puudumine. Eelarvele tasub mõelda siis, kui sait tekitab kümneid tuhandeid URL-e: filtritega kataloog, broneerimiskalender, saidisisene otsing, sortimisparameetrid.

Millest roomamiseelarve koosneb

Google Search Central kirjeldab seda kahe piirangu koosmõjuna.

OsaMis see onKes seda mõjutab
Roomamissageduse piirKui palju päringuid sait ilma aeglustumata kannatabSina — serveri vastusaja ja 5xx-vigade kaudu
RoomamisnõudlusKui väga Google neid URL-e läbi käia tahabGoogle — lehtede populaarsuse, uuenemissageduse ja andmete vananemise järgi

Sellest järeldub peamine, ja Google Search Central kirjutab sedasama otsesõnu: eelarvet ei saa otse suurendada. Saab teha nii, et sait vastab kiiremini ja et Googlebot kulutab päringud kasulikele aadressidele prügi asemel. Kõik muu on folkloor.

Enne: külastused lähevad prügilefiltrid, sortimine, utm, saidiotsingtootekaardidkategooriad ja artiklidrobots.txt + canonical + parameetrite koristusPärast: sama maht, teised aadressidprügitootekaardidkategooriad ja artiklidSkeem näitab ümberjaotuse mehaanikat, mitte konkreetse saidi mõõtmist.

Millal eelarve pole üldse süüdi

Minu poole pöördutakse regulaarselt sõnastusega «Google ei indekseeri saiti, ilmselt ei jätku roomamiseelarvet». Enamasti on sait sadakond lehte ja eelarvel pole sellega mingit pistmist.

Märgid, et põhjus on mujal:

  • roomamisstatistikast on näha, et Googlebot käib saidil regulaarselt, aga lehed püsivad olekus «roomatud, kuid pole indekseeritud» — see on sisu väärtuse, mitte sageduse küsimus;
  • indekseerimata lehtedele ei vii ühtegi siselinki — siis on tegu orblehtedega ja robotil pole neid kusagilt leida;
  • indeksisse ei jõua peaaegu ühesugused tootekaardid — siis tuleb tegeleda duplikaatsisuga, mitte eelarvega.

Põhjuste täieliku loetelu koondasin eraldi artiklisse selle kohta, miks Google lehti ei indekseeri. Roomamiseelarve on seal nimekirja viimane punkt ja see on õige kontrollimise järjekord.

Mis eelarvet päriselt sööb

Peaaegu alati pole süüdi sisu, vaid aadressid, mida sait ise tekitab.

  1. Fassettnavigatsioon. Omavahel kombineeruvad filtrid annavad kombinatoorse plahvatuse: kolm filtrit kümne väärtusega on juba tuhat aadressi ühe kategooria kohta.
  2. Sortimine ja parameetritega lehekülgede jaotus. Sama toode on kättesaadav kümne eri aadressi kaudu.
  3. Saidisisene otsing. Iga päring on eraldi tulemuste leht, kui seda ei sulge.
  4. UTM-märgendid siselinkides. Klassika: märgendid on pandud saidisisestele bänneritele ja iga leht kahekordistus.
  5. Broneerimiskalendrid. Lõputu kuupäevade genereerimine ettepoole on lõks, kust robot välja ei saa.
  6. Ümbersuunamiste ahelad. Iga lüli on eraldi päring: kolm ühe asemel kulutab eelarvet kolm korda rohkem.
  7. Pehmed 404-d. Kustutatud tooted, mis vastavad koodiga 200 ja tühja kaardiga, käiakse edasi läbi. Kuidas selliseid aadresse õigesti sulgeda, kirjutasin artiklis 404, 410 või ümbersuunamine kustutatud lehtedele.

Kuidas tunni ajaga diagnoosida

Järjekord, mida ma tehnilisel auditil ise kasutan:

  1. Search Console → Seaded → Roomamisstatistika. Vaatan kolme asja: päringute arvu ööpäevas, keskmist vastusaega ning jaotust eesmärgi (avastamine vs uuendamine) ja failitüübi järgi.
  2. Jaotus vastusekoodide järgi. Märgatav 3xx ja 4xx osakaal tähendab, et eelarve kulub aadressidele, mida ammu pole.
  3. Serverilogid. Ainus allikas, kus on nimeliselt näha, milliseid URL-e Googlebot läbi käib ja mitu korda. Võtan välja 2–4 nädalat, filtreerin user-agenti järgi koos pöörd-DNS kontrolliga ja grupeerin URL-i mustri kaupa.
  4. Oma roomamine. Võrdlen, mitu URL-i leiab roomaja linkide kaudu ja mitu neist on sitemapis. Mitmekordne vahe on kindel prügi tekitamise märk.
  5. Vastusaeg. Kui keskmine vastusaeg püsib sekundi kandis või kõrgemal, jääb roomamissagedus madalaks olenemata kõigest muust. See on naaberteema saidi kiirusest ja positsioonidest, aga siin loeb just serveri vastus, mitte Core Web Vitals.

Ühekordne külastuste hüpe pärast väljalaset on normaalne: Googlebot käib muutunud lehed uuesti läbi. Murettekitav märk on teine ja paistab roomamisstatistikas 2–3 nädalaga välja: püsiv nihe parameetritega aadresside poole, kui tootekaartide külastused samal ajal kahanevad.

Millega eelarvet juhitakse

TööriistMida teebMillal kasutada
robots.txtKeelab URL-i pärimiseSaidiotsing, kalendrid, ilmselgelt prügised parameetrid
noindexEemaldab indeksist, roomamine jääb allesLeht on kasutajale vajalik, aga otsingusse ei kuulu
rel=canonicalLiidab duplikaadidSortimised ja ühe kaardi variandid
Parameetriteta lingidEi tekita lisaaadresseSaidisisesed bännerid: märgendid ainult välistele allikatele
Kiire serveri vastusTõstab roomamissagedustAlati
Korrektne lastmod sitemapisAitab valida, mida uuesti roomataSageli muutuvad kataloogid

Saidikaardi ja keelufaili seadistust käsitlen eraldi artiklis sitemap.xml ja robots.txt. Siin on üks oluline märkus: robots.txt pole viis lehte otsingust eemaldada. Selles suletud aadressi võib Google tulemustes ilma kirjelduseta näidata, sest ta keelas endal selle lugemise.

Mida ma oma projektides näen

Oma saitidel jooksis Googlebot roomamislakke täpselt ühe korra, ja mitte mahu, vaid arhitektuuri pärast: parameetrite kombinatsioonide järgi genereeritud võrdluslehti tekkis suurusjärgu võrra rohkem kui kasulikku sisu. Ravi polnud roomamise peenhäälestus, vaid otsus, millistel kombinatsioonidel on üldse õigus eraldi lehena eksisteerida.

Aus rakenduspiir: kui sul on 40 lehega teenusesait või 300 artikliga blogi, pole kogu see peatükk sinu jaoks. Sinu lagi pole roomamiseelarve, vaid nõudlus ja kvaliteet. Teema juurde tasub naasta siis, kui URL-ide arv hakkab mõõduma kümnetes tuhandetes ja oluliste lehtede osakaal külastustes langeb.

Mida sel nädalal teha

  1. Ava roomamisstatistika ja kirjuta üles kolm arvu: päringuid ööpäevas, keskmine vastusaeg, mitte-200 vastuste osakaal.
  2. Jookseta sait roomajaga läbi ja võrdle leitud URL-ide arvu sitemapi omaga.
  3. Leia kolm kõige massilisemat prügiaadresside mustrit ja otsusta iga kohta: robots.txt, canonical või linkide eemaldamine.
  4. Eemalda UTM-märgendid siselinkidest — kõige odavam parandus märgatava mõjuga.
  5. Kui serveri vastus on sekundist aeglasem, tegele backendiga: see mõjutab nii roomamist kui ka kasutajat. Sellised parandused kuuluvad pigem veebiarenduse kui SEO-seadete alla, aga ilma nendeta jookseb tehniline audit lakke.

Korduma kippuvad küsimused

Mis on roomamiseelarve lihtsalt öeldes?
See on URL-ide hulk, mille Googlebot sinu saidil teatud aja jooksul läbi käib. See koosneb kahest asjast: kui palju päringuid sait aeglustumata välja kannatab ja kui vajalikuks Google neid aadresse üldse peab. Eraldi numbrit Google'i liideses pole — on ainult tegelik roomamisstatistika.
Kui suure saidi puhul muutub roomamiseelarve probleemiks?
Google Search Central kirjutab, et kuni umbes paari tuhande URL-iga saidi omanikul pole vaja sellele mõelda. Minu tähelepanekute järgi ei määra piiri mitte toodete arv, vaid tekitatavate aadresside arv: 800 tootega pood avatud filtritega paisub kergesti sadade tuhandete URL-ideni ja jookseb eelarvesse varem kui 5000 artikliga blogi.
Kas Google'ilt saab paluda sagedasemat roomamist?
Nuppu «roomake rohkem» pole kunagi olnud ja roomamissageduse piiramise tööriista Google eemaldas Search Console'ist. Mõjutada saab kaudselt: kiirenda serveri vastust, eemalda kasutud URL-id, uuenda päriselt muutunud lehti ja hoia sitemapis korrektsed lastmod-kuupäevad.
Kas robots.txt aitab roomamiseelarvet kokku hoida?
Jah, see on peamine tööriist prügiosade jaoks nagu saidisisene otsing ja lõputud kalendrid: robots.txt-s suletud aadressi Googlebot ei päri. Kuid suletud leht võib jääda indeksisse ilma kirjelduseta, seega kasuta otsingust eemaldamiseks noindexi, mitte robots.txt-d.
Kas saidi kiirus mõjutab roomamiseelarvet?
Jah, aga mitte Core Web Vitalsi kaudu, vaid serveri vastusaja kaudu. Google vähendab roomamissagedust, kui näeb vastusaja kasvu ja serveri vigu, ning tõstab seda, kui sait vastab kiiresti. See on ainus osa eelarvest, mida sa otseselt ja ettearvatavalt mõjutad.

Järeldused

Roomamiseelarve pole kang, mida saab keerata. See on tagajärg sellest, kui palju prügi-URL-e sa robotile ette annad ja kui kiiresti server vastab. Kui sait on väike ja lehed pole indeksis, pole asi peaaegu kindlasti eelarves. Kui kataloog on suur, alusta roomamisstatistikast ja logidest, mitte oletustest.

Artikli autor

Vladislav Krivorutsko — ADLABi asutaja
Vladislav Krivorutsko

ADLAB OÜ asutaja · SEO ja Google Ads

Üle 20 aasta otsiliikluse ja monetiseerimisega, Eesti turul alates 2017. aastast. Töötan üksi: teen auditi, koostan strateegia ja viin projekti ise lõpuni — ilma alltöövõtjate ja šabloonideta. Kirjutan ainult sellest, mida olen oma ja klientide saitidel järele proovinud.

  • 20+ aastat otsiliikluses
  • 50+ projekti võtmed kätte
  • Oma saidid konkurentsitihedates nišides
  • SEO ru/et/en ühes otsingutulemuses
Loe minust lähemalt

Loe edasi