SEO

Tekninen hakukoneoptimointi 2026: tarkistuslista, jonka voi oikeasti käydä läpi

Alle puolet sivustoista läpäisee Core Web Vitals -mittarit mobiilissa, FAQ-rikasteet poistuivat toukokuussa ja moni suomenkielinen ohje puhuu yhä mittarista, jota ei ole ollut kahteen vuoteen. Tässä 14 kohtaa, joista jokaisessa lukee, miten se tarkistetaan ja millä.

Anssi Tamminen Anssi Tamminen Päivitetty 12 min lukuaika
Lähikuva koodista näytöllä – tumma editori ja syntaksiväritys
Sisällys (27)

Sivusto voi olla sisällöltään paras ja silti näkymätön, jos Googlebot ei pääse sisään, sivu latautuu neljässä sekunnissa tai kanoninen osoite osoittaa väärään versioon. Tekninen hakukoneoptimointi on se osa työtä, jossa virhe on binäärinen: joko robots.txt sallii polun tai ei.

Tämä lista on päivitetty syyskuussa 2026 Googlen omien dokumenttien ja HTTP Archiven Web Almanac 2025 -datan mukaan. Jokaisessa kohdassa lukee, mitä tarkistetaan, miten ja millä työkalulla. Työkalujen hinnat ovat euroina jutun lopussa. Muutama kohta on eri kuin vuosi sitten: INP on korvannut FID:n, FAQ-rikasteet poistuivat toukokuussa 2026 ja AI-boteista pitää erottaa kaksi eri lajia.

Mitä tekninen hakukoneoptimointi tarkoittaa

Tekninen SEO kattaa kaiken, mikä vaikuttaa siihen, löytääkö hakukone sivun, saako se sen luettua ja kuinka nopeasti sivu toimii käyttäjällä. Se ei koske sisällön laatua eikä linkkejä. Google itse kuvaa järjestyksen kolmena vaiheena: indeksoija hakee sivun, renderöi sen ja vasta sitten indeksoi. Jos ensimmäinen vaihe epäonnistuu, kahta seuraavaa ei tule.

Googlen mukaan Core Web Vitals -mittarit ovat mukana rankkausjärjestelmissä, mutta relevanssi voittaa aina: hakukone näyttää osuvimman sisällön, vaikka sen sivukokemus olisi heikko. John Mueller totesi lokakuussa 2024, etteivät mittarit ole "jättimäisiä tekijöitä" sijoituksissa. Tekninen kunto ei siis nosta huonoa sisältöä, mutta se estää hyvää sisältöä putoamasta.

1. Core Web Vitals: kolme lukua ja 75. persentiili

Googlen kolme kenttämittaria ja niiden raja-arvot ovat samat mobiilissa ja työpöydällä, mutta ne mitataan erikseen:

MittariMitä mittaaHyväParannettavaaHeikko
LCP (Largest Contentful Paint)Suurimman elementin latautuminen≤ 2,5 s2,5–4 s> 4 s
INP (Interaction to Next Paint)Viive klikkauksesta ruudun päivitykseen≤ 200 ms200–500 ms> 500 ms
CLS (Cumulative Layout Shift)Sisällön hyppiminen latauksen aikana≤ 0,10,1–0,25> 0,25

Raja lasketaan 75. persentiilistä: kolmen neljästä käynnistä pitää osua hyvään. INP korvasi FID:n maaliskuussa 2024, ja se mittaa kaikkien klikkausten ja näppäinpainallusten viivettä koko käynnin ajalta, ei vain ensimmäistä. Moni suomenkielinen ohje puhuu yhä FID:stä. Se on merkki siitä, ettei ohjetta ole päivitetty kahteen vuoteen.

Web Almanac 2025:n mukaan heinäkuussa 2025 kaikki kolme mittaria läpäisi 48 prosenttia sivustoista mobiilissa ja 56 prosenttia työpöydällä. LCP on vaikein: mobiilissa sen läpäisee 62 prosenttia, INP:n 77 ja CLS:n 81. Suomalaisten sivustojen läpäisyprosenttia ei ole kukaan julkaissut.

Miten tarkistat: Search Consolen Core Web Vitals -raportti näyttää kenttädatan URL-ryhmittäin. PageSpeed Insights näyttää saman 28 päivän kenttädatan ja lisäksi Lighthouse-laboratoriomittauksen. Kenttädata ratkaisee, laboratorio kertoo syyn.

2. LCP-kuva: formaatti ja lazy loading

Suurin elementti on useimmiten kuva. Web Almanacin mukaan LCP-kuvista 57 prosenttia on yhä JPG-muodossa, 26 prosenttia PNG, 11 prosenttia WebP ja alle prosentti AVIF. Google Images tukee sekä WebP:tä että AVIF:ia, joten formaatin vaihto on helpoin yksittäinen LCP-parannus.

Toinen yleinen virhe: 17 prosenttia mobiilisivuista lataa LCP-kuvansa laiskasti (lazy loading). Ensimmäisen näytön kuvaa ei saa merkitä `loading="lazy"`, koska selain siirtää sen jonon perälle. Laiskan latauksen paikka on kuvissa, jotka ovat näytön alapuolella.

Miten tarkistat: Lighthouse nimeää LCP-elementin ja varoittaa laiskasta latauksesta. Chromen DevTools näyttää formaatin.

3. Indeksoitavuus: pääseekö Googlebot sisään

Robots.txt on ensimmäinen portti. Googlen dokumentaatio, päivitetty elokuussa 2026, tukee vain neljää kenttää: user-agent, allow, disallow ja sitemap. Kaikki muu, esimerkiksi crawl-delay, ohitetaan. Tiedoston enimmäiskoko on 500 kibitavua. Google on kertonut aikovansa listata dokumentaatioon yleisimmät tukemattomat direktiivit, mutta listaa ei ole julkaistu syyskuuhun 2026 mennessä.

Robots.txt estää hakemisen, ei indeksointia. Sivu, johon on linkkejä muualta, voi näkyä tuloksissa ilman kuvausta, vaikka polku olisi estetty. Indeksoinnin estää vain noindex-tunniste sivulla, jonka Googlebot saa lukea.

Miten tarkistat: Search Consolen URL-tarkastus kertoo, onko sivu haettu, indeksoitu ja millä kanonisella osoitteella. Screaming Frog listaa estetyt ja noindex-sivut koko sivustolta.

4. Sivustokartta: rajat ja lastmod

XML-sivustokarttaan mahtuu 50 000 osoitetta tai 50 megatavua pakkaamattomana. Suurempi jaetaan sivustokarttaindeksiin. Google ohittaa priority- ja changefreq-kentät kokonaan. Lastmod-kenttää se käyttää, jos se on "johdonmukaisesti ja todennettavasti tarkka". Gary Illyes totesi heinäkuussa 2026, että sivusto, jonka lastmod-arvot ovat vääriä, pärjää paremmin ilman niitä.

Käytännössä lastmod kannattaa generoida sisällön oikeasta muokkausajasta, ei sivun renderöintihetkestä. Jos jokainen osoite saa tämän päivän päivämäärän joka kerta, kenttä on kohinaa.

Miten tarkistat: Search Consolen Sivustokartat-raportti näyttää luetut osoitteet ja virheet. Avaa sivustokartta selaimessa ja vertaa muutaman sivun lastmodia todelliseen päivitykseen.

5. Kanoninen osoite on vihje, ei sääntö

Googlen kanonisointidokumentti, päivitetty elokuussa 2026, sanoo suoraan, että rel=canonical on vihje. Lopullisen kanonisen version Google valitsee useasta signaalista: HTTPS-versio, uudelleenohjaukset, sivustokartan osoitteet, sisäiset linkit ja canonical-tunniste. Kun nämä ovat ristiriidassa, Google päättää itse.

Yleisin ristiriita on lopuksi tuleva vinoviiva tai www-etuliite: sivustokartta listaa yhden muodon, sisäiset linkit toisen ja canonical kolmannen. Web Almanacin mukaan canonical on 68 prosentilla sivuista ja ristiriitainen alle prosentilla, mutta juuri se prosentti tuottaa "Duplicate, Google chose different canonical" -rivit Search Consoleen.

Miten tarkistat: Search Consolen Sivut-raportti ja URL-tarkastuksen "Google-selected canonical". Screaming Frog vertaa canonicalia ja osoitetta koko sivustolla.

6. Uudelleenohjaukset: yksi hyppy, ei viittä

Pysyviä ohjauksia ovat 301 ja 308, väliaikaisia 302, 303 ja 307. Google suosittelee palvelinpuolen pysyvää ohjausta aina, kun se on mahdollista. Googlebot seuraa enintään viittä hyppyä yhdellä hakukerralla, ja crawl budget -ohje sanoo pitkien ketjujen vaikuttavan hakemiseen kielteisesti.

Ketjut syntyvät kerroksittain: http → https → www → uusi polku. Jokainen kerros on oma kirjaus, jota kukaan ei ole purkanut. Tavoite on yksi hyppy lähteestä lopulliseen osoitteeseen.

Poistetun sivun oikea vastaus on 404 tai 410. Google sanoo 404:n olevan "vahva signaali olla hakematta osoitetta uudelleen", eivätkä 404-sivut ole laatusignaali. Mueller on kuvannut 404:n ja 410:n eron "hyvin pieneksi". Ohjaus etusivulle ei ole ratkaisu: se on soft 404, jonka Google tulkitsee virheeksi.

Miten tarkistat: Screaming Frogin Redirect Chains -raportti. Search Consolen Sivut-raportti listaa soft 404 -sivut.

7. JavaScript: mitä Googlebot näkee ilman selainta

Googlebot renderöi JavaScriptin, mutta jonossa, joka kestää Googlen mukaan "muutaman sekunnin, mutta voi kestää pidempään". Google suosittelee palvelinpuolen renderöintiä tai esirenderöintiä, koska kaikki botit eivät aja JavaScriptiä. Sivu, jonka sisältö on vain asiakaspuolella, on riski AI-hakubottien kohdalla, jotka eivät välttämättä renderöi lainkaan.

Kolme tarkkaa ohjetta Googlelta: älä reititä sivuja ristikkomerkillä (#), vaan History API:lla. Laiska lataus toteutetaan natiivilla loading-attribuutilla tai IntersectionObserverilla niin, että sisältö latautuu, kun se tulee näkyviin. Loputon vieritys tarvitsee jokaiselle sivulle oman osoitteen. Tämä on yksi syy, miksi sisältösivustoilla Astron kaltainen palvelinrenderöinti eroaa Next.js-oletuksista, kuten Astron ja Next.js:n vertailussa käytiin läpi.

Miten tarkistat: Search Consolen URL-tarkastus näyttää renderöidyn HTML:n. Vertaa sitä selaimen lähdekoodiin: jos otsikot ja teksti puuttuvat lähdekoodista, ne ovat JavaScriptin varassa.

Tekninen tiimitapaaminen — esitys ja yhteinen keskustelu

8. Strukturoitu data: mikä poistui ja mikä jäi

Tämä kohta on muuttunut eniten. Google poisti kesäkuussa 2025 seitsemän rikastetyyppiä, muun muassa Course Info-, Claim Review- ja Vehicle Listing -tulokset, ja 7.5.2026 FAQ-rikasteet poistuivat kokonaan. Googlen dokumentti sanoo, etteivät FAQ-rikasteet enää näy haussa. Merkintä saa jäädä sivulle, mutta se ei tuota mitään. Vanhoissa tarkistuslistoissa, tämän jutun aiempi versio mukaan lukien, FAQ-skeema oli suositus. Ei enää.

Search galleryssa on kesäkuun 2026 tilanteessa 25 tuettua ominaisuutta. Pk-yrityksen sivustolle riittävät Organization etusivulla, Article tai BlogPosting artikkeleissa, BreadcrumbList, Product ja Offer verkkokaupassa sekä LocalBusiness, jos toimipaikka on olemassa. Googlen sääntö on, että strukturoidun datan pitää vastata sivulla näkyvää sisältöä.

Tekoälyominaisuuksiin strukturoitu data ei ole vaatimus. Googlen heinäkuussa 2026 päivittämä ohje sanoo sen suoraan ja lisää, ettei uusia konetiedostoja, llms.txt:tä tai Markdown-versioita tarvita: llms.txt "ei haittaa eikä auta" näkyvyyttä. Mitä tekoälyvastaukset tekevät liikenteelle, on käyty läpi jutussa Google AI Overview ja AI Mode 2026.

Miten tarkistat: Rich Results Test ja Search Consolen Parannukset-osio. Poista listasta FAQ ja HowTo, jos ne ovat siellä tavoitteina.

9. AI-botit: koulutus ja haku ovat eri asia

Robots.txt:ssä on nyt kahdenlaisia tekoälybotteja, ja niiden sekoittaminen on yleisin uusi virhe.

  • Koulutusbotit: GPTBot (OpenAI), ClaudeBot (Anthropic) ja Google-Extended-tunnus. Niiden estäminen vähentää sisällön käyttöä mallien koulutuksessa.

  • Hakubotit: OAI-SearchBot (ChatGPT:n haku) ja Claude-SearchBot. Niiden estäminen poistaa sivuston tekoälyhakujen lähteistä. OpenAI:n mukaan muutos näkyy noin vuorokaudessa.

Google-Extended on erikoistapaus: Googlen oma dokumentaatio sanoo, ettei se vaikuta sivuston näkymiseen haussa, ei toimi rankkaussignaalina eikä poista sivua AI-yhteenvedoista, koska ne nojaavat tavalliseen hakuindeksiin. AI-yhteenvetoja rajoittavat vain nosnippet, data-nosnippet, max-snippet ja noindex, ja niiden hinta on, että sama katkelma katoaa myös tavallisista tuloksista.

Web Almanacin mukaan GPTBot mainitaan 4,5 prosentissa ja ClaudeBot 3,6 prosentissa robots-tiedostoista, ja tekoälybotteja koskevat säännöt lähes kaksinkertaistuivat vuodessa. Päätös kannattaa tehdä tietoisesti, ei kopioimalla lista foorumilta.

Miten tarkistat: Avaa oma robots.txt ja etsi user-agent-rivit. Jos siellä on OAI-SearchBot tai Claude-SearchBot estettynä, tiedä miksi.

10. Mobiili: ainoa Googlebot

Mobile-first-indeksointi valmistui lokakuussa 2023, ja heinäkuusta 2024 alkaen Google hakee sivustot vain Googlebot Smartphonella. Sisältö, joka ei ole saatavilla mobiililaitteella, ei indeksoidu lainkaan. Web Almanacin mukaan viewport-määritys on 95 prosentilla mobiilisivuista, joten perusasia on kunnossa lähes kaikilla. Ongelmat ovat piilotetuissa välilehdissä ja haitarielementeissä, joiden sisältö on mobiilissa eri kuin työpöydällä.

Peittävät ponnahdusikkunat ovat oma kohtansa. Googlen ohje sallii lakisääteiset, kuten evästesuostumuksen ja ikärajan, mutta suosittelee toteuttamaan ne päällekkäisenä kerroksena, ei erillisenä sivuna, ja niin, että Googlebot näkee sisällön niiden takaa.

Miten tarkistat: URL-tarkastuksen kuvakaappaus näyttää, mitä Googlebot Smartphone näki. Vertaa sitä työpöytäversioon.

11. HTTPS ja HSTS

HTTPS on ollut rankkaussignaali vuodesta 2014, ja Google kuvasi sen jo silloin "hyvin kevyeksi". Web Almanacin mukaan 92 prosenttia sivustoista on HTTPS:n takana, joten se ei enää erota ketään. Sen puuttuminen sen sijaan näkyy selaimen varoituksena. HSTS-otsake ei Muellerin mukaan vaikuta hakuun lainkaan, mutta se kannattaa pitää tietoturvasyistä.

Miten tarkistat: Search Consolen HTTPS-raportti listaa sivut, jotka eivät ole HTTPS:n takana. Sekasisältövaroitukset näkyvät selaimen konsolissa.

12. Sisäinen linkitys ja orvot sivut

Web Almanacin mediaanisivulla on 43 sisäistä linkkiä. Määrä ei ratkaise, jakauma ratkaisee: tärkein sivu tarvitsee eniten sisäisiä linkkejä, ja sivu ilman yhtään sisäistä linkkiä on Googlelle löydettävissä vain sivustokartasta. Sisäinen linkitys on myös se, jolla pitkän hännän sisältö saa painoa, kuten jutussa pitkän hännän hauista todettiin.

Miten tarkistat: Screaming Frogin tai Ahrefs Site Auditin orpojen sivujen raportti vertaa sivustokarttaa ja linkkirakennetta. Tee se neljännesvuosittain.

13. Fasettinavigaatio ja parametri-URL:t

Googlen joulukuussa 2025 päivittämä fasettinavigaation ohje on suora: usein ei ole hyvää syytä sallia suodatettujen listausten hakemista. Suositus on estää ne robots.txt:llä tai käyttää URL-fragmentteja. Jos suodattimet halutaan indeksoida, parametrit erotetaan &-merkillä, järjestys pidetään aina samana ja tyhjä tulos palauttaa 404:n.

Crawl budget koskee Googlen mukaan vasta yli miljoonan sivun sivustoja tai yli 10 000 päivittäin muuttuvan sivun sivustoja. Pienemmällä sivustolla ongelma ei ole budjetti vaan se, että tuhat suodatinyhdistelmää laimentaa kymmenen oikean sivun signaalit.

Miten tarkistat: Search Consolen Sivut-raportin "Discovered – currently not indexed" -rivi. Jos siellä on parametriosoitteita, ne pitää estää.

14. Kansainväliset versiot: hreflang ja paluulinkit

Jos sivustolla on suomi ja ruotsi, jokaisen version pitää viitata toisiinsa. Googlen ohje on ehdoton: jos sivu X viittaa sivuun Y, sivun Y pitää viitata takaisin sivuun X, tai merkinnät voidaan ohittaa. Kielikoodit ovat ISO 639-1 -muodossa, x-default osoittaa oletusversion, eikä "EU" tai "UK" kelpaa alueeksi. Saman kielen aluevariantit tarvitsevat sekä canonicalin että hreflangin.

Miten tarkistat: Screaming Frogin hreflang-raportti listaa puuttuvat paluulinkit. Search Consolen kansainvälinen kohdennus -raportti näyttää virheet.

Suomi-konteksti: palvelin, CDN ja .fi

Time to First Byte, jonka hyvä raja on 800 millisekuntia, on helpompi saavuttaa, kun palvelin on lähellä käyttäjää. Suomalaiselle yleisölle se tarkoittaa Helsinkiä: Zonerin palvelut ovat Telian Helsingin datakeskuksessa, Louhen palvelimet Suomessa ja Hetznerin hel1-alue Helsingissä. Cloudflaren EU-alueelle rajattu liikenne (Regional Services) on Enterprise-tason lisäosa, joten tavallisella Cloudflare-tilillä TLS-purku voi tapahtua EU:n ulkopuolella.

.fi-verkkotunnuksen voi Traficomin mukaan rekisteröidä kuka tahansa välittäjän kautta, kunhan se ei loukkaa suojattua nimeä. Hakukoneelle .fi on vahva maantieteellinen signaali, jota kansainvälinen .com ei anna ilman erillistä kohdennusta.

Työkalut ja hinnat syyskuussa 2026

  • Google Search Console ja Bing Webmaster Tools: ilmaisia. Search Console on ainoa lähde Googlen omalle kenttädatalle ja indeksointitilalle.

  • PageSpeed Insights ja Lighthouse: ilmaisia. Kenttädata 28 päivän ikkunalla plus laboratoriomittaus.

  • Screaming Frog SEO Spider: ilmainen 500 osoitteeseen asti, lisenssi 199 puntaa eli noin 245 euroa vuodessa käyttäjää kohden.

  • Ahrefs Webmaster Tools: ilmainen omille vahvistetuille sivustoille, Site Audit 5 000 krediittiä kuukaudessa. Maksullinen Lite-taso 119 €/kk.

  • Semrush: alkaen noin 117 dollaria kuukaudessa vuosilaskutuksella.

  • Sitebulb: pilviversio alkaen 95 puntaa kuukaudessa.

Pk-sivustolle riittää Search Console, PageSpeed Insights ja Screaming Frogin ilmaisversio. Maksullinen työkalu tulee tarpeeseen, kun sivuja on enemmän kuin 500 tai auditointi toistetaan kuukausittain.

Kuinka usein lista käydään läpi

Kerran vuodessa koko lista, kerran kuussa Search Consolen Sivut- ja Core Web Vitals -raportit. Jokaisen julkaisun, teemanvaihdon ja osoitemuutoksen jälkeen kohdat 3–6. Sivustomuutossa Google arvioi keskikokoisen sivuston siirron kestävän "muutaman viikon tai enemmän", ja kesäkuusta 2026 alkaen Change of Address -ilmoitus pitää tehdä jokaiselle osoitevariantille erikseen, www-versio mukaan lukien.

Lisää hakukoneoptimoinnin juttuja on koottuna kategoriaan SEO.

Usein kysytyt kysymykset

Mitkä ovat Core Web Vitals -raja-arvot vuonna 2026?

LCP enintään 2,5 sekuntia, INP enintään 200 millisekuntia ja CLS enintään 0,1. Raja mitataan 75. persentiilistä eli kolmen neljästä käynnistä pitää osua hyvään. Uusia mittareita ei ole tullut vuosina 2025–2026.

Mikä on INP ja miksi se korvasi FID:n?

INP mittaa viivettä minkä tahansa klikkauksen tai näppäinpainalluksen ja ruudun päivityksen välillä koko käynnin ajalta. FID mittasi vain ensimmäisen vuorovaikutuksen viiveen. INP korvasi FID:n maaliskuussa 2024.

Vaikuttaako Core Web Vitals sijoituksiin?

Kyllä, mutta vähän. Google sanoo mittareiden olevan mukana rankkausjärjestelmissä ja samalla, että osuvin sisältö näytetään, vaikka sivukokemus olisi heikko.

Kannattaako FAQ-skeema yhä lisätä?

Ei rikasteiden takia. FAQ-rikastetut tulokset poistuivat Googlesta 7.5.2026. Merkintä ei haittaa, mutta se ei tuota mitään.

Pitääkö GPTBot tai ClaudeBot estää?

Se on sisällön omistajan valinta. GPTBot ja ClaudeBot ovat koulutusbotteja. OAI-SearchBot ja Claude-SearchBot ovat hakubotteja, joiden estäminen poistaa sivuston ChatGPT:n ja Clauden hakutuloksista. Google-Extendedin estäminen ei vaikuta Google-hakuun eikä AI-yhteenvetoihin.

Kannattaako llms.txt tehdä?

Google sanoo, ettei se haittaa eikä auta näkyvyyttä. Web Almanacin mukaan sitä käyttää 2 prosenttia sivustoista. Googlen mukaan mikään Googlen järjestelmä ei käytä sitä.

Kuinka monta osoitetta sivustokarttaan mahtuu?

50 000 osoitetta tai 50 megatavua pakkaamattomana. Suurempi sivusto jakaa osoitteet useaan tiedostoon ja listaa ne sivustokarttaindeksissä.

Lähteet

Lue myös