mainostoimisto.ai
Oulu · 06:00:00

Aihekokonaisuus4 artikkelia

Tekninen SEO tekoälyaikana: indeksointi, skeema, nopeus ja mitä ei tarvitse tehdä

Vastaus lyhyestiTekninen SEO tekoälyaikana on sama työ kuin ennen: sivun pitää olla indeksoitu, katkelmakelpoinen, nopea ja luettavissa ilman JavaScriptiä. Google sanoo suoraan, ettei AI Overviews- tai AI Mode -näkyvyyteen ole lisävaatimuksia, ja että llms.txt, sisällön pilkkominen, erityinen skeema ja tekoälylle kirjoittaminen ovat turhia. Skeema vaikuttaa tuloksen ulkoasuun, ei sijoitukseen. Core Web Vitals ratkaisee, jääkö kävijä. Tämä sivusto testaa nämä väitteet omalla putkellaan.

Tekninen hakukoneoptimointi on vuonna 2026 saanut uuden myyntinimen: “tekninen GEO”, “AI-valmius”, “LLM-optimointi”. Palvelulistoilla on llms.txt-tiedostoja, tekoälyskeemaa ja sisällön pilkkomista. Google on julkaissut oman oppaansa siitä, mitä tekoälyominaisuuksiin pääseminen vaatii, ja sen viesti on lyhyt: ei mitään uutta. Tämä pilariartikkeli käy läpi, mitä tekninen SEO oikeasti vaatii tänä vuonna, mitä Google sanoo turhaksi, ja mitä mainostoimisto.ai tekee testatakseen väitteet omalla sivustollaan.

Indeksoitavuus on pääsymaksu, myös tekoälyominaisuuksiin

Googlen AI features -dokumentaation mukaan sivu voi näkyä AI Overviews- ja AI Mode -vastauksissa, kun se on indeksoitu ja kelpaa näytettäväksi katkelmana tavallisessa haussa, täyttää haun tekniset vaatimukset ja noudattaa spämmikäytäntöjä. Sitten tulee lause, joka kannattaa lukea kahdesti: lisävaatimuksia AI Overviews- tai AI Mode -näkyvyyteen ei ole, eikä erityisiä optimointeja tarvita.

Tekniset vaatimukset ovat Googlen omalla sivulla kolme: Googlebotia ei ole estetty, sivu toimii eli palauttaa HTTP 200 -koodin, ja sivulla on indeksoitavaa sisältöä tuetussa tiedostomuodossa. Vaatimusten täyttäminen tekee sivusta kelpoisen, ei takaa indeksointia. Tämä on se pääsymaksu. Kaikki muu tässä artikkelissa on sen päälle rakentamista.

Sama AI features -sivu listaa, mitä indeksoitavuuden eteen kannattaa tehdä, ja lista on tuttu: varmista robots.txt:llä, että sivut voi hakea, käytä sisäisiä linkkejä, huolehdi sivukokemuksesta, tarjoa sisältö tekstinä ja pidä rakenteinen data sivun näkyvän tekstin mukaisena. Sisäiset linkit ovat näistä se, joka pk-yrityksen sivustolla useimmin puuttuu: palvelusivu, johon ei linkitetä mistään muualta kuin valikosta, on hakukoneelle heikko signaali siitä, että sivu on tärkeä. Sitemap kertoo, että sivu on olemassa; linkit kertovat, että sillä on väliä. Tällä sivustolla jokainen artikkeli linkittää omaan pilariinsa ja pilari jokaiseen artikkeliinsa juuri tästä syystä.

Sama logiikka pätee muihin tekoälyhakuihin, mutta lippu tarkistetaan robots.txt:ssä. OpenAI:n bottidokumentaation mukaan sivustot, jotka estävät OAI-SearchBotin, eivät näy ChatGPT:n hakuvastauksissa. Anthropic dokumentoi ClaudeBotin (mallikehitys), Claude-Userin ja Claude-SearchBotin (haku), ja Perplexity PerplexityBotin hakutuloksia varten. Yleinen virhe on estää robots.txt:ssä kaikki tekoälybotit kerralla, koska ei haluta koulutusdataksi, ja pudota samalla ChatGPT:n ja Perplexityn hakutuloksista. Koulutusbotit (GPTBot, ClaudeBot) ja hakubotit (OAI-SearchBot, Claude-SearchBot, PerplexityBot) ovat eri käyttäjäagentteja, ja ne voi ohjata erikseen.

Katkelmakelpoisuus tarkoittaa, että vastaus on HTML:ssä ja sitä ei ole piilotettu

Googlen katkelmadokumentaation mukaan katkelmat tehdään ensisijaisesti sivun sisällöstä ja joskus meta descriptionista, jos se kuvaa sivua tarkemmin. Sivustonomistaja voi rajoittaa katkelmia kolmella ohjaimella: nosnippet estää katkelman kokonaan, max-snippet rajoittaa sen pituuden ja data-nosnippet-attribuutti sulkee tietyn sivun osan pois. AI features -sivu listaa samat ohjaimet tapana rajoittaa sisällön näkymistä tekoälyominaisuuksissa.

Tästä seuraa käytännön sääntö. Jos vastaus kysymykseen on sivun ensimmäisessä kappaleessa, tavallisena tekstinä, ilman että se on max-snippet-rajan takana tai data-nosnippet-lohkossa, se on lainattavissa. Tämän sivuston jokaisella sivulla on siksi tiivistelmä heti otsikon alla: 40–70 sanan suora vastaus, joka toimii yksinään, jos kone lainaa vain sen. Se ei ole tekoälytemppu vaan katkelmakelpoisuutta.

JavaScript on riski, jonka voi välttää kokonaan

Google osaa ajaa JavaScriptiä, mutta Googlen JavaScript SEO -ohjeen mukaan prosessi on kolmivaiheinen: indeksointirobotti hakee HTML:n, sivu jonottaa renderöintiin, ja vasta renderöinnin jälkeen JavaScriptillä tuotettu sisältö indeksoidaan. Sivu voi olla jonossa muutaman sekunnin, mutta ohjeen sanoin se voi kestää pidempäänkin. Sama ohje sanoo, että palvelinpuolen renderöinti tai esirenderöinti on edelleen hyvä ajatus, koska se tekee sivustosta nopeamman käyttäjille ja roboteille, eivätkä kaikki botit osaa ajaa JavaScriptiä.

Tekoälyhakujen boteista (OpenAI, Anthropic, Perplexity) en löytänyt dokumentaatiota, jonka mukaan ne renderöisivät JavaScriptiä. Turvallisin oletus on, että ne lukevat sen HTML:n, jonka palvelin lähettää, eivät sitä, minkä selain rakentaa. Jos sivun sisältö, otsikot tai sisäiset linkit syntyvät vasta JavaScriptissä, tekoälyhaulle sivu voi olla tyhjä.

Asian voi tarkistaa ilman työkaluja. Avaa sivun lähdekoodi selaimessa (ei kehittäjätyökalujen elementtinäkymää, vaan se, mitä palvelin lähetti) ja etsi sieltä sivun otsikko ja ensimmäinen kappale. Jos ne löytyvät, sivu on luettavissa ilman JavaScriptiä. Jos lähdekoodissa on vain tyhjä säiliö ja skriptiviittauksia, sisältö syntyy selaimessa, ja silloin Search Consolen URL-tarkastus näyttää, mitä Google renderöinnin jälkeen näki. Tekoälyhaun botille sitä näkymää ei ole.

Ratkaisu ei ole “älä käytä JavaScriptiä” vaan “lähetä valmis HTML”. WordPress tekee sen oletuksena, staattiset generaattorit kuten Astro tekevät sen oletuksena, ja yksisivuiset sovellukset (React, Vue ilman palvelinrenderöintiä) eivät tee. Alustavertailu on artikkelissa Staattinen sivusto vai WordPress.

Core Web Vitals ratkaisee kävijän, ei sijoitusta

Kolme mittaria ovat web.devin mukaan LCP (suurin sisältöelementti näkyvissä 2,5 sekunnissa), INP (vastaus vuorovaikutukseen 200 millisekunnissa) ja CLS (asettelun siirtymä enintään 0,1), kaikki mitattuna 75. persentiilillä oikeiden käyttäjien datasta. Data tulee Chrome User Experience Reportista ja näkyy PageSpeed Insightsissa ja Search Consolen Core Web Vitals -raportissa.

Vaikutuksesta sijoitukseen Google on rehellinen omalla sivukokemussivullaan: ydinjärjestelmät pyrkivät palkitsemaan hyvän sivukokemuksen, mutta mikään yksittäinen signaali ei ratkaise, ja Google-haku näyttää aina relevanteimman sisällön, vaikka sivukokemus olisi heikko. Nopeus ei siis nosta huonoa sisältöä. Se pitää kävijän hyvällä sivulla.

Suomalaisen pk-yrityksen kannalta olennaisin on INP, koska siihen kaatuvat WordPress-sivustot. HTTP Archiven Web Almanac 2025:n mukaan vain 45 prosenttia WordPress-sivustoista saavutti hyvän Core Web Vitals -tuloksen vuonna 2025, ja luku nimeää syyksi page builderien tuottamat monimutkaiset DOM-rakenteet ja suuret JavaScript-paketit. Mekanismit, mittaus ja korjaukset ovat artikkelissa Core Web Vitals 2026: mitä INP mittaa ja miksi WordPress-sivut kaatuvat siihen.

Skeema vaikuttaa siihen, miltä tulos näyttää, ei siihen, missä se on

Googlen rakenteisen datan johdanto kuvaa merkinnät tapana kertoa sivun sisällöstä niin, että Google voi näyttää sen rikastettuna tuloksena. Suositeltu muoto on JSON-LD. Merkintä ei saa kuvata tietoa, jota käyttäjä ei näe sivulla. Sijoituksesta dokumentti ei puhu.

Googlen tuettujen tyyppien lista on syyskuussa 2026 lyhyempi kuin ennen: FAQ ja HowTo puuttuvat. Googlen muutoslokin mukaan FAQ-rikastettu tulos lakkasi näkymästä 7.5.2026 ja dokumentaatio poistettiin kesäkuussa. Pk-yritykselle jäljelle jäävät hyödylliset tyypit ovat Article (otsikko, kuva, päivämäärä, kirjoittaja), Organization (logo, tietopaneeli, yritystunnisteet), LocalBusiness (aukioloajat, sijainti), Breadcrumb ja verkkokaupalle Product.

Tekoälyhakua varten Googlen optimointiopas sanoo suoraan, ettei rakenteista dataa vaadita eikä ole mitään erityistä schema.org-merkintää, joka pitäisi lisätä. Ainoa skeemaan liittyvä tekoälyohje on, että merkinnän pitää vastata sivun näkyvää tekstiä. Mitkä tyypit kannattaa tehdä ja mitkä eivät, on artikkelissa Skeema-merkinnät, jotka kannattaa tehdä 2026.

Fontit ovat halvin korjaus, jonka moni jättää tekemättä

Fontit eivät ole tekoälykysymys, mutta ne ovat suomalaisten yrityssivujen yleisin Core Web Vitals -vuoto. web.devin fonttiohjeen suositukset ovat lyhyet: käytä WOFF2-muotoa, tee fontista osajoukko, jossa on vain tarvittavat merkit, valitse font-display-arvo tietoisesti (optional, jos suorituskyky on tärkein; swap, jos fontin pitää näkyä, mutta teksti saa vaihtua) ja käytä size-adjust-ominaisuutta, jotta varafontti vie saman tilan kuin oikea fontti eikä teksti hypi. Jos fontit tulevat Google Fontsista, preconnect-vihjeet fonts.googleapis.com- ja fonts.gstatic.com-osoitteisiin lyhentävät yhteyden avaamista. Ohjeen mukaan itse isännöinti kannattaa vain, jos käytössä on CDN ja HTTP/2, muuten hyöty ei ole taattu.

Suomen kielen ä ja ö kannattaa muistaa osajoukkoa tehdessä. Latin-osajoukko, josta ne puuttuvat, näyttää suomalaisen sivun varafontilla juuri niissä sanoissa, jotka näkyvät otsikoissa.

Googlen lista turhista tempuista

Tämä on artikkelin tärkein osa, ja se on lähes kokonaan sitaattia Googlen omasta optimointioppaasta (päivitetty 10.7.2026). Opas listaa asiat, joita ei tarvitse tehdä.

Uusia koneluettavia tiedostoja ei tarvita. Oppaan mukaan Google-hakuun pääsemiseksi ei tarvitse luoda uusia koneluettavia tiedostoja, tekoälytekstitiedostoja, merkintöjä tai Markdownia, ja Google-haku ohittaa ne. Muutoslokin 15.6.2026 täsmennyksen mukaan llms.txt-tiedoston saa tehdä muita palveluita varten, mutta se ei vaikuta Google-näkyvyyteen kumpaankaan suuntaan. Googlen John Mueller kirjoitti kesäkuussa 2025, ettei yksikään tekoälyjärjestelmä käytä llms.txt-tiedostoa. Koko tarina on artikkelissa llms.txt — tarvitseeko suomalainen yritys sitä?.

Sisältöä ei tarvitse pilkkoa. Oppaan mukaan sisältöä ei tarvitse jakaa pieniin paloihin, jotta tekoäly ymmärtäisi sen paremmin. “Chunking” on RAG-järjestelmien sisäinen tekniikka, ei sivuston tekijän tehtävä.

Ihanteellista sivun pituutta ei ole. Opas sanoo sen sanasta sanaan ja lisää, että sivut tehdään yleisölle, ei generatiiviselle haulle.

Tekoälyä varten ei tarvitse kirjoittaa erityisellä tavalla. Oppaan mukaan generatiivista hakua varten ei tarvitse kirjoittaa tietyllä tyylillä. Järjestelmät ymmärtävät synonyymit ja tarkoituksen.

Erityistä skeemaa ei tarvita. Tämä sanottiin jo edellä, mutta se kuuluu tähän listaan.

Ostettuja tai tekaistuja mainintoja ei kannata hankkia. Oppaan mukaan järjestelmät suosivat laadukasta sisältöä ja spämmijärjestelmät torjuvat epäaidot maininnat.

Listan ulkopuolelta yksi asia, jota opas nostaa varovasti esiin: agenttikokemukset. Selainagentit voivat oppaan mukaan tehdä tehtäviä sivustolla tarkastelemalla visuaalista renderöintiä (kuvakaappauksia), DOM-rakennetta ja saavutettavuuspuuta. Tämä ei ole vaatimus vaan suunta: siisti semanttinen HTML ja toimiva saavutettavuuspuu auttavat agenttia siinä missä ruudunlukijaa. Se on sama työ kuin saavutettavuus, ja se kannattaa tehdä siitä syystä.

Mitä tämä sivusto tekee ja mittaa

mainostoimisto.ai on Cosmic Thing Oy:n julkinen laboratorio, ja tämä pilari on sen tekninen koeasetelma. Sivusto on Astro-staattinen Cloudflare Pagesissa, joten jokainen sivu on valmista HTML:ää ilman renderöintijonoa. Kolme ulkoasua (kineettinen typografia, WebGL ja lähtöaulan taulu) arvotaan kävijälle, ja kaikissa on sama sisältö, sama tiivistelmä otsikon alla ja sama skeema. Animaatiot koskevat vain transform- ja opacity-ominaisuuksia, ja WebGL ajetaan vain, kun se on näkyvissä, jotta liike ei tuki pääsäiettä.

Skeemana sivusto tuottaa Article-, Organization-, Person- ja FAQPage-merkinnät JSON-LD:nä samasta datasta kuin näkyvän sisällön. FAQPage on mukana, vaikka Google poisti rikastetun tuloksen, koska se on ilmainen ja kelvollinen; siitä ei odoteta mitään. Sivustolla on sitemap ja RSS.

Ja sitten koe. Sivustolla on llms.txt- ja llms-full.txt-tiedostot, joita Googlen mukaan ei tarvita ja joita Muellerin mukaan kukaan ei lue. Cloudflaren lokista lasketaan, hakeeko yksikään tunnistettu botti niitä ja kuinka usein verrattuna HTML-sivuihin. Samasta lokista nähdään, mitkä tekoälybotit sivustolla ylipäätään käyvät. Dataa ei vielä ole, koska sivusto julkaistiin 22.9.2026, ja tämä launch-erä on kirjoitettu Claude-agenteilla ennen sisältökoneen ensimmäistä automaattiajoa. CrUX-dataa Core Web Vitalseista ei myöskään ole ennen kuin kävijöitä on riittävästi. Kun lukuja on, ne julkaistaan, myös silloin kun ne eivät tue tämän sivuston omaa väitettä. Bottien seuranta on artikkelissa Tekoälybotit lokeissa, ja mittaamisen kokonaiskuva pilarissa Näkyvyyden mittaaminen tekoälyssä.

Tekninen SEO -lista suomalaiselle pk-yritykselle 2026

Lista on lyhyt, koska työ on lyhyt. Tarkista, ettei robots.txt estä Googlebotia eikä hakubotteja (OAI-SearchBot, Claude-SearchBot, PerplexityBot), vaikka estäisit koulutusbotit. Tarkista Search Consolesta, että tärkeät sivut on indeksoitu ja että ne palauttavat 200. Katso PageSpeed Insightsista kenttädata ja korjaa ensin INP, jos se on punaisella; yleisin syy on lisäosat, page builder ja kolmannen osapuolen skriptit. Varmista, että sisältö on HTML:ssä ilman JavaScriptiä. Tee Article-, Organization- ja tarvittaessa LocalBusiness-skeema, ja tarkista, että ne vastaavat näkyvää sisältöä. Laita fontit WOFF2-muotoon ä:n ja ö:n kanssa. Kirjoita vastaus ensimmäiseen kappaleeseen.

Älä osta llms.txt-tiedostoa, tekoälyskeemaa tai sisällön pilkkomista. Google sanoo, etteivät ne tee mitään, ja tämä sivusto mittaa, pitääkö se paikkansa. Sisällön puolelta sama asia jatkuu pilarissa GEO: tekoälyhaun optimointi.

Kysymyksiä, joita tästä haetaan

Tarvitseeko tekoälyhakuun erillistä teknistä optimointia?

Ei. Googlen mukaan AI Overviews- ja AI Mode -näkyvyyteen ei ole lisävaatimuksia: sivun pitää olla indeksoitu ja katkelmakelpoinen. Muille tekoälyhauille riittää, ettei robots.txt estä niiden hakubotteja ja että sisältö on HTML:ssä ilman JavaScriptiä.

Onko llms.txt pakollinen?

Ei. Google sanoo, ettei tiedosto vaikuta näkyvyyteen kumpaankaan suuntaan, ja OpenAI, Anthropic ja Perplexity ohjaavat bottejaan robots.txt-tiedostolla. Tämä sivusto julkaisee tiedoston kokeena ja mittaa, hakeeko kukaan sitä.

Vaikuttaako skeema sijoitukseen?

Googlen dokumentaatio ei kuvaa skeemaa sijoitustekijänä. Se vaikuttaa siihen, miltä tulos näyttää: otsikko, kuva, päivämäärä, logo, tietopaneeli. Tekoälyhakuun ei tarvita erityistä skeemaa.

Mitä Core Web Vitals -arvoja pitää tavoitella?

LCP enintään 2,5 sekuntia, INP enintään 200 millisekuntia, CLS enintään 0,1, kaikki 75. persentiilillä oikeiden käyttäjien datasta. Google sanoo silti näyttävänsä relevanteimman sisällön, vaikka sivukokemus olisi heikko.

Pitääkö sivuston olla WordPress, että Google löytää sen?

Ei. Googlen John Muellerin mukaan valtavirran julkaisujärjestelmien välillä ei ole perustavaa SEO-eroa ja staattinen hosting moderneilla työkaluilla on yhtä hyvä.

Lähteet

  1. Google Search Central: AI features and your websiteKelpoisuus: indeksoitu ja katkelmakelpoinen; ei lisävaatimuksia; ei tarvita tekoälytiedostoja; nosnippet-ohjaimet
  2. Google Search Central: Guide to optimizing for generative AI featuresTurhien temppujen lista: tiedostot, Markdown, pilkkominen, sivun pituus, kirjoitustapa, skeema, maininnat; agenttikokemukset (päivitetty 10.7.2026)
  3. Google Search Central: What's new15.6.2026 llms.txt-täsmennys; 8.5.2026 FAQ-rikastetun tuloksen poisto
  4. Google Search Central: Google Search technical requirementsKolme teknistä vaatimusta: Googlebot ei estetty, HTTP 200, indeksoitava sisältö
  5. Google Search Central: Control your snippets in search resultsKatkelma tehdään sivun sisällöstä; nosnippet, max-snippet, data-nosnippet
  6. Google Search Central: Understand JavaScript SEO basicsRenderöintijono voi kestää; palvelinpuolen renderöinti on hyvä ajatus, koska kaikki botit eivät aja JavaScriptiä
  7. web.dev: Web VitalsLCP 2,5 s, INP 200 ms, CLS 0,1; 75. persentiili
  8. Google Search Central: Understanding page experience in Google Search resultsGoogle näyttää relevanteimman sisällön, vaikka sivukokemus olisi heikko
  9. HTTP Archive Web Almanac 2025: CMS45 % WordPress-sivustoista hyvä CWV; page builderit ja DOM
  10. Google Search Central: Introduction to structured data markupJSON-LD; ei merkintöjä näkymättömästä sisällöstä
  11. Google Search Central: Structured data markup that Google Search supportsTuetut tyypit syyskuussa 2026; FAQ ja HowTo puuttuvat
  12. web.dev: Best practices for fontsWOFF2, font-display, size-adjust, preconnect
  13. John Mueller (Bluesky), 17.6.2025'FWIW no AI system currently uses llms.txt.'
  14. OpenAI: Overview of OpenAI crawlersOAI-SearchBotilta estetyt sivustot eivät näy ChatGPT:n hakuvastauksissa
  15. Anthropic: Does Anthropic crawl data from the webClaudeBot, Claude-User, Claude-SearchBot; robots.txt
  16. Perplexity: Perplexity crawlersPerplexityBot; robots.txt

Löysitkö virheen?

Tämän tekstin kirjoitti kone ja toinen kone tarkisti faktat. Ihminen ei ole lukenut jokaista tekstiä. Jos jokin on väärin, kerro — ilmoitus menee Ilkka Immoselle, korjaus tehdään ja se merkitään tähän tekstiin näkyviin.

Artikkelit tästä aiheesta

22.9.2026
5 min

llms.txt — tarvitseeko suomalainen yritys sitä?

Google sanoo, ettei llms.txt-tiedostoa tarvita, ja yksikään tekoälyhaku ei ole vahvistanut lukevansa sitä. Mikä ehdotus on, kuka sen teki ja mitä tämä sivusto mittaa.

Julkaistu · faktantarkistus tulossa
portti 82

Sama menetelmä on myytävänä.

Jos löysit tänne hakukoneen tai tekoälyn kautta, näit jo tuloksen. Cosmic Thing tekee saman sinun yrityksellesi: verkkosivut, joista näet vaihtoehdot ennen buildia, ja sisältökoneen, joka tarkistaa omat faktansa ja kertoo sen lukijalle.

Pyydä tarjousKuka tämän takana on