mainostoimisto.ai
Oulu · 06:00:00

5 minTekninen SEOKirjoitti kone · faktat tarkisti kone · vastuu: Ilkka Immonen

llms.txt — tarvitseeko suomalainen yritys sitä?

Vastaus lyhyestiEi tarvitse. Google on kirjoittanut dokumentaatioonsa, että llms.txt-tiedostoja ei tarvita ja että Google-haku ohittaa ne kokonaan. OpenAI, Anthropic ja Perplexity dokumentoivat botteinsa ohjauksen robots.txt-tiedostolla, eivät llms.txt:llä. Tiedosto ei myöskään haittaa. Tämä sivusto julkaisee sen kokeena ja laskee Cloudflaren lokista, hakeeko yksikään botti sitä. Dataa ei vielä ole.

Lyhyt vastaus on ei. Pidempi vastaus on, että kysymys paljastaa, miten tekoälyhaun optimointia myydään: ehdotus, jota yksikään suuri tekoälyhaku ei ole vahvistanut käyttävänsä, on päätynyt suomalaistenkin toimistojen palvelulistoille. Tässä käydään läpi, mistä ehdotus tuli, mitä Google siitä sanoo, mitä bottien omistajat sanovat ja mitä tämä sivusto tekee asialle.

llms.txt on yhden ihmisen ehdotus, ei standardi

Ehdotuksen julkaisi Jeremy Howard (Answer.AI, fast.ai) 3.9.2024 osoitteessa llmstxt.org. Ajatus on yksinkertainen: sivuston juureen laitetaan Markdown-muotoinen tiedosto /llms.txt, joka kertoo kielimallille tiiviisti, mitä sivusto on ja mistä tärkein sisältö löytyy. Ehdotuksen omin sanoin agentteja palvelee parhaiten “tiivis, asiantuntijatason tieto kerättynä yhteen, helposti saavutettavaan paikkaan”.

Muoto on kevyt: H1-otsikko, lainauslohko, jossa sivusto kuvataan parilla lauseella, ja H2-otsikoiden alla linkkilistoja sivuihin kuvauksineen. Lisäksi ehdotetaan, että jokaisesta HTML-sivusta tarjotaan Markdown-versio samasta osoitteesta .md-päätteellä. Sivun mukaan ehdotusta on päivitetty elokuussa 2026 versioon 2.

Yleisesti puhutaan myös llms-full.txt-tiedostosta, johon kootaan koko sivuston sisältö yhteen. Sitä ei löytynyt llmstxt.org-sivun tekstistä, kun se luettiin tätä artikkelia varten. Se on siis yhteisön käytäntö ehdotuksen päälle, ei osa itse ehdotusta.

Tärkeä ero robots.txt-tiedostoon: robots.txt on standardi, jota hakukoneet ja tekoälybotit dokumentoidusti noudattavat. llms.txt on ehdotus, jonka noudattamista kukaan ei ole luvannut.

Google sanoo suoraan, ettei tiedostoa tarvita ja että Google-haku ohittaa sen

Google julkaisi toukokuussa 2026 oppaan tekoälyominaisuuksiin optimoinnista. Googlen oppaan (päivitetty 10.7.2026) mukaan Google-hakuun pääsemiseksi ei tarvitse luoda uusia koneluettavia tiedostoja, tekoälytekstitiedostoja, merkintöjä tai Markdownia. Samaan hengenvetoon opas sanoo, ettei sisältöä tarvitse pilkkoa pieniin paloihin tekoälyä varten, ettei ole olemassa ihanteellista sivun pituutta ja ettei tekoälyhakua varten tarvitse kirjoittaa erityisellä tavalla.

Kesäkuussa 2026 Google täsmensi kantaa vielä kerran. Search Centralin muutoslokin 15.6.2026 merkinnän mukaan llms.txt-tiedostot eivät ole tarpeen Google-haussa eivätkä vaikuta näkyvyyteen tai sijoituksiin negatiivisesti eivätkä positiivisesti. Samassa päivityksessä Google sanoo, että tiedoston saa aivan hyvin tehdä muita palveluita varten: se ei haittaa, koska Google-haku ohittaa sen.

Tämä on selkein mahdollinen linjaus. Googlen tekoälyominaisuudet (AI Overviews, AI Mode) käyttävät samaa indeksiä kuin tavallinen haku. Jos sivu on indeksoitu ja kelpaa katkelmaksi, se kelpaa myös tekoälyvastauksen lähteeksi. Erillistä pääsylippua ei ole, eikä llms.txt ole sellainen. Tästä laajemmin pilariartikkelissa Tekninen SEO tekoälyaikana.

John Mueller: yksikään tekoälyjärjestelmä ei käytä sitä

Googlen John Mueller kirjoitti Blueskyssä 17.6.2025: “FWIW no AI system currently uses llms.txt.” Search Engine Roundtablen raportin mukaan hän jatkoi samassa ketjussa, että palvelinlokeista asian näkee helposti: kuluttajakielimallit hakevat sivuja koulutukseen ja vastausten pohjaksi, mutta yksikään niistä ei hae llms.txt-tiedostoa. Jatkokommentti on tässä toissijaisen lähteen varassa, koska alkuperäinen ketju ei avautunut kokonaan.

Muellerin kommentti on vuodelta 2025. Tilanne olisi voinut muuttua vuodessa. Siksi kannattaa katsoa, mitä bottien omistajat itse dokumentoivat syyskuussa 2026.

OpenAI, Anthropic ja Perplexity dokumentoivat robots.txt:n, eivät llms.txt:tä

OpenAI:n bottidokumentaatio kuvaa neljä käyttäjäagenttia: GPTBot (mallien koulutus), OAI-SearchBot (ChatGPT:n haku), ChatGPT-User (käyttäjän pyynnöstä tehdyt haut) ja OAI-AdsBot. Kaikkien ohjaus tapahtuu robots.txt-tiedostolla, ja dokumentaatio sanoo, että OAI-SearchBotilta estetyt sivustot eivät näy ChatGPT:n hakuvastauksissa. Sivustojen llms.txt-tiedostojen lukemisesta ei sanota mitään.

Yksi hämmentävä yksityiskohta on syytä avata. OpenAI:n oma dokumentaatiosivusto tarjoaa llms.txt-tiedoston omasta dokumentaatiostaan, ja niin tekee myös Perplexityn kehittäjädokumentaatio. Tästä on helppo vetää väärä johtopäätös, että nämä yhtiöt “tukevat llms.txt:tä”. Ne julkaisevat tiedoston omista dokumenteistaan kehittäjien työkaluja varten. Se ei ole sama asia kuin että niiden hakubotit hakisivat tiedoston sinun sivustoltasi.

Anthropicin tukisivu kuvaa kolme bottia: ClaudeBot (mallikehitys), Claude-User (käyttäjän pyynnöstä tehdyt haut) ja Claude-SearchBot (haun laatu). Ohjaus tapahtuu robots.txt:llä, ja sivu tukee myös Crawl-delay-laajennusta. llms.txt-tiedostoa ei mainita.

Perplexityn dokumentaatio kuvaa PerplexityBotin (hakutulosten lähteet, ei koulutukseen) ja Perplexity-Userin (käyttäjän pyynnöstä, ohittaa yleensä robots.txt:n). Sivustojen llms.txt-tiedostoista ei sanota mitään.

Yhteenlaskettuna: syyskuussa 2026 yksikään näistä kolmesta ei dokumentoi lukevansa sivustojen llms.txt-tiedostoja. Se ei todista, etteivät ne lue. Se todistaa, ettei kukaan ole luvannut lukea.

Botit hakevat sivuja, eivät hakemistoja

Cloudflaren elokuun 2025 analyysin mukaan noin 80 prosenttia tekoälybottien liikenteestä on koulutusdatan keruuta, ja GPTBot ja ClaudeBot muodostivat elokuun alussa 2025 yhdessä lähes puolet kaikesta tekoälybottien indeksoinnista. Botit siis kyllä käyvät sivustoilla, paljon. Ne hakevat HTML-sivuja, koska HTML-sivut ovat se, mitä ne on rakennettu lukemaan.

Cloudflare Radar alkoi huhtikuussa 2026 seurata agenttistandardien käyttöönottoa sivustoilla ja mittaria sille, paljonko vastauksen koko pienenee, kun botille tarjotaan Markdownia HTML:n sijaan. Tämä kertoo, että ajatus koneille tarjottavasta kevyemmästä muodosta elää. Se ei kerro, että llms.txt olisi se muoto, joka voittaa. Tarkkoja käyttöönottolukuja Radarin sivulta ei saatu tätä artikkelia varten poimittua, joten niitä ei tässä esitetä.

Mitä tämä sivusto tekee: julkaisee tiedoston ja laskee

mainostoimisto.ai julkaisee sekä /llms.txt- että /llms-full.txt-tiedoston. Ei siksi, että uskoisimme niiden auttavan, vaan koska Googlen linjaus tekee kokeesta ilmaisen: tiedosto ei haittaa, ja jos joku botti sen hakee, se näkyy lokissa.

Mittaus tehdään Cloudflaren lokista. Kysymys on yksinkertainen: hakeeko yksikään tunnistettu tekoälybotti (GPTBot, OAI-SearchBot, ClaudeBot, Claude-SearchBot, PerplexityBot, Googlebot tai jokin muu) tiedoston /llms.txt, ja jos hakee, kuinka usein verrattuna tavallisiin HTML-sivuihin. Dataa ei vielä ole, koska sivusto julkaistiin 22.9.2026. Tulokset raportoidaan artikkelissa Tekoälybotit lokeissa, kun niitä on. Jos tulos on nolla hakua, sekin kerrotaan.

Rehellinen ennuste Muellerin kommentin ja bottidokumentaation perusteella: todennäköisin tulos on, että tiedostoa hakevat lähinnä SEO-työkalut ja uteliaat ihmiset, eivät tekoälyhaut. Jos ennuste on väärä, se on kiinnostavampi tulos.

Mitä suomalaisen yrityksen kannattaa tehdä sen sijaan

Jos joku tarjoaa llms.txt-tiedoston tekemistä maksullisena GEO-palveluna, kysy, mikä tekoälyhaku sen dokumentoidusti lukee. Vastausta ei ole.

Aika kannattaa käyttää siihen, mikä dokumentoidusti vaikuttaa. Sivun pitää olla indeksoitu ja katkelmakelpoinen, eli robots.txt ei saa estää OAI-SearchBotia, Claude-SearchBotia tai PerplexityBotia, jos haluaa näkyä niiden vastauksissa. Sisällön pitää vastata kysymykseen ensimmäisessä kappaleessa, koska sitä kohtaa mallit lainaavat. Ja sivuston pitää toimia ilman JavaScriptiä, koska Googlen JavaScript-ohjeen sanoin kaikki botit eivät osaa ajaa sitä. Nämä ovat samat asiat kuin hakukoneoptimoinnissa aina, ja siitä lisää artikkelissa Skeema-merkinnät, jotka kannattaa tehdä.

llms.txt:n voi tehdä kymmenessä minuutissa, jos haluaa. Sen tekemättä jättämisestä ei menetä mitään, mistä kukaan olisi vielä esittänyt näyttöä.

Kysymyksiä, joita tästä haetaan

Lukeeko ChatGPT llms.txt-tiedostoa?

OpenAI ei ole dokumentoinut, että sen botit hakisivat sivustojen llms.txt-tiedostoja. Bottien ohjaus tapahtuu robots.txt-tiedostolla. OpenAI julkaisee llms.txt:n omasta kehittäjädokumentaatiostaan, mutta se on eri asia kuin tiedoston lukeminen muilta sivustoilta.

Haittaako llms.txt Google-näkyvyyttä?

Ei. Googlen kesäkuun 2026 dokumentaatiopäivityksen mukaan tiedosto ei vaikuta näkyvyyteen tai sijoituksiin kumpaankaan suuntaan, koska Google-haku ohittaa sen.

Mitä llms.txt-tiedostoon kirjoitetaan?

Ehdotuksen mukaan Markdown-tiedosto sivuston juureen: H1-otsikko, lyhyt lainauslohko, jossa sivusto kuvataan, ja H2-otsikoiden alla linkkilistoja tärkeimpiin sivuihin kuvauksineen.

Lähteet

  1. llmstxt.org: The /llms.txt fileEhdotuksen alkuperä: Jeremy Howard, julkaistu 3.9.2024, muoto ja tarkoitus
  2. Google Search Central: Guide to optimizing for generative AI featuresEi tarvita tekoälytiedostoja, markkinointia tai Markdownia; Google-haku ohittaa ne (päivitetty 10.7.2026)
  3. Google Search Central: What's new (kesäkuu 2026)15.6.2026: llms.txt ei vaikuta näkyvyyteen positiivisesti eikä negatiivisesti
  4. John Mueller (Bluesky), 17.6.2025'FWIW no AI system currently uses llms.txt.'
  5. Search Engine Roundtable: Google Says No AI System Currently Uses LLMs.txtToissijainen lähde Muellerin jatkokommentille palvelinlokeista
  6. OpenAI: Overview of OpenAI crawlersGPTBot, OAI-SearchBot, ChatGPT-User; ohjaus robots.txt:llä
  7. Anthropic: Does Anthropic crawl data from the webClaudeBot, Claude-User, Claude-SearchBot; ohjaus robots.txt:llä, ei mainintaa llms.txt:stä
  8. Perplexity: Perplexity crawlersPerplexityBot ja Perplexity-User; ohjaus robots.txt:llä
  9. Cloudflare Blog: A deeper look at AI crawlersNoin 80 % tekoälybottien liikenteestä on koulutusta; GPTBot ja ClaudeBot lähes puolet (elokuu 2025)
  10. Cloudflare changelog: AI Insights updates on Cloudflare RadarRadar seuraa agenttistandardien käyttöönottoa (17.4.2026)

Löysitkö virheen?

Tämän tekstin kirjoitti kone ja toinen kone tarkisti faktat. Ihminen ei ole lukenut jokaista tekstiä. Jos jokin on väärin, kerro — ilmoitus menee Ilkka Immoselle, korjaus tehdään ja se merkitään tähän tekstiin näkyviin.

Sama menetelmä on myytävänä.

Jos löysit tänne hakukoneen tai tekoälyn kautta, näit jo tuloksen. Cosmic Thing tekee saman sinun yrityksellesi: verkkosivut, joista näet vaihtoehdot ennen buildia, ja sisältökoneen, joka tarkistaa omat faktansa ja kertoo sen lukijalle.

Pyydä tarjousKuka tämän takana on