Technikai / Technical

llms.txt útmutató: mi az, és kell-e a weboldaladra?

2026. július 4. Daniel Dexuro 10 perces olvasás Read in English →

Az elmúlt egy-két évben egyre gyakrabban bukkan fel egy új fájlnév a technikai SEO- és GEO-cikkekben: llms.txt. A neve a robots.txt-re hajaz, ezért sokan az AI-változatának gondolják — pedig a két fájl egészen más problémát old meg. Ebben a cikkben megnézzük, mi pontosan az llms.txt, honnan ered, miben különbözik a robots.txt-től és a sitemaptől, hogyan épül fel egy valódi llms.txt fájl, és — a legfontosabb kérdés — tényleg számít-e ma, hogy van-e a weboldaladon.

Mi az az llms.txt és ki találta ki?

Az llms.txt egy egyszerű, Markdown-formátumú szöveges fájl, amelyet a weboldal gyökerében helyezel el (például pelda.hu/llms.txt). Célja, hogy egy rövid, egyszerre gépi és emberi olvasásra alkalmas térképet adjon a nagy nyelvi modelleknek (LLM-eknek) és az AI-ügynököknek arról, hol találják a weboldal legfontosabb tartalmait — anélkül, hogy végig kellene böngészniük a teljes oldalstruktúrát.

A formátumot Jeremy Howard, a fast.ai és az Answer.AI társalapítója javasolta 2024 szeptemberében, és publikálta az llmstxt.org oldalon. Az ötlet mögötti logika egyszerű: egy LLM kontextusablaka véges, a weboldalak HTML-je viszont tele van navigációval, reklámmal és scripttel, ami feleslegesen tölti meg ezt a kontextust. Egy tiszta, Markdown-alapú fájl sokkal hatékonyabban feldolgozható egy modell számára, mint a nyers HTML. Nem hivatalos W3C- vagy IETF-szabvány — egy önkéntes, gyorsan terjedő közösségi konvenció.

Miben más, mint a robots.txt és a sitemap?

Fontos tisztázni: az llms.txt nem hozzáférés-szabályozó, és nem is oldaltérkép — teljesen más réteget céloz, mint a robots.txt vagy a sitemap.xml.

  • robots.txt: megmondja a crawlereknek, mely útvonalakra léphetnek be, és melyekre nem. Hozzáférési szabály.
  • sitemap.xml: felsorolja az oldal összes indexelendő URL-jét, gépi feldolgozásra optimalizált XML-ben. Teljességre törekvő oldaltérkép.
  • llms.txt: nem szabályoz hozzáférést, és nem törekszik teljességre. Egy szerkesztett, emberi döntés alapján összeállított rövid lista azokról az oldalakról, amelyeket a tulajdonos a legfontosabbnak tart egy AI-ügynök számára — kontextussűrítve, Markdown-linkek formájában.

Más szóval: a robots.txt tiltásra és engedélyre, a sitemap teljességre, az llms.txt pedig prioritásra és kontextusra való. Ha a robots.txt AI-crawlerekkel kapcsolatos beállításait még nem nézted át, érdemes elolvasnod a robots.txt és AI crawlerek útmutatónkat is.

Hogyan épül fel egy valódi llms.txt?

A specifikáció szerint az llms.txt fix szerkezetű Markdown-fájl: egy H1-es címsor a projekt vagy cég nevével, ezt követi egy blockquote-ban egy rövid, egy-két mondatos összefoglaló, majd opcionálisan további szabad szöveg, végül egy vagy több H2-es szekció, amely alatt Markdown-linklisták sorolják fel a legfontosabb oldalakat, rövid leírással. Egy leegyszerűsített, annotált példa:

# Példa Kft.

> B2B szoftvercég, amely számlázási automatizálást épít KKV-knak.

Ez a fájl a legfontosabb oldalainkat sorolja fel LLM-ek és AI-ügynökök számára.

## Docs

- [API dokumentáció](https://pelda.hu/docs/api): a REST API teljes referenciája
- [Gyors indulás](https://pelda.hu/docs/quickstart): telepítés és első lépések

## Blog

- [Árazási útmutató](https://pelda.hu/blog/arazas): hogyan válaszd ki a csomagodat

## Optional

- [Változásnapló](https://pelda.hu/changelog): kevésbé kritikus, de hasznos kiegészítő

A „## Optional" szekció egy külön konvenció része: azokat a linkeket tartalmazza, amelyeket egy korlátozott kontextusablakkal dolgozó AI-ügynök nyugodtan kihagyhat, ha kevés a rendelkezésre álló hely. Sok llms.txt fájlhoz tartozik egy testvérfájl is, az llms-full.txt — ez nem linkeket ad, hanem a teljes tartalmat egyetlen összefésült Markdown-dokumentumban, azoknak az ügynököknek, amelyek elég nagy kontextusablakkal rendelkeznek ahhoz, hogy egyben dolgozzák fel.

Hogyan készítsd el a sajátod lépésről lépésre

  1. Válogasd össze a legfontosabb oldalakat. Ne az összes URL-t sorold fel — csak azt a 15–30 oldalt, amelyet egy AI-ügynöknek elsőként érdemes látnia (dokumentáció, kulcsfontosságú termékoldalak, legjobb blogbejegyzések).
  2. Csoportosítsd logikus H2 szekciókba. Docs, Blog, Termékek, API — amilyen tagolás a saját oldaladon értelmes.
  3. Írj rövid, konkrét leírást minden linkhez. Egy mondat elég; a lényeg, hogy a modell a link megnyitása nélkül is tudja, mire számítson.
  4. A kevésbé kritikus linkeket tedd a „## Optional" szekcióba. Így a korlátozott kontextusú ügynökök is helyesen priorizálnak.
  5. Töltsd fel a domain gyökerébe egyszerű, sima szöveges .txt fájlként — nem HTML, nem PDF.
  6. Ellenőrizd, hogy a robots.txt nem tiltja a fájl elérését, és hogy a fájl a böngészőből is simán megnyílik (pelda.hu/llms.txt).

Mennyit számít ma valójában az llms.txt?

Az őszinte válasz: még korai szakaszban van. Az llms.txt nem hivatalos webszabvány, és egyetlen nagy AI-szolgáltató sem erősítette meg nyilvánosan, hogy a crawlerei — a GPTBot, a ClaudeBot vagy a PerplexityBot — szisztematikusan keresik és priorizálják az llms.txt fájlt ugyanúgy, ahogyan a robots.txt-et tiszteletben tartják. Az elterjedtsége főleg a fejlesztői és dokumentációs ökoszisztémában nőtt: több dokumentáció-generáló eszköz alapból elkészíti az llms.txt fájlt az általa épített oldalakhoz, és néhány agentikus fejlesztői eszköz aktívan beolvassa, ha talál egyet.

Ez nem jelenti azt, hogy értéktelen. Egy jól megírt llms.txt gyakorlatilag ingyenes: fél óra munka, nem árt semmilyen más rendszernek, és felkészíti az oldaladat egy olyan jövőre, amelyben az AI-ügynökök egyre inkább közvetlenül fogyasztják a weboldalak tartalmát. De ha most kell választanod, hova fekteted az idődet, egy strukturált, közvetlen válaszokat adó tartalom, a helyes schema.org jelölés, és az AI-crawlerek robots.txt-beli helyes kezelése ma nagyobb hatással van az AI-citációkra, mint önmagában az llms.txt megléte. Az llms.txt kiegészítő eszköz, nem helyettesítő.

Érdemes azt is szem előtt tartani, hogy az llms.txt támogatottsága nem egyenletes az AI-szolgáltatók között, és jelenleg nincs nyilvánosan dokumentált, megbízható módszer annak ellenőrzésére, hogy egy adott AI-motor ténylegesen beolvasta-e a fájlodat egy adott kérés megválaszolásakor — más szóval a hatását nehéz elkülönítve mérni. Ez élesen elüt a robots.txt-től, amelynek betartását a legtöbb komoly crawler naplózható módon, a szerver access logjaiban is visszaigazolja. Ha tehát valaki azt állítja, hogy pontosan tudja, mekkora citációs emelkedést hozott önmagában egy llms.txt fájl, azt egészséges fenntartással érdemes kezelni — ilyen mérést ma senki nem tud megbízhatóan elvégezni.

A gyakorlati tanács ezért egyszerű: tekints az llms.txt-re úgy, mint egy jó gyakorlatra a szélesebb GEO-eszköztárban, nem pedig önálló megoldásra. Készítsd el, tartsd frissen, amikor jelentősen bővül az oldalad, de a fő energiádat a tartalom minőségébe, a strukturált adatokba és a mérhető citációs mutatókba fektesd.

Gyakran ismételt kérdések

Nem — nincs technikai vagy jogi előírás, amely megkövetelné. Az llms.txt nem hivatalos webszabvány, hanem egy önkéntes iparági konvenció. Elkészítése ugyanakkor alacsony ráfordítású, és nem árt, ha a támogatottsága a jövőben bővül.

A domain gyökerébe, pontosan úgy, mint a robots.txt-et: pelda.hu/llms.txt. Almappában vagy aldomainen elhelyezett verziók nem felelnek meg a specifikációnak, és az AI-ügynökök nem fogják megtalálni őket.

Az llms.txt egy rövid, linkekből álló navigációs fájl, amely csak a legfontosabb oldalakra mutat, rövid leírással. Az llms-full.txt ezzel szemben a teljes tartalmat egyetlen összefésült Markdown-dokumentumban adja át — azoknak az AI-ügynököknek készül, amelyeknek elég nagy a kontextusablakuk ahhoz, hogy egyben dolgozzák fel.

Ingyenes audit

Készen állsz, hogy az AI téged idézzen?

Kérj ingyenes AI hivatkozási auditot — 24 órán belül megmutatjuk, hol tart most a márkád.

Ingyenes audit kérése
Get a Free Audit