CodeKitHub
Webmester eszközök

Robots.txt generátor

Utolsó frissítés:

Készíts érvényes robots.txt fájlt másodpercek alatt: indulj ki egy előre beállított sablonból (engedélyezz mindent, tilts mindent, vagy kifejezetten tiltsd le az AI tanítási robotokat, miközben a Google/Bing indexelést engedélyezed), add hozzá saját tiltott útvonalaidat és sitemap URL-edet, majd másold ki vagy töltsd le a fájlt.

Download robots.txt

Mi ez az eszköz?

A robots.txt egy egyszerű szöveges fájl a weboldalad gyökerében, amely megmondja a keresőrobotoknak, mely részekhez férhetnek vagy nem férhetnek hozzá. A Google és a Bing tiszteletben tartja indexeléshez; 2026-ban ez a szabványos módja annak is, hogy az oldalak kizárják tartalmukat az AI-modellek tanításából, konkrét bot nevek, például a GPTBot, a CCBot és a Google-Extended révén.

A szintaxis pontos betartása fontos — egy hibás Disallow útvonal véletlenül kizárhatja a keresőmotorokat az egész oldaladról, vagy egy rosszul elhelyezett AI-tiltó szabály nem tilt le valójában semmit. Ez a generátor minden forgatókönyvhöz szintaktikailag helyes kimenetet ad.

Közel három évtizednyi informális konvenció után, amely 1994-ig nyúlik vissza, a Robots Exclusion Protocol végre szabvánnyá vált mint RFC 9309 2022-ben — az e generátor által kiadott szabályok (User-agent, Disallow, Allow, plusz a Sitemap kiegészítés) ezt a specifikációt követik.

Miért érdemes használni?

  • Dedikált AI-robot-tiltó sablon, amely lefedi a GPTBot, ChatGPT-User, CCBot, Google-Extended, ClaudeBot, Bytespider és anthropic-ai robotokat — miközben kifejezetten fenntartja a keresőmotoros hozzáférést.
  • Egyedi tiltott útvonalak azokhoz a tartalmakhoz, amelyeket minden robot elől el akarsz rejteni.
  • Sitemap URL mező — egy apró kiegészítés, amely segít a keresőmotoroknak gyorsabban felfedezni az oldalaidat.
  • Mindig helyes szintaxis — nincs kockázata annak, hogy egy véletlen elgépelés kizárja az egész oldaladat.
  • Ingyenes, azonnali, töltsd le közvetlenül a fájlt, vagy másold ki a szöveget.

Használati útmutató

  1. Válassz egy sablont: engedélyezz mindent, tilts mindent, vagy csak az AI-robotokat tiltsd.
  2. Opcionálisan adj hozzá egyedi tiltott útvonalakat, soronként egyet (pl. /admin/).
  3. Opcionálisan add hozzá a sitemap URL-edet.
  4. Kattints a Másolás vagy Letöltés gombra, majd töltsd fel a fájlt az oldalad gyökerébe /robots.txt néven.

Példa

Bemenet

Sablon: AI-robotok tiltása, keresőmotorok engedélyezése. Sitemap: https://example.com/sitemap.xml

Kimenet

User-agent: GPTBot
Disallow: /

User-agent: CCBot
Disallow: /

...

User-agent: *
Allow: /

Sitemap: https://example.com/sitemap.xml

Minden AI-robot saját, explicit tiltást kap, míg a végén álló wildcard szabály nyitva tartja a normál keresőmotoros hozzáférést.

Blokkold ezt a keresőrobotot?

Nem minden bot ugyanazt a célt szolgálja — a rossz blokkolása keresési forgalmat vághat el ahelyett, hogy egyszerűen kilépnél az AI-tanításból.

KeresőrobotMit csinálBlokkold, ha…
Googlebot, BingbotIndexeli az oldaladat a keresési találatokhozSoha — ezek blokkolása teljesen kizár a Google/Bing keresésből.
GPTBot, ChatGPT-UserAz OpenAI keresőrobotjai — a GPTBot modelleket tanít, a ChatGPT-User olyan oldalakat tölt le, amelyeket egy felhasználó kért a ChatGPT-től böngészniNem akarod, hogy a tartalmadat AI-tanításra használják, de vedd figyelembe, hogy amikor a ChatGPT-User egy felhasználó által linkelt oldalt böngész, az más eset, amelyet egyes oldalak engedélyeznek.
Google-ExtendedAzt szabályozza, hogy a Google felhasználja-e a tartalmadat Gemini/AI tanításhoz — külön a Googlebot keresési indexelésétőlMaradni akarsz a Google keresésben, de kilépnél a Google AI-tanításából — ez a direktíva pontosan ezt teszi a rangsorolás sérelme nélkül.
CCBot, Bytespider, anthropic-ai, ClaudeBotCommon Crawl (sok AI-adathalmazt táplál), ByteDance, az Anthropic keresőrobotjaiUgyanaz az indoklás, mint a GPTBotnál — blokkold, ha nem akarod, hogy a tartalmad AI-tanítási adathalmazokba kerüljön.

Gyakori kérdések

Valóban megakadályozza a robots.txt, hogy az AI felhasználja a tartalmamat?

Becsületalapon működik — a megbízható AI-cégek keresőrobotjai tiszteletben tartják (ezért is léteznek a GPTBot, CCBot stb. mint különálló, dokumentált user-agentek, kifejezetten azért, hogy az oldalak kiléphessenek). Nem állítja meg azokat a robotokat, amelyek figyelmen kívül hagyják a szabványt, és nincs hatással a már korábban, a tiltás hozzáadása előtt lementett tartalomra.

Rontja az AI-robotok tiltása a Google/Bing keresési rangsoromat?

Nem — az AI-robot sablon kifejezetten csak a megnevezett AI-botokat tiltja, és egy „Allow: /” wildcard szabályt hagy meg mindenki másnak, így a Googlebot és a Bingbot nem érintett.

Hova kell tennem a robots.txt fájlt?

A domained gyökerébe, hogy pontosan a sajatdomain.hu/robots.txt címen legyen elérhető — ne egy almappába. A legtöbb webtárhely és statikus oldalgenerátor rendelkezik egy erre kijelölt public/root mappával.

Mire való a sitemap sor?

A sitemap.xml fájlodra irányítja a keresőrobotokat, amely felsorolja az összes indexelhető oldaladat. Opcionális, de általánosan ajánlott — egyetlen extra sor, amely felgyorsíthatja az új oldalak felfedezését.

Kombinálhatom az egyedi tiltott útvonalakat az AI-tiltó sablonnal?

Igen — az AI-tiltó sablon először az AI-bot tiltásokat adja hozzá, majd alkalmazza az egyedi tiltott útvonalaidat (ha vannak) az általános wildcard szabály alatt, amely továbbra is engedélyezi a keresőmotorokat.

Kapcsolódó eszközök