← Nazad na blog

llms.txt i AI crawleri: kako da upravljate pristupom botova

28. 7. 2026.

Godinama je jedini bot o kome ste morali da razmišljate bio Googlebot. Danas vaš sajt posećuje čitava nova grupa: GPTBot (OpenAI), ClaudeBot (Anthropic), Google-Extended, PerplexityBot i drugi. Ovi AI crawleri prikupljaju sadržaj za treniranje jezičkih modela i za odgovore u AI asistentima. Postavlja se praktično pitanje: da li da im dozvolite pristup, i kako uopšte da kontrolišete šta rade?

Šta je llms.txt

llms.txt je predlog standarda — tekstualni fajl u korenu domena (example.com/llms.txt) koji AI sistemima daje kratak, čist pregled najvažnijeg sadržaja vašeg sajta u Markdown formatu. Ideja je slična sitemap-u, ali umesto za pretraživače, namenjen je jezičkim modelima: umesto da model gata kroz HTML pun menija i reklama, dobija uredan spisak ključnih stranica i njihovih opisa. Bitno je razumeti da je llms.txt tek u ranoj fazi usvajanja i da ga još ne poštuju svi akteri.

llms.txt nije isto što i kontrola pristupa

Ovo je najčešća zabuna. llms.txt pomaže AI sistemu da bolje razume vaš sadržaj, ali NE zabranjuje pristup. Ako želite da nekom botu zabranite obilazak, to i dalje radite kroz robots.txt, jednako kao za Googlebot. Na primer, možete dodati pravila za User-agent: GPTBot i User-agent: ClaudeBot sa Disallow direktivama. Razlika u odnosu na klasične botove objašnjena je u našem tekstu robots meta tag vs robots.txt, a principi se prenose i na AI crawlere.

  • Hoću da AI bolje razume moj sadržaj → dodajte llms.txt.
  • Hoću da zabranim treniranje na mom sadržaju → Disallow za konkretne AI botove u robots.txt.
  • Hoću da se pojavljujem u AI odgovorima ali ne u treningu → pažljivo razdvojite botove; neki razdvajaju treniranje od prikaza.

Da li da ih pustite

Odgovor zavisi od vašeg modela. Ako živite od saobraćaja i pregleda reklama, možete strahovati da će AI asistent dati odgovor bez posete vašem sajtu. Sa druge strane, mnogi AI odgovori navode izvor i linkuju nazad, pa blokiranje može značiti da vas u toj novoj vrsti pretrage uopšte nema. Sve više vlasnika sajtova bira srednji put: puštaju botove koji citiraju izvor, a blokiraju one koji sadržaj koriste samo za trening. Ovo je usko povezano sa širom temom optimizacije za AI pretragu, o čemu pišemo u tekstu optimizacija crawl budžeta jer i AI botovi troše resurse vašeg servera.

Uticaj na server i hosting

AI crawleri umeju da budu agresivni — neki šalju hiljade zahteva dnevno. Na slabom hostingu to podiže opterećenje i usporava sajt za prave posetioce. Zato su brz server, keširanje i CDN koji apsorbuje deo saobraćaja praktična zaštita. Ako želite okruženje koje bez problema podnosi i klasične i AI botove, pogledajte naše SEO hosting planove sa globalnim CDN-om i pakete i cene. Osnove pravilne mape sajta koja pomaže i pretraživačima i AI sistemima pokrivamo u tekstu sitemap.xml i robots.txt.

Praktičan zaključak

Za 2026. razuman pristup je: dodajte llms.txt sa spiskom ključnih stranica, jasno odlučite koje AI botove puštate i to sprovedite kroz robots.txt, i pratite u logovima servera ko vas zapravo obilazi. Standard će se menjati, ali princip ostaje isti — vi odlučujete ko i kako koristi vaš sadržaj.

100% GARANCIJA30 dana povraćaj novca

30 dana povraćaj novca

Bez pitanja. Ako niste zadovoljni, vraćamo ceo iznos.