Dla małej firmy usługowej najpierw trzeba zapewnić dostępność strony, poprawnie skonfigurować robots.txt i opublikować mapę strony XML. Dopiero później warto dodać llms.txt jako eksperymentalny opis najważniejszych treści dla kompatybilnych systemów AI. Ten plik nie otwiera ani nie blokuje dostępu i nie gwarantuje cytowania firmy w odpowiedziach.
Trzy pliki, trzy różne funkcje
Te trzy pliki rozwiązują różne problemy. robots.txt określa, które ścieżki mogą być odwiedzane przez wskazane roboty. Google pobiera i analizuje go przed crawlowaniem witryny, dlatego błędna reguła może ograniczyć dostęp do ważnych zasobów.
Więcej na ten temat: Pozycjonowanie stron
Mapa strony XML wskazuje wyszukiwarkom istotne adresy URL i pomaga priorytetyzować ich crawlowanie. Jest jednak wskazówką, a nie poleceniem gwarantującym pobranie lub indeksację każdej strony.
llms.txt to otwarta propozycja opisana przez projekt llmstxt.org. W formacie Markdown porządkuje opis firmy i linki do najważniejszych materiałów, aby kompatybilne narzędzia AI mogły łatwiej zrozumieć strukturę oferty. Google Search Central opisuje robots.txt i mapy XML w dokumentacji z 2026 roku, natomiast llmstxt.org przedstawia llms.txt jako projekt rozwijany społecznościowo.
Robots.txt a AI
Robots.txt a AI to temat często upraszczany do pytania: „czy jeden wpis zablokuje ChatGPT albo Google AI?”. Nie. Plik steruje możliwością crawlowania ścieżek przez zgodne roboty, ale nie jest gwarancją widoczności ani niewidoczności firmy w odpowiedziach AI.
Prawidłowy adres pliku to https://domena.pl/robots.txt. Musi on znajdować się w katalogu głównym hosta. Plik umieszczony pod adresem /uslugi/robots.txt nie będzie robots.txt dla całej witryny. Google Search Central wskazuje również limit 500 KiB: po jego przekroczeniu dalsza część treści jest przez Google ignorowana.
Robots.txt nie służy do pewnego usuwania strony z indeksu. Zablokowany adres może nadal pojawić się w indeksie jako sam URL, bez pobranej treści i fragmentu. Do kontroli indeksowania należy stosować między innymi noindex albo ograniczenie dostępu przez logowanie.
Reguły robots.txt są wskazówką dla zgodnych robotów, a nie zabezpieczeniem poufnych danych; treści wymagające ochrony należy zabezpieczyć kontrolą dostępu, uwierzytelnianiem lub innym mechanizmem po stronie serwera.
Mapa strony XML
Mapa strony XML powinna zawierać adresy, które firma rzeczywiście chce rozwijać w wyszukiwarce: stronę główną, aktualne podstrony usług, lokalizacje i wartościowe materiały. Warto umieszczać w niej kanoniczne adresy URL zgodne z zasadami indeksowania.
Pojedyncza mapa może mieć 50 MB bez kompresji lub 50 000 adresów URL. Jeśli serwis przekroczy którykolwiek z tych limitów, należy podzielić mapę na kilka plików i opcjonalnie użyć indeksu map.
| Plik | Zweryfikowany limit | Praktyczne znaczenie dla małej firmy |
|---|---|---|
| robots.txt | 500 KiB | Po przekroczeniu tej wielkości treść znajdująca się dalej w pliku jest ignorowana przez Google; typowa strona usługowa nie powinna zbliżać się do tego limitu. |
| Pojedyncza mapa XML | 50 MB bez kompresji lub 50 000 adresów URL | Jeśli serwis przekroczy którykolwiek limit, należy podzielić mapę na kilka plików i opcjonalnie użyć indeksu map. |
| llms.txt | Brak liczbowego limitu określonego na stronie propozycji | Warto utrzymywać plik krótki i selektywny: opis firmy oraz linki do najważniejszych usług, lokalizacji, kontaktu i wiarygodnych materiałów. |
Limity dotyczą odpowiednio specyfikacji Google dla robots.txt i map witryn; brak limitu dla llms.txt nie oznacza, że każdy system AI musi ten plik odczytywać.
Google Search Central w dokumentacji „Build and Submit a Sitemap” z 2026 roku podkreśla, że mapa pomaga odkrywać adresy, ale nie gwarantuje ich pobrania ani indeksacji. Adres nadal musi być dostępny, możliwy do wyrenderowania, wartościowy i zgodny z zasadami indeksowania.
Gdzie mieści się llms.txt
llms.txt ma porządkować najważniejsze zasoby witryny w Markdown. Dla firmy usługowej powinien zawierać zwięzły opis działalności oraz linki do kluczowych usług, obsługiwanych lokalizacji, kontaktu i wiarygodnych materiałów. Selektywność jest ważniejsza niż kopiowanie całej witryny.
Projekt The /llms.txt file, v2 opisuje ten format jako otwartą propozycję, a nie egzekwowany standard dostępu. Publikacja pliku nie zastępuje robots.txt, nie zmienia uprawnień robota i nie nakazuje systemowi AI pobrania wskazanych stron.
Nie ma też gwarancji, że firma pojawi się w ChatGPT lub Google AI, zostanie zacytowana albo uzyska wyższą widoczność. System, który obsługuje llms.txt, może potraktować go jako pomocny katalog, ale sama obecność pliku nie zapewnia odczytania ani wykorzystania treści.
Minimum wdrożeniowe dla lokalnej firmy usługowej
W praktyce SEO techniczne dla lokalnej firmy warto układać w kolejności, która najpierw usuwa podstawowe blokady, a dopiero potem dodaje eksperymentalne formaty. Google Search Central w 2026 roku zaleca sprawdzanie, czy strona jest prawidłowo renderowana i dostępna dla wyszukiwarki.
- Sprawdź dostępność strony przez HTTPS oraz podstawowego HTML, w tym kluczowych treści i linków.
- Zweryfikuj robots.txt w katalogu głównym hosta; usuń reguły blokujące ważne podstrony, arkusze stylów lub skrypty potrzebne do renderowania.
- Wygeneruj mapę XML z kanonicznymi adresami i dodaj ją do Google Search Console.
- Dopiero po tych krokach przygotuj krótki llms.txt z opisem firmy oraz selektywnym zestawem linków.
Lokalne treści i sygnały nie zastępują zapewnienia dostępności oraz prawidłowego renderowania strony.
Szybka kontrola dostępności
Kontrolę zacznij od 4 adresów: strony głównej, /robots.txt, mapy XML oraz /llms.txt. Sprawdź cztery adresy: stronę główną, /robots.txt, mapę XML i /llms.txt, a następnie użyj URL Inspection dla kluczowej strony.
Następnie otwórz w Google Search Console narzędzie URL Inspection dla najważniejszej podstrony usługi. Google wskazuje, że pozwala ono sprawdzić, jak wyszukiwarka widzi wersję na żywo. Jeśli ważne zasoby są zablokowane, strona może nie zostać prawidłowo zcrawlowna lub wyrenderowana.
Wynik kontroli powinien rozdzielać trzy kwestie: możliwość odwiedzenia adresu przez robota, obecność adresu w mapie XML oraz faktyczną możliwość indeksowania. llms.txt sprawdza się osobno, ponieważ jego obsługa zależy od konkretnego systemu AI.
Najczęstsze pytania
Czy llms.txt sprawi, że firma pojawi się w ChatGPT lub Google AI?
Nie ma takiej gwarancji. Plik może ułatwić interpretację treści systemowi, który go obsługuje, ale sama publikacja nie zapewnia odczytania, cytowania ani wyższej widoczności.
Czy można zablokować roboty AI przez llms.txt?
Nie. Do reguł dostępu służy robots.txt lub inne mechanizmy kontroli dostępu. llms.txt jest opisem i uporządkowanym zestawem linków, a nie zaporą.
Co wdrożyć najpierw na stronie małej firmy?
Najpierw usuń blokady crawlowania, sprawdź poprawność robots.txt, wygeneruj mapę XML z kanonicznymi adresami i dodaj ją do Search Console. llms.txt traktuj jako uzupełnienie, nie fundament SEO technicznego.
Czy wpisanie adresu do mapy XML gwarantuje indeksację?
Nie. Google określa mapę jako wskazówkę. Adres musi być również dostępny, wartościowy, możliwy do wyrenderowania i zgodny z zasadami indeksowania.
Źródła
- How Google Interprets the robots.txt Specification — Google Search Central, 2026, robots.txt specification
- Build and Submit a Sitemap — Google Search Central, 2026, sitemap documentation
- Technical SEO Techniques and Strategies — Google Search Central, 2026, technical SEO guidance
- The /llms.txt file, v2 — llmstxt.org, 2026, open community proposal


