Przejdź do treści
Waseit
← Wszystkie artykuły
AEOGEO

1227 zapytań do llms.txt, zero robotów AI: nie ma żadnego pliku do położenia

Roboty AI zabierają tysiące stron za każdego odesłanego odwiedzającego, a plik, który miał do nich mówić, nie jest czytany przez żadnego z nich. Co pokazują opublikowane pomiary.

0 z 1227

zapytań do llms.txt pochodzących od robota wielkich laboratoriów, w badaniu logów serwera

3 września 20269 min czytania
W tym artykule
  1. Wymiana jest niesymetryczna i daje się policzyć
  2. Plik, którego nikt nie czyta
  3. Co mówi Google, oficjalnie
  4. Dlaczego nie ma żadnego pliku do położenia
  5. Co to zmienia

Krótka odpowiedź: widoczności w odpowiedziach AI nie da się skonfigurować. Mówią to razem dwa pomiary. Z jednej strony roboty wielkich modeli zabierają setki do tysięcy stron za każdego odwiedzającego, którego odsyłają. Z drugiej plik llms.txt, który branża zaczęła kłaść w katalogu głównym stron, nie jest pobierany przez żadnego zweryfikowanego robota wielkich laboratoriów, a Google oświadcza, że go ignoruje. Nie ma tylnych drzwi: rozstrzyga się w korpusie.

3389 : 1

stron zabieranych przez robota Mistrala na jednego odesłanego odwiedzającego (Cloudflare Radar, lipiec 2026)

żadnej

mierzalnej korelacji między publikowaniem llms.txt a byciem cytowanym, na około 300 000 domen

Nie ma pliku, który kładzie się w katalogu głównym, żeby istnieć w odpowiedzi AI. Widoczność zdobywa się w korpusie, nie deklaruje.

Wymiana jest niesymetryczna i daje się policzyć

Cloudflare publikuje wskaźnik prosty i brutalny: stosunek liczby stron, które platforma AI przychodzi przeczytać na witrynie, do liczby odwiedzających, których jej odsyła. Definicja jest mechaniczna. Liczy się zapytania HTML pochodzące od agentów platformy i dzieli przez zapytania HTML, których nagłówek odsyłający nosi nazwę tej platformy.

Strony przeczytane na jednego odesłanego odwiedzającego, odczyt z Cloudflare Radar, okno 28 dni zamknięte 21 lipca 2026. Stosunek czyta się jak migawkę: zmienia się szybko.
PlatformaStrony zabrane na odesłanego odwiedzającego
Mistral3389 : 1
Anthropic2237 : 1
OpenAI (GPTBot)217 : 1
DuckDuckGo2,5 : 1

Rząd wielkości liczy się bardziej niż miejsce po przecinku, a zmienił się mocno w 2026: stosunek Anthropic liczono w dziesiątkach tysięcy w pierwszym kwartale, zanim spadł do kilku tysięcy latem. Kierunek jest właściwy, nierównowaga pozostaje pełna. Dla witryny znaczy to, że czytanie przez maszyny jest już normą, podczas gdy ludzka wizyta, która za nie płaciła, staje się wyjątkiem.

Uściślenie, które podaje sama Cloudflare, a które przedruki często pomijają: ruch odsyłany przez natywną aplikację Claude nie niesie nagłówka odsyłającego. Te odesłania są więc niewidoczne w mianowniku, a Cloudflare pisze, że jej stosunki mogą zawyżać nierównowagę, nie mogąc powiedzieć o ile. Sens ustalenia się trzyma; jego dokładność nie.

Plik, którego nikt nie czyta

Wobec tej nierównowagi branża zaproponowała prostą odpowiedź: llms.txt, plik położony w katalogu głównym witryny, by powiedzieć modelom, co czytać i jak. Pomysł jest kuszący. Ma jedną wadę: roboty go nie pobierają.

Badanie logów serwera prowadzone od września 2025 do kwietnia 2026 na około 900 domenach odnotowało 1227 zapytań do tych plików i ani jednego od zweryfikowanego robota wielkich laboratoriów - ani GPTBot, ani ClaudeBot, ani PerplexityBot, ani Google-Extended. Pytającymi byli komercyjny agregator danych z 794 zapytaniami, czyli 64,7%, oraz ludzkie przeglądarki z 392, czyli 31,9%. Innymi słowy: plik czytają ci, którzy sprzedają narzędzia wokół niego, oraz ciekawscy.

Wskaźnik przyjęcia z kolei zależy całkowicie od tego, na kogo się patrzy, i dlatego czyta się wszystko i jego przeciwieństwo.

Przyjęcie llms.txt zależnie od próby. Ten sam obiekt zmierzony na czterech populacjach daje cztery odpowiedzi: przytoczenie tylko jednej z tych liczb wprowadza w błąd.
Zmierzona próbaPrzyjęcie
Panel 218 hostów zorientowanych na programistów (sierpień 2026)51,8%
Top 1000 Tranco, osiągalne korzenie (czerwiec 2026)15,8%
Około 300 000 domen (listopad 2025)10,13%
Top 1000 Tranco, całość (czerwiec 2026)8,7%

A w kwestii, która rozstrzyga o wszystkim, badanie korelacji przeprowadzone na około 300 000 domen nie znajduje żadnego mierzalnego związku między publikowaniem tego pliku a byciem cytowanym przez modele. Usunięcie zmiennej wręcz poprawiało trafność modelu statystycznego, co jest uprzejmym sposobem powiedzenia, że wnosiła szum.

Co mówi Google, oficjalnie

Stanowisko nie jest dwuznaczne. Dokumentacja Google, zaktualizowana w czerwcu 2026, wskazuje, że plik nie ma żadnego wpływu, ani pozytywnego, ani negatywnego, na pozycję w wyszukiwarce ani w AI Overviews, i że wyszukiwarka po prostu go ignoruje. Zespół Chrome ze swojej strony dodał w maju 2026 kontrolę llms.txt do Lighthouse, ale umieszczoną w audytach przeglądania agentowego, a nie w audytach SEO, i zgłasza ona tylko błąd serwera, nigdy brak pliku.

To umiejscowienie mówi wiele: plik traktuje się jako obiekt przeznaczony dla agentów przemierzających sieć w imieniu użytkownika, nie jako sygnał pozycjonujący. Położenie go kosztuje prawie nic i nie szkodzi. Po prostu nie należy oczekiwać po nim widoczności.

Dlaczego nie ma żadnego pliku do położenia

Oba pomiary odpowiadają sobie nawzajem. Modele czytają masowo otwartą sieć, w tym Twoje strony, i robią to, nie przechodząc przez żadne drzwi, które byś otworzył. To, co zapamiętują o Tobie, nie pochodzi więc z deklaracji złożonej w katalogu głównym Twojej domeny, lecz z tego, co mówi się o Tobie w korpusie, którego nie kontrolujesz.

To dokładne przedłużenie tego, co pokazuje porównanie silników: nie czytają tych samych źródeł, a mimo to zgadzają się znacznie bardziej co do nazw, które polecają. Plik konfiguracyjny nic na to nie poradzi, ani w jedną, ani w drugą stronę. Waży spójność tego, co o Tobie napisane, wszędzie, oraz możliwość przypisania tego przez maszynę.

  • Stosunek pobrań to migawka, nie stała.

    Liczby Cloudflare zmieniają się z miesiąca na miesiąc i spadły o rząd wielkości w ciągu 2026. Porównywanie odczytu z lipca z odczytem z marca nie ma sensu, a my sami ich nie mierzyliśmy.

  • Cloudflare ostrzega, że jej własne stosunki mogą zawyżać nierównowagę.

    Odesłania z natywnej aplikacji Claude nie wysyłają nagłówka odsyłającego i brakuje ich w mianowniku. Firma to mówi i zaznacza, że nie zna skali obciążenia: przekazujemy ostrzeżenie razem z liczbą.

  • Badanie logów serwera jest małe.

    1227 zapytań na około 900 domenach: wystarczy, by stwierdzić, że nie pojawia się tam żaden robot wielkich laboratoriów, nie wystarczy, by twierdzić, że żaden nigdy się nie pojawi, ani by mówić w imieniu całej sieci.

  • Wskaźniki przyjęcia nie są ze sobą porównywalne.

    Od 8,7% do 51,8% zależnie od próby, dla tego samego obiektu: różnica tkwi w obserwowanej populacji, nie w zmianie w czasie. Artykuł przytaczający tylko jeden z nich, bez wskazania który, niczego nie uczy.

Co to zmienia

Nie licz na plik.

Położenie llms.txt jest tanie i nieszkodliwe, ale żaden opublikowany pomiar nie wiąże go z cytowaniem. To nie dźwignia widoczności, co najwyżej uprzejmość wobec agentów, którzy jeszcze nie istnieją.

Czytaj własne logi.

Jedno zapytanie powie Ci, które roboty przychodzą na Twoją witrynę, jak często i o co proszą. To jedyna dana z tej sprawy, którą możesz wytworzyć sam, i jest warta więcej niż światowa średnia.

Zdecyduj, co pozwalasz zabrać.

Stosunek między przeczytanymi stronami a odesłanymi odwiedzającymi to negocjacja, nie los. Dopuszczenie, spowolnienie lub zablokowanie agenta to decyzja handlowa, która należy do Ciebie, podejmowana robot po robocie.

Mierz cytowanie, nie zgodność.

Odhaczenie technicznych rubryk nic nie mówi o Twojej obecności w odpowiedzi. Użyteczne pytanie pozostaje: czy Twoja nazwa pada, w którym silniku i obok kogo.

Najczęstsze pytania

Czy mimo wszystko publikować plik llms.txt?
Możesz, nie szkodzi, a koszt jest bliski zeru. Ale żaden opublikowany pomiar nie wykazuje wpływu na cytowanie: badanie obejmujące około 300 000 domen nie znajduje związku, a Google od czerwca 2026 wskazuje, że plik nie ma wpływu na pozycję ani na AI Overviews. Opublikuj go, jeśli chcesz udokumentować witrynę dla przyszłych agentów, a nie po to, by zyskać widoczność.
Czy powinienem blokować roboty AI?
To decyzja handlowa, nie techniczna, i podejmuje się ją robot po robocie. Opublikowane stosunki pokazują znaczne różnice między platformami, od kilku tysięcy stron zabranych na odesłanego odwiedzającego do wartości bliskiej równowadze. Blokowanie chroni Twoje strony, ale usuwa Cię też z odpowiedzi, w których zostaną Twoi konkurenci. Najpierw spójrz w logi, potem rozstrzygaj źródło po źródle.
Jeśli plik nic nie daje, co działa?
Pomiary wskazują na spójność tego, co mówi się o Tobie tam, gdzie silniki naprawdę czytają, oraz na możliwość przypisania twierdzenia do źródła przez maszynę. Dźwignie sprawdzone w badaniach nad optymalizacją dla silników generatywnych są redakcyjne: cytować źródła, przytaczać wypowiedzi, podawać liczby, pisać jasno. Nic, co kładzie się w katalogu głównym domeny.