1227 zapytań do llms.txt, zero robotów AI: nie ma żadnego pliku do położenia
Roboty AI zabierają tysiące stron za każdego odesłanego odwiedzającego, a plik, który miał do nich mówić, nie jest czytany przez żadnego z nich. Co pokazują opublikowane pomiary.
0 z 1227
zapytań do llms.txt pochodzących od robota wielkich laboratoriów, w badaniu logów serwera
W tym artykule
Krótka odpowiedź: widoczności w odpowiedziach AI nie da się skonfigurować. Mówią to razem dwa pomiary. Z jednej strony roboty wielkich modeli zabierają setki do tysięcy stron za każdego odwiedzającego, którego odsyłają. Z drugiej plik llms.txt, który branża zaczęła kłaść w katalogu głównym stron, nie jest pobierany przez żadnego zweryfikowanego robota wielkich laboratoriów, a Google oświadcza, że go ignoruje. Nie ma tylnych drzwi: rozstrzyga się w korpusie.
3389 : 1
stron zabieranych przez robota Mistrala na jednego odesłanego odwiedzającego (Cloudflare Radar, lipiec 2026)
żadnej
mierzalnej korelacji między publikowaniem llms.txt a byciem cytowanym, na około 300 000 domen
Nie ma pliku, który kładzie się w katalogu głównym, żeby istnieć w odpowiedzi AI. Widoczność zdobywa się w korpusie, nie deklaruje.
Wymiana jest niesymetryczna i daje się policzyć
Cloudflare publikuje wskaźnik prosty i brutalny: stosunek liczby stron, które platforma AI przychodzi przeczytać na witrynie, do liczby odwiedzających, których jej odsyła. Definicja jest mechaniczna. Liczy się zapytania HTML pochodzące od agentów platformy i dzieli przez zapytania HTML, których nagłówek odsyłający nosi nazwę tej platformy.
| Platforma | Strony zabrane na odesłanego odwiedzającego |
|---|---|
| Mistral | 3389 : 1 |
| Anthropic | 2237 : 1 |
| OpenAI (GPTBot) | 217 : 1 |
| DuckDuckGo | 2,5 : 1 |
Rząd wielkości liczy się bardziej niż miejsce po przecinku, a zmienił się mocno w 2026: stosunek Anthropic liczono w dziesiątkach tysięcy w pierwszym kwartale, zanim spadł do kilku tysięcy latem. Kierunek jest właściwy, nierównowaga pozostaje pełna. Dla witryny znaczy to, że czytanie przez maszyny jest już normą, podczas gdy ludzka wizyta, która za nie płaciła, staje się wyjątkiem.
Uściślenie, które podaje sama Cloudflare, a które przedruki często pomijają: ruch odsyłany przez natywną aplikację Claude nie niesie nagłówka odsyłającego. Te odesłania są więc niewidoczne w mianowniku, a Cloudflare pisze, że jej stosunki mogą zawyżać nierównowagę, nie mogąc powiedzieć o ile. Sens ustalenia się trzyma; jego dokładność nie.
Plik, którego nikt nie czyta
Wobec tej nierównowagi branża zaproponowała prostą odpowiedź: llms.txt, plik położony w katalogu głównym witryny, by powiedzieć modelom, co czytać i jak. Pomysł jest kuszący. Ma jedną wadę: roboty go nie pobierają.
Badanie logów serwera prowadzone od września 2025 do kwietnia 2026 na około 900 domenach odnotowało 1227 zapytań do tych plików i ani jednego od zweryfikowanego robota wielkich laboratoriów - ani GPTBot, ani ClaudeBot, ani PerplexityBot, ani Google-Extended. Pytającymi byli komercyjny agregator danych z 794 zapytaniami, czyli 64,7%, oraz ludzkie przeglądarki z 392, czyli 31,9%. Innymi słowy: plik czytają ci, którzy sprzedają narzędzia wokół niego, oraz ciekawscy.
Wskaźnik przyjęcia z kolei zależy całkowicie od tego, na kogo się patrzy, i dlatego czyta się wszystko i jego przeciwieństwo.
| Zmierzona próba | Przyjęcie |
|---|---|
| Panel 218 hostów zorientowanych na programistów (sierpień 2026) | 51,8% |
| Top 1000 Tranco, osiągalne korzenie (czerwiec 2026) | 15,8% |
| Około 300 000 domen (listopad 2025) | 10,13% |
| Top 1000 Tranco, całość (czerwiec 2026) | 8,7% |
A w kwestii, która rozstrzyga o wszystkim, badanie korelacji przeprowadzone na około 300 000 domen nie znajduje żadnego mierzalnego związku między publikowaniem tego pliku a byciem cytowanym przez modele. Usunięcie zmiennej wręcz poprawiało trafność modelu statystycznego, co jest uprzejmym sposobem powiedzenia, że wnosiła szum.
Co mówi Google, oficjalnie
Stanowisko nie jest dwuznaczne. Dokumentacja Google, zaktualizowana w czerwcu 2026, wskazuje, że plik nie ma żadnego wpływu, ani pozytywnego, ani negatywnego, na pozycję w wyszukiwarce ani w AI Overviews, i że wyszukiwarka po prostu go ignoruje. Zespół Chrome ze swojej strony dodał w maju 2026 kontrolę llms.txt do Lighthouse, ale umieszczoną w audytach przeglądania agentowego, a nie w audytach SEO, i zgłasza ona tylko błąd serwera, nigdy brak pliku.
To umiejscowienie mówi wiele: plik traktuje się jako obiekt przeznaczony dla agentów przemierzających sieć w imieniu użytkownika, nie jako sygnał pozycjonujący. Położenie go kosztuje prawie nic i nie szkodzi. Po prostu nie należy oczekiwać po nim widoczności.
Dlaczego nie ma żadnego pliku do położenia
Oba pomiary odpowiadają sobie nawzajem. Modele czytają masowo otwartą sieć, w tym Twoje strony, i robią to, nie przechodząc przez żadne drzwi, które byś otworzył. To, co zapamiętują o Tobie, nie pochodzi więc z deklaracji złożonej w katalogu głównym Twojej domeny, lecz z tego, co mówi się o Tobie w korpusie, którego nie kontrolujesz.
To dokładne przedłużenie tego, co pokazuje porównanie silników: nie czytają tych samych źródeł, a mimo to zgadzają się znacznie bardziej co do nazw, które polecają. Plik konfiguracyjny nic na to nie poradzi, ani w jedną, ani w drugą stronę. Waży spójność tego, co o Tobie napisane, wszędzie, oraz możliwość przypisania tego przez maszynę.
Stosunek pobrań to migawka, nie stała.
Liczby Cloudflare zmieniają się z miesiąca na miesiąc i spadły o rząd wielkości w ciągu 2026. Porównywanie odczytu z lipca z odczytem z marca nie ma sensu, a my sami ich nie mierzyliśmy.
Cloudflare ostrzega, że jej własne stosunki mogą zawyżać nierównowagę.
Odesłania z natywnej aplikacji Claude nie wysyłają nagłówka odsyłającego i brakuje ich w mianowniku. Firma to mówi i zaznacza, że nie zna skali obciążenia: przekazujemy ostrzeżenie razem z liczbą.
Badanie logów serwera jest małe.
1227 zapytań na około 900 domenach: wystarczy, by stwierdzić, że nie pojawia się tam żaden robot wielkich laboratoriów, nie wystarczy, by twierdzić, że żaden nigdy się nie pojawi, ani by mówić w imieniu całej sieci.
Wskaźniki przyjęcia nie są ze sobą porównywalne.
Od 8,7% do 51,8% zależnie od próby, dla tego samego obiektu: różnica tkwi w obserwowanej populacji, nie w zmianie w czasie. Artykuł przytaczający tylko jeden z nich, bez wskazania który, niczego nie uczy.
Co to zmienia
Nie licz na plik.
Położenie llms.txt jest tanie i nieszkodliwe, ale żaden opublikowany pomiar nie wiąże go z cytowaniem. To nie dźwignia widoczności, co najwyżej uprzejmość wobec agentów, którzy jeszcze nie istnieją.
Czytaj własne logi.
Jedno zapytanie powie Ci, które roboty przychodzą na Twoją witrynę, jak często i o co proszą. To jedyna dana z tej sprawy, którą możesz wytworzyć sam, i jest warta więcej niż światowa średnia.
Zdecyduj, co pozwalasz zabrać.
Stosunek między przeczytanymi stronami a odesłanymi odwiedzającymi to negocjacja, nie los. Dopuszczenie, spowolnienie lub zablokowanie agenta to decyzja handlowa, która należy do Ciebie, podejmowana robot po robocie.
Mierz cytowanie, nie zgodność.
Odhaczenie technicznych rubryk nic nie mówi o Twojej obecności w odpowiedzi. Użyteczne pytanie pozostaje: czy Twoja nazwa pada, w którym silniku i obok kogo.