Co i kiedy zmieniło się na tej stronie. Prowadzimy tę listę
z tego samego powodu, dla którego zalecamy ją klientom: świeżość treści jest realnym sygnałem
dla silników generatywnych, a deklarowana data bez pokrycia w rzeczywistych zmianach jest
gorsza niż jej brak. Poniższe wpisy odpowiadają commitom w repozytorium tej strony.
8 września 2026
Piąta edycja badania: wszystkie
111 polskich hoteli pięciogwiazdkowych, populacja z rejestru państwowego.
Pierwszy raz próba nie pochodzi z katalogu firm, które same się do niego zgłosiły, tylko
z Centralnego Wykazu Obiektów Hotelarskich — więc widać w niej też to, czego katalog
z definicji nie pokazuje: 29 ze 111 hoteli nie ma w rejestrze adresu, pod
którym stoi tylko ten jeden obiekt. To ustalenie zapada, zanim cokolwiek pobierzemy.
Checklistę uruchomiliśmy na 76 hotelach z adresem własnym; stronę oddało
59, a 17 nie odpowiedziało klientowi bez przeglądarki. Surowy przebieg
jest opublikowany, wiersz po wierszu, na licencji CC BY 4.0.
Sprostowanie przed publikacją: trzy hotele omal nie zostały nazwane jako
pozbawione własnej strony, którą mają. Rejestr listuje jeden obiekt
dwa razy, kiedy jego część nosi inną kategorię gwiazdek — a nasz test
„domena dzielona” liczył wpisy, więc taki hotel „dzielił” domenę sam ze sobą. Dotyczyło to
Regent Warsaw Hotel (Warszawa), BRISTOL TRADITION & LUXURY (Rzeszów) i CITY PARK HOTEL
& RESIDENCE (Poznań). Test liczy teraz podmioty — różne pary
(właściciel, gmina) — a trzy wymienione hotele zostały normalnie zmierzone 8 września.
Reguła i jej granica są opisane w metodologii: rejestr nie
niesie identyfikatora obiektu przeżywającego ponowną rejestrację, więc jeden operator
z dwoma obiektami w jednej gminie pod jedną domeną jest dla tej reguły nieodróżnialny
od jednego obiektu zapisanego dwa razy. Wielkość tej granicy podajemy przy raporcie.
Przekrój ma piątą populację i nadal 3
z 7. Wczorajszy wpis mówił „4 z 7” i mówił prawdę o zestawieniu czterech prób.
Hotele wypadają przy „nie prowadzi historii zmian” gorzej niż którakolwiek
z czterech wcześniejszych populacji — 97% wobec 85–92% — więc rozpiętość tego
ustalenia urosła do 12 punktów, dwa ponad próg, przy którym nazywamy ustalenie
powtarzalnym. Progu nie ruszyliśmy: liczba jest
wynikiem pomiaru, nie wyborem. Strona przekrojowa mówi teraz wprost, że to jedno ustalenie
stoi tuż za progiem, zamiast przedstawiać je jako drugie w kolejności powtórzenie.
Pas badań na obu landingach przestał nazywać siecią hotelową to, co nią nie
jest. Karta piątej edycji mówiła „dzieli domenę z inną siecią hotelową”, a to
jest prawda o części tej klasy, nie o całej: 9 z 15 hoteli stoi pod
domeną rezerwacyjną sieci, a pozostałych 6 — pod domeną, na której jeden
właściciel trzyma kilka własnych obiektów (Donimirski, Dr Irena Eris, Zdrojowa). Napis
mówił o całej klasie to, co jest prawdą o jej większej części. Strona raportu mówiła to
poprawnie od początku; pas — nie, i stoi na dwóch najczęściej czytanych stronach
serwisu.
Sprostowanie: krotność w zdaniu o wiarygodnych źródłach była policzona na
braku, a napisana o posiadaniu. Wczorajszy wpis mówił, że urzędy miast linkują
wiarygodne źródła „trzy razy częściej” niż którakolwiek grupa firm. Trzy
to iloraz ustalenia, czyli braku: firmy nie linkują takich źródeł w 90–96%,
miasta w 34%, a 90/34 daje 2,6. Zdanie mówi jednak o odwrotnej stronie tej samej
liczby — o linkowaniu — a tam miasta stoją na 66% wobec
4–10% i iloraz wynosi 6,90. Odsetek i jego dopełnienie
nie mają tej samej krotności. Zdanie mówi teraz „ponad sześć razy”, tą samą podłogą,
którą przyjęliśmy 18 sierpnia dla ilorazu 3,44. Kierunek był poprawny od początku,
wielkość zaniżona o ponad połowę. Strona przekrojowa, która jest generowana
i bramkowana, przez cały czas podawała 34% wobec 90–100% poprawnie —
rozjechał się wyłącznie ręcznie pisany changelog, bo bramka liczb czyta cyfry, a „trzy”
jest słowem. Od dziś tę krotność trzyma strażnik, który wywodzi ją z modułów.
Nowa bramka wdrożeniowa: twierdzenia, które nie niosą ani jednej cyfry.check-study.py wylicza pary licznik–mianownik i czyta cyfry, więc zdanie bez
żadnej jest dla niej niewidzialne — a dwa razy w tym miesiącu właśnie takie zdanie okazało
się nieprawdziwe. Nowa bramka czyta czternaście stron, wyszukuje zdania stawiające
twierdzenie porównawcze bez cyfry i żąda, żeby każde miało rozstrzygnięcie: albo
wyprowadzone z modułów liczb, albo orzeczone jako nie o danych, z zapisanym powodem.
Zdanie nowe albo przepisane rozstrzygnięcia nie ma i zatrzymuje wdrożenie — dlatego nie
jest to lista zakazanych zwrotów, tylko wymóg, żeby twierdzenie było pokryte, zanim
pojedzie na produkcję. Granice bramki są wypisane w jej pliku: gołych kwantyfikatorów nie
wykrywa, stron angielskich nie obejmuje, a zdania takiego jak „mierzymy warunki wstępne,
nie efekt” nie ocenia, bo to definicja, nie twierdzenie, które dane mogą obalić. Jej
pierwszy przebieg wskazał cztery zdania i wszystkie poprawiliśmy:
„To jedyna miara, na której firmy technologiczne wypadają gorzej niż obie
wcześniejsze próby” — gorzej wypadają na dwóch. Poza próg powtórzenia wychodzą na
jednej; zdanie mówi to teraz wprost i podaje różnicę na drugiej.
„…więc pytanie szło o «Stronę główną»” — pierwszy człon zdania jest prawdą, następnik
nie. Sonda szła pod pierwszym członem <title>, dla Gdańska
„Oficjalny portal miasta Gdańska”, a dosłownie „Strona główna” była nim dla
nielicznych.
„…nie ma encji w Wikidacie i tyle samo nie pokazuje daty” — daty nie pokazuje ponad
połowa firm, a nie tyle samo. Strona rozróżnia te dwie miary dwa akapity wyżej; akapit
z wnioskiem je sklejał.
Podpis „brak daty i historii zmian wypada na 91%” nazywał
koniunkcją miarę liczącą sam człon: historii zmian nie prowadzi 91%, a jednego
i drugiego naraz brakuje 52%. Liczba była poprawna — kłamała nazwa
nad nią.
7 września 2026
Przykładowy wynik audytu na obu landingach: siedem ocen jako wiersze,
nie słupki. Podpisy stały obrócone o 90 stopni w pudełku o sztywnej wysokości
88 px — dobranej pod angielskie napisy. Po polsku „Cytowalność w AI" potrzebuje
122 px, więc jej tekst wychodził poza pudełko i nachodził na własną
liczbę o 24 px. Wersja angielska była czysta, więc wada żyła wyłącznie
w polskiej. Naprawą nie jest podniesienie 88 na 122: sztywna wysokość znika, podpis
dostaje własną kolumnę, a pasek — długość zamiast wysokości. Widżet jest o
150 px niższy, paski dają się porównać jednym spojrzeniem i wyglądają
tak samo jak w tabelach raportów.
Nowa strona: populacje obok
siebie — i ani jednego nowego pomiaru. Cztery badania odpowiadały każde
o swojej populacji; pytania, którego żadne nie mogło postawić samo — co z tych wyników
jest cechą branży, a co cechą polskiego internetu — nie zadaliśmy przez trzy tygodnie,
choć wszystkie dane leżały gotowe. Odpowiedź tego dnia: na 4 z 7
zestawionych ustaleń cztery ówczesne próby mieściły się w dziesięciu punktach od siebie.
Najostrzej powtarzał się brak nazwanego człowieka przy treści (95–97%
w każdej z tych czterech populacji) i brak historii zmian. Odstaje jedno ustalenie
i odstaje w dobrą stronę: urzędy miast
linkują wiarygodne źródła ponad sześć razy częściej niż którakolwiek
grupa firm (66% wobec 4–10%), bo piszą o rzeczach
mających podstawę prawną. Jedna pozycja checklisty nie orzekła
o nikim ani razu — cytowań nie widać w kodzie strony — i publikujemy to zamiast pominąć.
Wikidata z zestawienia wypada, bo dla miast ta sonda mierzy co innego niż dla firm.
Nazajutrz doszła piąta populacja — hotele — i obie te liczby się przesunęły; co dziś
stoi na tej stronie, mówi wpis z 8 września. Krotność w tym zdaniu była policzona na
niewłaściwej stronie odsetka i poprawiliśmy ją 8 września — dlaczego, mówi tamten
wpis.
Pięć stron odpowiedzi dostało drogę do bezpłatnego analizatora.
Do dziś prowadziły do niego wyłącznie dwa landingi. Czytelnik, który doszedł do końca
odpowiedzi na pytanie „jak przygotować stronę pod AI", zadawał sobie następne — „a jak
wypada moja?" — i dostawał adres e-mail oraz odsyłacz „Wróć na stronę główną", choć
odpowiedź jest bezpłatna i o jedno kliknięcie stąd. Notka pod formularzem mówi wprost,
że analizator to inny przyrząd niż checklista, którą prowadzimy
w badaniach: liczy oceny dla domeny, nie wydaje werdyktu pozycja po pozycji. Cztery
strony badań i metodologia zostają bez formularza — w badaniach niczego nie sprzedajemy
i ta zasada nie zmienia się dlatego, że akurat mamy co pokazać.
Generator stron przestał prowadzić własny spis stron. Trzymał ręczną
listę tych, których sam nie pisze, i lista rozjechała się o trzy pozycje — metodologię
i oba nowsze badania — więc jego uruchomienie dawało sitemapę i kanał bez nich. Nic
takiego nie trafiło na produkcję, bo bramka dat trzyma sitemapę w równości ze stronami
na dysku i odmawiała wdrożenia; nieuruchamialny był generator. Teraz strony są
odnajdywane w katalogu, a to, co mówią o sobie — datę, tytuł, opis — czyta się z nich.
Przy okazji tytuł raportu w kanale RSS przestał zapowiadać badanie samych spółek
giełdowych, trzy tygodnie po tym, jak ta strona objęła również e-commerce.
1 września 2026
Sprostowanie do wszystkich czterech raportów: miara „nie pokazuje daty ani
changelogu" nazywa się teraz „nie prowadzi historii zmian". Podpis obiecywał
koniunkcję — datę oraz historię zmian — a liczba pod nim liczyła jedną pozycję
checklisty: historię zmian. Bez jednego i drugiego naraz jest 49 z 94
software house'ów, a nie 86; wśród spółek giełdowych 22 z 55, a nie 47; wśród sklepów
68 z 128, a nie 111. Same liczby były poprawne i takie zostają — zmienił się podpis nad
nimi, w tabelach porównawczych czterech raportów i na obu landingach. Raport o software
house'ach podaje teraz obie miary osobno, bo przyrząd mierzy je osobno od pierwszego
przebiegu: 86 z 94 nie prowadzi historii zmian, 55 z 94
nie pokazuje daty.
„Kompletna encja Organization" wyliczała cztery pola z pięciu.
Raport o software house'ach tłumaczył ją jako „nazwę, adres, logo i profile razem”,
a pozycja wymaga jeszcze opisu. Różnica nie jest teoretyczna: opisu brakuje
32 z 94 firm, a 15 z 94 nie zdaje tej pozycji wyłącznie
z tego powodu, mając komplet pozostałych pól. Czytelnik, który sprawdził u siebie cztery
wymienione, wychodził z przekonaniem, że ma komplet.
Obie rzeczy wyszły przy zastosowaniu tych samych reguł do jednego serwisu spoza próby.
Przy odsetku podpis czyta się jak nagłówek kolumny; przy jednym wierszu widać, że obiecuje
coś, czego liczba obok nie mierzy. Bramka przed publikacją trzyma liczby wobec przebiegu
i nie ma jak sprawdzić, czy zdanie nad liczbą mówi to samo co ona — to zostaje po stronie
czytającego.
26 sierpnia 2026
Sprostowanie do wszystkich czterech raportów: miara „brak encji w Wikidata"
nazywa się teraz „brak encji pod nazwą ze strony". Pozycja pyta Wikidatę
o nazwę, którą przyrząd odczytał ze strony — z encji Organization, a gdy jej
nie ma, z pierwszego członu <title>. Kiedy strona nazywa się „Strona
główna" albo „Home", pytanie idzie o coś innego niż jej właściciel. Zmierzyliśmy skalę,
pytając ponownie o każdy zapisany brak encji nazwą z rejestru albo
katalogu branżowego. Bez encji zostaje: 30 z 55 spółek giełdowych
(55% zamiast 78%), 85 z 128 sklepów (66% zamiast 77%),
76 z 94 software house'ów (81% zamiast 90%) i 1 z 59
miast. Ustalenie raportu o software house'ach przeżywa poprawkę — przewaga nad dwiema
wcześniejszymi populacjami rośnie z 12 punktów do 15. Sprostowania stoją przy liczbach,
których dotyczą.
Trzy spółki giełdowe i sześć miast miało w opublikowanych danych cudzą encję
jako dowód. Wyszukiwarka Wikidaty na „Strona główna" zwraca Q5296, czyli
„Wikimedia main page", a na „Home" — nazwisko. Wiersze, w których pytaliśmy o cudzą nazwę,
niosą teraz pole entityNameNotTheOwners we wszystkich czterech zbiorach
danych. Audyt: czwarta edycja.
Nowa strona: metodologia — wspólne reguły
wszystkich edycji w jednym miejscu: dobór próby, skąd biorą się adresy, dlaczego nie ma
oceny końcowej, kogo nazywamy z imienia, jak testujemy hipotezy i co sprawdza bramka przed
publikacją. Raporty linkują tutaj, zamiast powtarzać regułę czterokrotnie.
Czwarte badanie: 66 miast na prawach powiatu — populacja i adresy wzięte
z rejestru MSWiA („Baza teleadresowa JST”, typ_JST = MNP), więc żadnego adresu
nie zgadywaliśmy: mierzymy ten, który miasto samo podało ministerstwu. Osobna strona:
widoczność w AI polskich miast na prawach
powiatu, surowy przebieg opublikowany:
dane w JSON,
CC BY 4.0.
Siedem miast nie odpowiada pod własnym adresem — brak rekordu DNS,
certyfikat nieobejmujący nazwy, niekompletny łańcuch, odmowa połączenia i jeden serwis
oddający stronę przeglądarce, a odmawiający jej botowi. Wśród 59 osiągalnych serwisów
0 publikuje kompletną encję Organization.
Dwie pozycje checklisty wyłączyliśmy z publikacji — encja w Wikidacie
i artykuł w Wikipedii pytają o nazwę odczytaną ze strony, a serwisy miast nazywają się
„Strona główna”. Werdykty zostają w opublikowanych danych z zastrzeżeniem przy każdym
wierszu; jako ustalenia o miastach nie padają nigdzie.
Nowa oś: co jest pod tymi stronami. Silnik nie przewiduje wyniku —
serwisy na tym samym CMS-ie nie są do siebie podobniejsze niż dobrane losowo. Cztery
miasta, które podpisują w stopce tego samego wykonawcę, zgadzają się na 21 pozycjach z 25
przy 15,3 oczekiwanych losowo. Cztery to cztery, więc zapisujemy to jako hipotezę.
W tej edycji nie nazywamy z imienia żadnego miasta — ani przy wadach,
ani przy zasługach. Przy zamkniętej próbie 66 samorządów każda lista czyta się jak ranking,
a rankingu miast nie robimy. Nazwy padają wyłącznie przy dostawcach oprogramowania.
Trzecie badanie: 98 polskich software house'ów — wszyscy członkowie
SoDA, wzięci z publicznego katalogu w całości, bez filtra „które z nich są naprawdę
software house'ami”. Osobna strona:
widoczność w AI polskich software
house'ów, surowy przebieg opublikowany:
dane
w JSON, CC BY 4.0.
Cztery miary powtórzyły się po raz trzeci, na populacji, która z dwiema
poprzednimi nie ma wspólnego nic poza krajem. Jedna wypadła inaczej i to ona jest
ustaleniem: 85 z 94 firm, które budują strony, nie ma encji w Wikidata —
częściej niż spółki giełdowe (78%) i częściej niż sklepy (77%). To jedyna miara, na której
firmy technologiczne odstają od obu wcześniejszych prób: na historii
zmian też wypadają gorzej, ale różnica w tej trójce to sześć punktów,
czyli mieści się w tym, co nazywamy powtórzeniem.
Blokada botów AI odwraca się względem e-commerce. Wśród sklepów 14 na 24
blokujących nie wiedziało, że blokuje — regułę postawiła zapora, a robots.txt
milczał. Wśród software house'ów przypadkowe są dwa przypadki na osiem; pozostałe sześć
wpisało nazwy botów ręcznie. Ludzie, którzy rozumieją robots.txt, używają go
celowo — i mają do tego prawo.
Pozycja o łańcuchu certyfikatu zapracowała. Przy pierwszym badaniu dwie
domeny były nieosiągalne bez podanej przyczyny, bo sprawdzenie TLS weszło do checklisty
dzień po tamtym pomiarze. Tutaj jedna z czterech nieosiągalnych domen dostała nazwaną
przyczynę: niekompletny łańcuch certyfikatu. Przeglądarka to nadrabia, klient ścisły nie.
Raporty stoją teraz pod nagłówkiem obu landingów, jako pas z liczbą
i linkiem na wydanie, zamiast jednego odnośnika w drobnym druku na końcu sekcji. Pas jest
generowany z danych — wpisana ręcznie liczba przeżyłaby następny przebieg.
Próbę zbudował skrypt, a nie ręka: idzie za paginacją katalogu zamiast zgadywać liczbę
stron, zapisuje powód wykluczenia przy każdym wykluczonym wpisie i notuje, że katalog
publikuje 101 firm, choć nagłówek nad nim mówi o 200. Poprzednia próba takiego skryptu
nie miała i dziś nikt nie odtworzy, jak powstała.
Wszystkie trzy raporty wymieniają teraz z nazwy tych, którzy coś MAJĄ —
cztery spółki z kompletną encją Organization, jedenaście z encją w Wikidacie,
dziewiętnaście firm e-commerce, szesnaście software house'ów. Przy wynikach typu „0 z 55”
lista tych, którym czegoś brakuje, jest listą prawie wszystkich i nie mówi nic; mniejszość
dowodzi, że się da. Listy są generowane z werdyktów pass, nigdy z dopełnienia
porażek: przy Wikidacie odjęcie dałoby dwanaście, a pomiar daje jedenaście, bo przy jednej
spółce sonda encji się nie uruchomiła.
Cztery nazwy zniknęły z raportu o spółkach giełdowych. Allegro, Decathlon,
Leroy Merlin i Mastercard były nazwane przy domenach, których nie dało się pobrać — 403,
niekompletny łańcuch certyfikatu, brak odpowiedzi — trzy zdania po tym, jak ta sama strona
pisze, że ich właściciele najprawdopodobniej o tym nie wiedzą. Nazwisko przy takiej pozycji
przypisuje decyzję, którą raport wyklucza. Nazywamy odtąd wyłącznie mniejszość, która coś
ma, i wyłącznie na pozycjach binarnych, publicznych i wolnych od założeń o czyjejś
intencji. Wszystkie wiersze zostają w surowych danych.
Pod każdym raportem stoi zdanie o sprostowaniach: jeśli mierzymy kogoś błędnie, poprawimy
i odnotujemy to tutaj.
Bramka wdrożeniowa sprawdza teraz siedemnaście rzeczy. Przy okazji wyszło,
że sprawdzanie dat chodziło po katalogach jeden poziom w głąb i nowej strony w ogóle by
nie zobaczyło — meldując „daty spójne na 9 stronach”, czyli prawdę o dziewięciu i ciszę
o dziesiątej.
24 sierpnia 2026
Nowy układ obu stron głównych — sześć sekcji zbudowanych identycznie
dawało dwadzieścia bloków o jednej wadze i żadnej wskazówki, co tu jest najważniejsze.
Teraz strona ma trzy poziomy głośności: ciemna płyta u góry, badanie z liczbami 34 px
pośrodku, usługi i pytania jako spokojne wiersze. Ani jedno słowo i ani jedna
liczba się przy tym nie zmieniły — zmienił się układ, typografia i kolor.
Badanie po polsku, na polskiej stronie głównej — do dziś
/pl/ nie podawało żadnej własnej liczby i odsyłało po nie do
raportu. Model odpowiadający na polskie pytanie czyta
stronę, którą pobrał, a nie tę, którą mógłby pobrać. Nowa sekcja jest generowana z tych
samych surowych przebiegów co angielska, a jej etykiety to te, którymi raport nazywa te
same pięć miar — jedno ustalenie ma mieć jedną nazwę.
Pasek górny na telefonie przestał wypychać stronę w bok. Logo,
plakietka, dwa odnośniki i przycisk mają razem szerokość większą niż ekran telefonu,
więc rząd wypychał całą stronę i trzeba było przewijać poziomo. Zwija się teraz
w rzędy — nic nie chowamy, bo „nie mieści się na telefonie” nie jest
powodem, żeby czytelnik telefonu nie dostał treści.
Z angielskiego landingu zniknęło zdanie pod karuzelą, które tłumaczyło czytelnikowi,
po co pod slajdami stoi ten sam tekst. Powód, dla którego on tam stoi, się nie zmienił —
ale to nasze uzasadnienie, nie treść dla klienta. Polska wersja nigdy go nie miała,
bo karuzeli tam nie ma.
Numery sekcji mówią jednym językiem: szara cyfra zamiast czerwonego kwadracika,
w rozmiarze idącym za nagłówkiem, którego dotyczą.
Liczby w raporcie dostały długość. Każda proporcja ma pod sobą pasek —
bez biblioteki wykresów i bez ani jednej linii JavaScriptu, bo strona, która sprzedaje
czytelność dla maszyn, nie może trzymać własnych liczb w skrypcie. Bramka wylicza długość
z proporcji stojącej w tej samej komórce i oblewa wdrożenie, gdy jedno rozjedzie się
z drugim. Gołe liczby w tabeli blokad paska nie dostają: ich podstawa stoi w nagłówku
kolumny, nie w komórce, więc czytelnik nie miałby jak sprawdzić skali.
Karuzela zniknęła z angielskiego landingu. Osiem plansz z tekstem
zamkniętym w obrazkach stało na stronie, której własna checklista
mówi wprost: „model nie czyta karuzel, infografik ani zrzutów ekranu". Te same osiem myśli
stoi pod spodem jako tekst — i tak było na /pl/ od początku. Razem
z karuzelą odszedł jedyny wykonywalny JavaScript na tej stronie.
Hero podaje teraz zmierzone liczby, nie ocenę w Google. Firma sprzedająca
pomiar miała nad zgięciem ocenę, liczbę recenzji i liczbę źródeł danych. Teraz stoją tam
wyniki obu badań; ocena z Google została w sekcji opinii, gdzie jest na miejscu.
Zniknęło zdanie, którego próba nie unosi — że cztery powtórzone miary „przestają opisywać
naszą próbkę, a zaczynają opisywać polski internet". Obie populacje to duże, zorganizowane
podmioty; małych firm nie ma w tym pomiarze ani jednej. Teza jest teraz węższa i pewniejsza.
Poprawka objęła raport i oba landingi, bo to samo zdanie stało w trzech miejscach.
Przykładowy wynik 62/100 dostał zastrzeżenie, którego brakowało: jedna ocena działa dla
jednej strony w czasie i nie działa przy porównywaniu stron — dokładnie to, co raport
tłumaczy w osobnej sekcji. Bez tego zdania oba dokumenty czytane razem sobie przeczyły.
Raport dostał sekcję „Czego ten pomiar nie rozstrzyga", podpis autora
z nazwiska i liczbę pozycji checklisty w treści, a nie tylko w metadanych. Nagłówek sekcji
e-commerce mówił „trzy razy częściej"; surowy iloraz to 3,44 — jest „ponad trzy razy”.
Nowa sekcja na obu landingach: ta strona przechodzi własną checklistę,
punkt po punkcie, każdy do sprawdzenia z zewnątrz.
Bramka wdrożeniowa sprawdza teraz jedenaście rzeczy: doszło trzymanie polskiego
bloku co do znaku, długość każdego paska w raporcie i każda proporcja wpisana wprost
w landing. Bloku, który jest generowany
i sprawdzany dosłownie, nie da się przeredagować w kłamstwo.
18 sierpnia 2026
Drugie badanie: 145 domen polskiego e-commerce — wszyscy członkowie
e-Izby, dobrani regułami nad publiczną listą, świadomie bez filtra „które są naprawdę
sklepami”. Wyniki w nowej sekcji raportu,
surowy przebieg opublikowany:
dane w JSON, CC BY 4.0.
Cztery miary powtórzyły się na niezależnej próbie co do jednego–dwóch
punktów: brak cytowanych źródeł, brak głosu eksperta, brak historii zmian, brak encji
w Wikidata. Dwie populacje, które nie mają ze sobą wspólnego nic poza tym, że są polskie,
dają te same liczby — to przestaje opisywać naszą próbkę, a zaczyna opisywać rynek.
Jedyna różnica, która wystaje: boty AI odprawia 5% spółek giełdowych
i 19% sklepów. Rozbicie mechanizmu waży więcej niż sama różnica — wśród sklepów
14 na 128 odrzuca boty na krawędzi, mając czysty robots.txt,
a wśród spółek giełdowych nie zdarzyło się to ani razu. To zapora postawiona przeciw
scraperom cen, pod którą AI wpadło przy okazji — i firma nie ma jak tego zobaczyć u siebie.
Porównanie liczymy na 128 domenach, nie na 145: narzędzie zmieniło się między badaniami,
a różnica trafia dokładnie w warstwę dostępu. Na pełnej próbie wyszłoby
korzystniej dla naszej tezy — 21% zamiast 19%.
Bramka wdrożeniowa sprawdza teraz siedem rzeczy zamiast czterech. Liczby obu badań są
trzymane osobno, bo mianownik jednej próby przy liczbie z drugiej wygląda
poprawnie i jest fałszem.
17 sierpnia 2026
Surowy przebieg badania jest opublikowany —
pełne dane w JSON, każdy wiersz wraz
z tymi, które nie weszły do mianownika, każdy z zapisanym powodem. Licencja CC BY 4.0.
Nie musisz powtarzać pomiaru, żeby nas sprawdzić.
Każda strona odpowiadająca na pytanie niesie teraz własną zmierzoną liczbę
z tego badania, dobraną do pytania tej strony, w miejsce jednego ogólnego zdania
powtórzonego na pięciu stronach.
Liczby nie są przepisane: wyprowadza je jeden moduł z surowego przebiegu, a bramka
wdrożeniowa wylicza je ponownie i zatrzymuje publikację, gdy proza rozjedzie się z danymi —
w obie strony.
Poprawione: Article.wordCount raportu deklarował 675 przy 738 faktycznych
słowach, bo instrukcja przeliczania cytowała znacznik sekcji we własnej treści i liczyła
sama siebie. Teraz pilnuje tego bramka, nie komentarz.
Nagłówek bot-hits.py podaje okno zmierzone, nie żądane,
i ostrzega, gdy log jest krótszy od pytania. Dochodzi też ikona strony i bramka na
artefakty weryfikacyjne (Google, Bing, IndexNow), których nie pilnowało nic.
Polska wersja strony głównej i wzajemne hreflang między wersją polską
a angielską.
Pięć stron odpowiadających na konkretne pytania, każda pod własnym adresem, w miejsce
kotwic na jednej stronie.
Osiem plansz karuzeli przepisanych na tekst — silniki nie czytają obrazków, więc
merytoryka zamknięta w pikselach dla nich nie istniała.
Dane strukturalne: wspólna encja firmy dla trzech domen, typ Article
z autorem i datami na stronach z treścią.
robots.txt z jawną zgodą dla botów AI, sitemapa, IndexNow, weryfikacja
w Bing Webmaster Tools.
Obsługa czystych adresów bez rozszerzenia (wcześniej podstrona odpowiadałaby treścią
strony głównej i statusem 404 — w przeglądarce niewidoczne, dla bota odrzucenie).
Włączone logowanie dostępu, żeby dało się w ogóle stwierdzić, czy silniki tu zaglądają.