Theos Group

Jak łatwo można znaleźć Twoją firmę w Google i w AI? Bezpłatnie, od razu.

Wolisz od razu pełny raport? Rozszerzone skanowanie — € 49 →

Baza wiedzy

Dlaczego moja strona produktu pojawia się trzy razy w Google?

Różne warianty URL tej samej strony sprawiają, że Google wątpi, która wersja ma znaczenie, a to kosztuje widoczność, którą odzyskasz jedną zmianą techniczną.

Co dokładnie oznacza kanonizowanie parametrów URL

Załóżmy, że sprzedajesz buty. Ktoś wchodzi na Twoją witrynę przez reklamę: uw-shop.nl/schoenen?utm_source=facebook. Ktoś inny sortuje po cenie: uw-shop.nl/schoenen?sort=laag-hoog. Kolejna osoba filtruje po rozmiarze: uw-shop.nl/schoenen?maat=42. Dla odwiedzającego to wszystko jest tą samą stroną w innym wydaniu. Dla Google'a bez interwencji to trzy lub więcej oddzielnych stron.

Kanonizowanie oznacza, że mówisz Google'owi: to wszystko są warianty, ale rzeczywista, licząca się wersja to uw-shop.nl/schoenen — bez dodatków. Ten czysty adres nazywamy kanonicznym URL. Udzielasz więc jednej jasnej odpowiedzi na pytanie, która wersja powinna pojawić się w wynikach wyszukiwania.

To nie chodzi o ukrycie lub blokowanie czegoś. Warianty mogą spokojnie istnieć i działać dla odwiedzających, którzy filtrują lub sortują. Mówisz tylko zeszukiwarkom: przypisz całą wartość i ocenę temu jednemu czystemu adresowi, a nie dziesięciu wariantom parametrów obok niego.

To przypomina to, co dzieje się przy paginacji, jak wyjaśniamy przy paginacji. Tam również istnieje wiele adresów URL, które zawartościowo się znacznie pokrywają. Różnica polega na tym, że parametry są często jeszcze bardziej przypadkowe: sortowanie i śledzenie nic nie dodają do treści, podczas gdy numery stron czasami dodają.

Jak sprawdzić, czy dotyczy to Ciebie

Najszybsza kontrola: wyszukaj w Google Search Console swoją domenę za pomocą wyszukiwania witryny, na przykład site:uw-shop.nl/schoenen. Jeśli pojawi się wiele wariantów ze znakami zapytania i parametrami, jest duża szansa, że to nie wygląda dobrze. Możesz też po prostu przejść przez swoją witrynę, włączyć filtry i opcje sortowania i zobaczyć, co się dzieje na pasku adresu.

W Search Console możesz sprawdzić w sekcji Strony powód, dla którego strony nie są indeksowane. Jeśli tam widnieje coś w rodzaju zduplikowanej zawartości, Google wybrał inny kanoniczny URL niż użytkownik, to jest to często dokładnie Twój problem. Jest to jeden z najwyraźniejszych sygnałów, które daje ten raport.

Sprawdź również kod źródłowy filtrowanej strony, lub poproś kogoś, aby to zrobił dla Ciebie. Powinna tam być reguła wskazująca czysty URL jako wersję kanoniczną. Jeśli ta reguła brakuje lub wskazuje na wersję parametrów, to trzeba się zabrać do pracy.

Wskazanie otrzymasz również z Twojej analizy: jeśli widzisz dziesiątki wariantów URL tego, co naprawdę jest jedną stroną, każdy z małą ilością ruchu, to ten ruch rozpryskał się na kopie zamiast być skonsolidowany na stronie głównej.

Ile to kosztuje, jeśli to nie jest w porządku

Największym ryzykiem jest zmarnowana uwaga Google do Twojej witryny. Wyszukiwarki poświęcają każdej witrynie ograniczoną ilość czasu i pojemności na przeglądanie stron, zwane również budżetem crawlerowania. Jeśli Google poświęci ten czas stuprocentom wariantów tej samej strony ze butami, zostanie mniej na nowe lub ważne strony gdzie indziej na Twojej witrynie.

Ponadto rozcieńczasz swoją własną istotność. Jeśli wartość linków i sygnały aprobaty rozprzestrzeniają się na dziesięć wariantów URL zamiast być skoncentrowane na jednej stronie, żaden wariant nie jest wystarczająco silny, aby dobrze się pozycjonować. W praktyce walczysz sam ze sobą w wynikach wyszukiwania.

Istnieje również realne ryzyko, że Google sam wybierze wersję kanoniczną, a niekoniecznie tę, którą chciałbyś. Może to być wariant parametrów z brzydkim adresem URL, lub strona, która nie jest Twoją preferowaną landing page dla tej wyszukiwarki. Tracisz wtedy kontrolę nad tym, co dokładnie ludzie widzą i na co klikają.

Dla asystentów AI, które podsumowują sieć, pojawia się ten sam problem, ale bardziej nasilony. Model językowy, który napotka trzy nieznacznie różne wersje tej samej strony produktu, może podnieść mylące lub sprzeczne informacje, na przykład inną cenę z powodu starego cache'u wariantu sortowania. Jasność co do tego, która wersja jest poprawna, pomaga zatem szerzej niż tylko w Google.

Co należy zrobić, aby to rozwiązać

Jądro jest proste: każdy wariant strony — ze śledzeniem, sortowaniem lub filtrami w adresie URL — musi wskazywać, że czysty wariant jest wersją właściwą. Jest to instrukcja, którą ustawia się prawidłowo raz na typ strony, a nie coś, co robi się ręcznie na każdej stronie. Pomyśl o stałej regule dla wszystkich stron produktów, innej stałej regule dla wszystkich stron kategorii.

To powinno mieć miejsce w szerszym przeglądzie tego, jakie strony posiadasz i jak się zachowują, jak omawiamy podczas tworzenia macierzy indeksacji na typ strony. Określa się tam dla każdego typu strony, a więc również dla każdego typu parametru, jaki jest zamiar: czy parametr może istnieć, czy musi być kanonizowany, czy nawet w ogóle nie powinien być uwzględniany w indeksie.

Niektóre parametry zasługują na inne podejście niż tylko kanonizacja. Wewnętrzne wyniki wyszukiwania, na przykład gdy ktoś szuka na Twojej własnej stronie i generuje to oddzielny adres URL, możesz często lepiej bezpośrednio wykluczyć z indeksowania, jak wyjaśniono w sekcji dotyczącej stron z wynikami wewnętrznego wyszukiwania na noindex. Kanonizacja i wykluczenie to dwa różne narzędzia do różnych sytuacji.

Po wdrożeniu zmian pozwól, aby upłynęło kilka tygodni, i ponownie sprawdź w Search Console, czy zduplikowane warianty znikną z raportu problemów. To nie dzieje się z dnia na dzień: Google musi ponownie odwiedzić strony i przetworzyć nową instrukcję. Cierpliwość i wielokrotna kontrola są częścią tego procesu.

Jak to łączy się z innymi podstawowymi kwestiami technicznymi

Kanonizacja nie istnieje w izolacji. Jeśli plik robots.txt już blokuje części witryny, jak omówiono w punkcie kontrolnym 1.1 dotyczącym robots.txt i punkcie kontrolnym 1.2, może to przeszkodzić w działaniu instrukcji kanonicznych. Strona, która jest zablokowana, i tak nie może być odwiedzona przez Google, aby przeczytać instrukcję kanoniczną.

Słaba obsługa błędów 404 również dotyczy tego tematu. Jeśli usunięta wersja parametru nie zostanie prawidłowo przekierowana, ale dostarczy mylącą stronę bez prawidłowego kodu statusu, mówimy o miękkim 404, wyjaśnionym w sekcji dotyczącej miękkiego 404. To samo dotyczy słabej strony błędu, patrz pomocna strona 404. Wszystkie te punkty wzajemnie się dotykają: zawsze chodzi o udzielenie Google'owi jasnych informacji na temat tego, czym dokładnie jest strona i co oznacza.

Na koniec: jeśli witryna w dużej mierze opiera się na JavaScript do wyświetlania zawartości, jak omówiono w sekcji dotyczącej zawartości głównej dostępnej bez JavaScript, może być dla Google'a już trudno zobaczyć zawartość podstawową, nie mówiąc już o referencji kanonicznej, która czasami jest do niej dynamicznie dodawana. Technicznie stabilna podstawa sprawia, że kanonizacja staje się naprawdę niezawodna.

Często zadawane pytania

Czy teraz muszę usunąć wszystkie adresy URL ze znakiem zapytania

Nie. Wersje parametrów mogą pozostać, ponieważ są przydatne dla odwiedzających, którzy filtrują, sortują lub przychodzą przez ogłoszenie. Nie musisz nic usuwać. Po prostu dodajesz instrukcję wskazującą, że czysty wariant bez parametrów jest rzeczywistą, liczącą się stroną dla wyszukiwarek. Wariant i instrukcja istnieją obok siebie.

Czy mogę to sprawdzić sam bez wiedzy technicznej

Częściowo tak. Możesz sprawdzić w Google Search Console, czy istnieją powiadomienia o zduplikowanych stronach lub innym wybranym kanonicznym adresie URL. Możesz również sam przejść przez swoją witrynę i zobaczyć, co dzieje się z paskiem adresu podczas filtrowania i sortowania. Faktyczna ocena kodu źródłowego i wdrożenie rozwiązania wymaga jednak kogoś z techniczną wiedzą na temat Twojej witryny lub systemu sklepu internetowego.

Czy jest to również ważne, jeśli nie mam sklepu internetowego

Tak, chociaż szansa jest mniejsza. Nawet zwykłą stronę biznesową mogą otrzymać parametry poprzez kampanie marketingowe, takie jak kody utm w reklamach lub biuletynach. Za każdym razem, gdy ktoś wejdzie przez taki link, w teorii powstaje nowy wariant URL tej samej strony. Bez filtrów sklepu internetowego problem jest mniejszy, ale rozwiązanie i logika za nim stojąca są identyczne.

Dalsze lektury

Jak wygląda Twoja własna strona?

Dwie liczby, w ciągu minuty, bezpłatnie — i nie musisz niczego zostawiać.

Jak łatwo można znaleźć Twoją firmę w Google i w AI? Bezpłatnie, od razu.

Wolisz od razu pełny raport? Rozszerzone skanowanie — € 49 →

Chcesz wiedzieć, na czym to polega?

Ten skaner pokazuje Ci stan. Raport pokazuje Ci przyczyny i kolejność, w której je rozwiązujesz.

  • Dla każdego ustalenia co jest nie tak i co trzeba zrobićBezpłatny skaning daje Państwu status. Raport daje Państwu listę — w zwykłym języku, uporządkowaną według wagi, bez konieczności zrozumienia czegokolwiek technicznego.
  • Wszystkich czterech asystentów AI zamiast jednegoBezpłatny wynik to próba u jednego asystenta. Raport zadaje osiem pytań wszystkim czterem, abyś wiedział, czy chodzi o jednego asystenta, czy o wszystkich.
  • Które firmy rzeczywiście się pojawiająKto otrzyma klienta, którego Państwo tracą? Te nazwy znajdują się w raporcie, z informacją o tym, jak często pojawiają się tam, gdzie Państwo się nie pojawiacie.
  • Głębszy pomiar Państwa strony internetowejBezpłatny skaning sprawdza dziesięć stron. Raport przechodzi przez pięćdziesiąt, a więc także strony, gdzie ostatecznie trafiają Państwa klienci.