Duplikacja treści w sklepie powstaje najczęściej przez architekturę i działanie systemu, a nie przez celowe kopiowanie artykułów. Jeden produkt może być dostępny pod kilkoma adresami, filtry tworzą setki podobnych list, a parametry kampanii generują kolejne wersje tej samej strony.
Google nie musi karać sklepu za każdy powtarzający się fragment. Problem polega na tym, że wyszukiwarka musi wybrać podstawowy URL, crawl jest kierowany do zbędnych kombinacji, a linki i dane rozkładają się między kilka wersji.
Gdzie powstają duplikaty w e-commerce?
Najczęstsze źródła obejmują:
- produkty przypisane do wielu kategorii i dostępne pod różnymi ścieżkami,
- oddzielne adresy dla kolorów, rozmiarów lub innych wariantów,
- sortowanie według ceny, popularności i daty,
- łączenie wielu filtrów,
- parametry kampanii, sesji i afiliacji,
- wersje HTTP, HTTPS, www i bez www,
- identyczne opisy pobrane od producenta,
- kategorie różniące się tylko nazwą albo jednym produktem,
- strony drukowania i podglądu.
Przed zmianą treści trzeba sprawdzić, czy problemem są podobne teksty, czy kilka technicznych adresów prowadzących do tego samego dokumentu.
Czy podobne produkty zawsze wymagają unikalnego opisu?
Nie ma sensu sztucznie przepisywać identycznych informacji technicznych dla dwudziestu wariantów jednego produktu. Jeżeli różnica ogranicza się do koloru lub rozmiaru, często lepsza jest jedna karta produktu z wyborem wariantu.
Oddzielny URL może być uzasadniony, gdy wariant:
- ma własny popyt i osobne zastosowanie,
- różni się parametrami wpływającymi na decyzję,
- ma samodzielną dostępność, cenę lub dokumentację,
- powinien być osobno promowany i raportowany.
W takiej sytuacji strona musi prezentować różnicę w sposób użyteczny dla klienta. Sama zamiana nazwy koloru w tym samym szablonie nie tworzy wartościowego materiału.
Canonical, przekierowanie czy noindex?
Rozwiązanie zależy od funkcji adresu.
Przekierowanie 301
Stosuje się je, gdy dodatkowy URL nie powinien być już dostępny, a istnieje bezpośredni odpowiednik. Użytkownik i robot trafiają wtedy do jednej, docelowej wersji.
Canonical
Jest odpowiedni, gdy alternatywny adres musi pozostać dostępny, ale jako podstawową wersję należy wskazać inny URL. Canonical jest sygnałem, a nie bezwzględną komendą. Powinien być zgodny z linkowaniem, sitemapą i pozostałymi elementami serwisu.
Noindex
Może wyłączyć z indeksowania stronę potrzebną użytkownikowi, np. określony widok filtrów albo wewnętrzne wyniki wyszukiwania. Robot musi jednak mieć możliwość pobrania strony, aby zobaczyć tę dyrektywę.
Ograniczenie crawlowania
robots.txt może ograniczać pobieranie technicznych przestrzeni URL, ale nie rozwiązuje automatycznie problemu wyboru wersji kanonicznej. Nie powinien blokować stron, na których robot musi odczytać canonical lub noindex.
Jak zarządzać filtrami i sortowaniem?
Najpierw trzeba rozpoznać kombinacje odpowiadające realnym potrzebom klientów. Kategoria „buty trekkingowe damskie” może zasługiwać na własną stronę. Widok „buty trekkingowe damskie, czerwone, rozmiar 38, posortowane od najtańszych” nie musi być osobnym wynikiem wyszukiwania.
Dla indeksowanych kombinacji należy przygotować:
- stały adres bez zbędnych parametrów,
- własny tytuł i nagłówek,
- rzeczywiście dopasowany asortyment,
- użyteczną treść lub informacje wspierające wybór,
- linki wewnętrzne prowadzące do strony.
Pozostałe filtry powinny działać dla kupującego, ale nie tworzyć niekontrolowanej liczby indeksowalnych URL-i. Rozwiązanie trzeba dopasować do platformy i sposobu renderowania produktów.
Jak postępować z opisami producenta?
Opis producenta może być poprawny technicznie, ale często występuje w wielu sklepach i nie odpowiada na pytania charakterystyczne dla konkretnego sprzedawcy.
Zamiast mechanicznie zamieniać synonimy, warto uzupełnić kartę o:
- własne zdjęcia i pomiary,
- informację o rzeczywistym zastosowaniu,
- zgodność z innymi produktami,
- ograniczenia zauważone przez sprzedawcę,
- odpowiedzi działu obsługi,
- warunki dostawy, zwrotu i gwarancji,
- porównanie wariantów.
To informacje, które pomagają kupującemu i odróżniają ofertę bez tworzenia tekstu wyłącznie dla wyszukiwarki.
Duplikacja kategorii
Dwie kategorie mogą mieć inne nazwy, ale prezentować prawie identyczny zestaw produktów. Przykładem może być „akcesoria do biegania” i „akcesoria dla biegaczy”, jeżeli obie strony obsługują tę samą intencję.
Możliwe decyzje to:
- połączenie kategorii i przekierowanie słabszej,
- wyraźne rozdzielenie asortymentu oraz potrzeb użytkownika,
- pozostawienie jednej strony indeksowanej,
- zmiana drugiej kategorii w filtr lub element nawigacji.
Nie należy utrzymywać dwóch stron tylko dlatego, że CMS pozwala je utworzyć.
Jak wykrywać duplikację?
Analiza powinna połączyć dane techniczne i zachowanie wyszukiwarki:
- crawl wszystkich adresów wraz z parametrami,
- canonical deklarowany i wybrany przez Google,
- powtarzające się tytuły, nagłówki i treści,
- mapy XML i linkowanie wewnętrzne,
- raport indeksowania w Search Console,
- logi pokazujące częstotliwość pobierania filtrów,
- zapytania kierowane do kilku konkurujących URL-i.
Sama lista zduplikowanych title nie wystarcza. Trzeba ustalić, czy powstały dwie strony, czy jeden dokument jest dostępny pod kilkoma adresami.
Jak sprawdzić efekt zmian?
Najpierw zweryfikuj:
- kody odpowiedzi i cele przekierowań,
- canonical w kodzie i po renderowaniu,
- adresy używane w linkach wewnętrznych,
- zawartość sitemap XML,
- indeksowalność filtrów i wariantów,
- działanie wyboru produktów na telefonie.
Następnie obserwuj, czy właściwe strony uzyskują wyświetlenia, a liczba zbędnych adresów w raportach stopniowo maleje. Warto równocześnie sprawdzać sprzedaż i korzystanie z filtrów, aby porządkowanie SEO nie pogorszyło procesu zakupowego.
Więcej o wyborze wersji podstawowej znajdziesz w poradniku o canonical URL, a o pojedynczych ofertach w materiale dotyczącym optymalizacji kart produktów.
Jeżeli sklep generuje wiele podobnych URL-i, mogę ustalić reguły dla wariantów, filtrów i kategorii podczas audytu SEO. Kontakt: czesc@seomariusz.pl, 665 015 610.
You must be logged in to post a comment.