Modelowane listy odbiorców nie zawierają konkretnych osób, tylko prawdopodobieństwa. Wyjaśniam, jak powstają, gdzie ich szukać w panelu i jak czytać ich raporty.
Piątego marca, razem z aktualizacją podstawową, Google opublikowało zmiany w zasadach dotyczących spamu. Jedna z nich zastąpiła punkt, który przez lata brzmiał „spamerska treść generowana automatycznie”. Nowa nazwa to scaled content abuse, w polskim tłumaczeniu wytycznych — nadużycie polegające na generowaniu treści na masową skalę.
Wygląda to na kosmetykę i większość osób tak to potraktowała. Moim zdaniem to jedna z ważniejszych zmian w wytycznych od kilku lat, bo przenosi punkt ciężkości z pytania „czy to napisał człowiek” na pytanie „ile tego jest i po co powstało”. A to zupełnie inna rozmowa z klientem, który chce mieć sto tekstów na kwartał.
Poniżej rozbieram tę zasadę na części: co dokładnie mówi, czym różni się od poprzedniej, gdzie realnie leży granica i jak sprawdzić, czy własny serwis w nią nie wchodzi.
Kontekst jest prosty: przez cały 2023 rok koszt wyprodukowania tysiąca podstron spadł praktycznie do zera. Wystarczyła lista fraz, szablon i narzędzie generujące tekst, żeby w tydzień postawić serwis, którego napisanie ręcznie zajęłoby rok.
Stara zasada tego nie obejmowała precyzyjnie, bo mówiła o treści „generowanej automatycznie”, a więc o metodzie. Dawało to wygodną lukę: wystarczyło, że tekst przeszedł przez ręce redaktora, który poprawił dwa zdania, i formalnie nie był już generowany automatycznie. Znam agencje, które dokładnie na tym budowały ofertę.
Druga rzecz to sygnał wysłany rynkowi. Google w komunikacie z 5 marca zapowiedziało, że celem całej marcowej operacji jest mniej treści nieoryginalnych i niskiej jakości w wynikach, a nowe zasady dają jego zespołowi podstawę do działań ręcznych. Przez marzec branża obserwowała witryny znikające z indeksu całkowicie — to efekt osobnej aktualizacji antyspamowej i działań ręcznych, nie zmiany w rankingu.
Warto ją przeczytać dosłownie, bo każdy fragment jest tam z jakiegoś powodu.
Google opisuje to zjawisko jako tworzenie wielu stron, których głównym celem jest manipulowanie pozycjami w wynikach wyszukiwania, a nie pomoc użytkownikowi. Dodaje, że praktyka polega zwykle na wytwarzaniu dużych ilości nieoryginalnej treści o niewielkiej wartości dla czytelnika — i że nie ma znaczenia, w jaki sposób ta treść powstała.
Trzy elementy tej definicji działają łącznie i to jest sedno. Musi być skala — wiele stron, nie jedna. Musi być cel skierowany na ranking, nie na czytelnika. I musi być brak wartości — treść nieoryginalna, powtarzalna, nic nie wnosząca. Jeden słaby tekst na blogu nie jest naruszeniem zasady spamowej. Trzysta słabych tekstów wygenerowanych pod listę fraz już nim jest.
Zwracam uwagę na sformułowanie „no matter how it’s created” — bez znaczenia, czy zrobiła to automatyzacja, człowiek, czy jedno i drugie razem. Google zamknęło tym zdaniem lukę, o której pisałem wyżej.
W wytycznych jest lista sytuacji i warto ją znać, bo część z nich nie ma nic wspólnego z generatorami tekstu.
Do tego jeszcze jeden przypadek, o którym łatwo zapomnieć: strony, których treść dla czytelnika nie ma sensu, ale zawiera frazy z wyszukiwarki. To nadal istnieje, głównie w postaci automatycznie mnożonych stron „usługa + miasto”.
Marcowe zmiany to trzy punkty i mieszanie ich prowadzi do złych wniosków.
Nadużycie wygasłych domen — kupowanie wygasłej domeny z historią i stawianie na niej treści niezwiązanej z tym, czym była, żeby skorzystać z resztek jej reputacji. Ta zasada obowiązuje od ogłoszenia.
Nadużycie reputacji witryny — publikowanie w zaufanej domenie treści przygotowanych przez podmiot trzeci, praktycznie bez nadzoru wydawcy i bez powiązania z jego działalnością. Najczęściej chodzi o katalogi z kuponami rabatowymi albo sekcje „artykuły partnerów” w serwisach informacyjnych. Tu Google dało dwa miesiące na dostosowanie i egzekwowanie ma zacząć się 5 maja, czyli w przyszłym tygodniu.
Jeśli prowadzisz serwis, który wynajmuje komukolwiek podkatalog albo subdomenę, to jest ostatni moment, żeby to przejrzeć. Nie chodzi o zakaz publikowania materiałów partnerskich, a o brak nadzoru redakcyjnego i o to, że taka sekcja korzysta z reputacji domeny, nie budując jej.
Odpowiadam na to pytanie co tydzień, więc powiem wprost: zasada nie zakazuje używania narzędzi. Google od lutego 2023 mówi to samo — ocenia jakość, nie sposób wytworzenia, a treść tworzona z myślą o pozycjach jest naruszeniem niezależnie od tego, kto ją napisał.
Granica przebiega w miejscu, w którym narzędzie przestaje być pomocą, a zaczyna być fabryką. Konspekt, przeredagowanie własnego akapitu, skrócenie zbyt długiego opisu, propozycja tytułów, tłumaczenie do dalszej redakcji — to praca z narzędziem. Wygenerowanie stu tekstów z listy fraz i wrzucenie ich do CMS-a bez czytania to produkcja masowa i dokładnie o niej mówi zasada.
Test, którego używam przy ocenie procesu u klienta, jest jeden: czy dla każdej publikowanej strony ktoś w firmie jest w stanie powiedzieć, komu ta strona pomaga i co wnosi ponad to, co już jest w wynikach. Jeśli odpowiedź brzmi „mamy tę frazę w arkuszu”, to nie jest odpowiedź.
Nie potrzeba do tego narzędzi za setki złotych. Wystarczy raport stron w Search Console i godzina spokoju.
Najpierw skala: ile serwis ma zaindeksowanych adresów i czy potrafię wyjaśnić, skąd wzięła się ta liczba. Serwis usługowy z pięćdziesięcioma podstronami i osiemnastoma tysiącami adresów w indeksie ma problem strukturalny, nawet jeśli nikt nie generował tekstów.
Potem szablony: czy istnieją grupy stron różniące się wyłącznie jednym słowem — nazwą miasta, marką, rozmiarem. Jeśli tak, sprawdzam, czy różni się w nich cokolwiek poza tym słowem.
Dalej pochodzenie treści: czy w serwisie są sekcje z tłumaczeniami, cudzymi opisami producenta, materiałami partnerskimi, kanałami z zewnątrz. Każda taka sekcja to kandydat do przeglądu.
Na koniec sprawdzam liczbę adresów, które przez ostatnie pół roku nie zebrały ani jednego kliknięcia. To nie jest naruszenie zasad samo w sobie, ale zwykle właśnie tam siedzi masa, o którą chodzi.
Naruszenie zasad spamowych to inna sytuacja niż spadek po aktualizacji podstawowej i wymaga innej reakcji.
Możliwe skutki są dwa. Systemy automatyczne mogą po prostu przestać brać takie strony pod uwagę — wtedy w Search Console nie ma żadnego komunikatu, a adresy przechodzą do statusu „wykryta, obecnie niezaindeksowana”. Albo zespół Google nakłada działanie ręczne, które widać w osobnym raporcie w Search Console. W marcu wielu właścicieli serwisów zobaczyło tam wpis o czystym spamie.
Przy działaniu ręcznym kolejność jest sztywna: usunąć albo wyłączyć z indeksu wszystko, co narusza zasadę, opisać w zgłoszeniu, co konkretnie zostało zrobione, i złożyć wniosek o ponowne rozpatrzenie. Bez faktycznego usunięcia problemu wniosek jest stratą czasu, a kolejny rozpatruje się dłużej.
Przy cichym ignorowaniu przez systemy nie ma do kogo pisać. Zostaje decyzja, której nikt nie lubi: skasować dużą część serwisu i zostawić to, co ma sens. Rozumiem opór — ktoś za te teksty zapłacił. Ale koszt utrzymywania kilku tysięcy stron, których nikt nie czyta, jest dziś wyższy niż koszt ich napisania.
Używamy plików cookies, aby ułatwić Ci nawigację oraz wykonywanie określonych funkcji. Szczegółowe informacje o wszystkich plikach cookies znajdziesz w każdej kategorii zgody poniżej.
Pliki cookies oznaczone jako "Niezbędne" są przechowywane w Twojej przeglądarce, ponieważ są one kluczowe dla zapewnienia podstawowych funkcji strony.
Używamy również plików cookies firm trzecich, które pomagają nam analizować, w jaki sposób korzystasz z tej strony, zapamiętują Twoje preferencje oraz dostarczają treści i reklamy odpowiednie dla Ciebie. Te pliki cookies będą przechowywane w Twojej przeglądarce tylko za Twoją uprzednią zgodą.
Możesz zdecydować, czy chcesz włączyć lub wyłączyć niektóre bądź wszystkie te pliki cookies, jednak wyłączenie niektórych z nich może wpłynąć na Twoje doświadczenia podczas przeglądania strony.
| Cookie | Czas przechowywania | Opis |
|---|---|---|
| __cf_bm | 13 minutes | Cloudflare bot management — distinguishes humans from bots. |
| rc::* | Persistent | Google reCAPTCHA — localStorage holding anti-bot challenge state. |
| Cookie | Czas przechowywania | Opis |
|---|---|---|
| wpEmojiSettingsSupports | Session | WordPress — sessionStorage flag caching whether the browser can render emoji (feature detection). |
| ytidb* | Persistent | YouTube — IndexedDB storing playback/search state for embedded videos. |
| Cookie | Czas przechowywania | Opis |
|---|---|---|
| _ga_* | 400 days | Google Analytics 4 — persists session state per property. |
| _ga | 400 days | Google Analytics — distinguishes unique users via a client id. |
| Cookie | Czas przechowywania | Opis |
|---|---|---|
| NID | 183 days | Google — stores preferences for personalized ads. |
| fr | 90 days | Meta — encrypted Facebook id and browser id for ads. |
| _gcl_au | 90 days | Google AdSense/Ads — experiments with advertising efficiency (conversion linker). |
| Cookie | Czas przechowywania | Opis |
|---|---|---|
| __Secure-YNID | 180 days | |
| YSC | Session | |
| __Secure-ROLLOUT_TOKEN | 180 days | |
| VISITOR_INFO1_LIVE | 180 days | |
| VISITOR_PRIVACY_METADATA | 180 days | |
| datr | 400 days | |
| sb | 400 days | |
| wd | 7 days |