Regex w Search Console: filtry, które ujawniają pytania

Raport skuteczności w Search Console potrafi zwrócić kilkadziesiąt tysięcy wierszy zapytań. Przewijanie tej listy ręcznie nie ma sensu. Filtr wyrażeń regularnych zamienia ją w narzędzie diagnostyczne: w kilkanaście sekund wyciągasz z niej pytania użytkowników, zapytania brandowe, długi ogon i frazy z intencją zakupową. Poniżej znajdziesz gotowe wzorce, które można wkleić bez zmian, oraz opis pułapek, na które najczęściej wpada się przy pierwszym podejściu.

Gdzie w GSC włączyć filtr regex

Wejdź w raport Skuteczność, kliknij pole Nowy nad wykresem i wybierz Zapytanie. W rozwijanej liście warunków, obok opcji „zawiera” i „dokładnie taki”, znajdziesz pozycję Pasujące do wyrażenia regularnego oraz Niepasujące do wyrażenia regularnego. Ta druga jest równie ważna, bo pozwala odjąć cały segment od reszty danych bez pisania negatywnego lookaheada.

Search Console używa składni RE2, nie PCRE. Konsekwencje są dwie i obie potrafią zaskoczyć. Po pierwsze, RE2 nie obsługuje lookaheadów ani lookbehindów, więc konstrukcje typu (?!marka) zwrócą błąd zamiast wyniku. Po drugie, dopasowanie jest domyślnie częściowe, czyli wzorzec szuka fragmentu w dowolnym miejscu ciągu. Jeśli chcesz dopasować całe zapytanie, musisz sam dodać kotwice ^ i $. Pełną listę obsługiwanych konstrukcji opisuje dokumentacja składni RE2, a samą mechanikę raportu pomoc Google Search Central.

Domyślnie filtr rozróżnia wielkość liter. Prawie zawsze chcesz to wyłączyć, dopisując na początku wzorca flagę (?i). Bez niej „Jak” i „jak” trafią do dwóch różnych segmentów, a dane rozjadą się o kilkanaście procent.

Filtr zapytań pytających

To najbardziej dochodowy filtr w całym zestawie, bo pytania są dokładnie tym materiałem, który modele językowe cytują w odpowiedziach. Zaczynamy od zapytań rozpoczynających się od słowa pytającego:

(?i)^(jak|co|czy|dlaczego|kiedy|gdzie|kto|ile|który|która|które|jaki|jaka|jakie|po co|na co)b

Kotwica ^ jest tu celowa. Bez niej wzorzec złapie każde zapytanie zawierające słowo „co” w środku, łącznie z „narzędzia do raportowania co miesiąc”. Granica słowa b chroni przed dopasowaniem „jakość” do „jak”, co jest najczęstszym błędem w tym filtrze.

Drugi wariant wyłapuje pytania sformułowane opisowo, bez słowa pytającego na początku:

(?i)(jak zrobić|jak działa|czym jest|co to jest|krok po kroku|instrukcja|poradnik|tutorial)

Segment zebrany tymi dwoma filtrami warto porównać z resztą serwisu pod kątem średniej pozycji i CTR. Jeśli pytania mają wyraźnie wyższe wyświetlenia, a niższy CTR niż średnia, to sygnał, że odpowiedź jest już wyświetlana w AI Overviews i użytkownik nie klika. Sposób rozliczenia takiego ruchu opisaliśmy w tekście o tym, jak skonfigurować rozpoznawanie ruchu z ChatGPT i Perplexity w GA4.

Warto też pamiętać, że filtr regex działa na surowym tekście zapytania, a nie na jego znormalizowanej formie. Google nie skleja odmian ani literówek na potrzeby raportu, więc „cennik”, „cenniki” i „cennika” to trzy osobne wiersze. Dlatego wzorce w tym zestawie celowo urywają się na rdzeniu wyrazu, na przykład darmow zamiast darmowy. Zbyt precyzyjny wzorzec gubi dane, a w raporcie skuteczności nie ma żadnego ostrzeżenia, że coś wypadło.

Rozdzielenie marki od reszty zapytań

Dopóki zapytania brandowe siedzą w tym samym zbiorze co reszta, każda średnia jest bez wartości. Marka ma zwykle pozycję poniżej 2 i CTR powyżej 30 procent, więc podnosi wynik całego serwisu i maskuje problemy w segmencie niebrandowym.

Filtr marki powinien obejmować literówki i formy odmienione:

(?i)(nazwamarki|nazwa marki|nazwamark[iay]|nazwamarki.pl)

Segment niebrandowy uzyskujesz tym samym wzorcem, ale z warunkiem Niepasujące do wyrażenia regularnego. To jedyna sensowna droga, bo negacja przez lookahead w RE2 nie zadziała.

Po rozdzieleniu obu zbiorów sprawdź trend miesiąc do miesiąca osobno dla każdego. Typowy scenariusz, który dopiero wtedy staje się widoczny: wyświetlenia całego serwisu rosną, bo rośnie marka, a segment niebrandowy stoi w miejscu albo spada. Bez tego podziału łatwo ogłosić sukces kampanii contentowej, która niczego nie zmieniła.

Długi ogon: filtr po liczbie słów

RE2 nie ma funkcji liczenia słów, ale można ją odtworzyć przez powtórzenia grupy. Zapytania z co najmniej pięcioma słowami:

^(w+s){4,}w+$

Zapytania krótkie, od jednego do dwóch słów, czyli typowy head:

^w+(sw+)?$

Uwaga na polskie znaki. Klasa w w RE2 domyślnie obejmuje tylko ASCII, więc „ś” czy „ż” nie zostaną dopasowane i zapytania z diakrytykami wypadną ze zbioru. To cichy błąd, który potrafi wyciąć połowę danych bez żadnego komunikatu. Bezpieczniejszy wariant używa dopełnienia białych znaków:

^(S+s){4,}S+$

Długi ogon to zwykle zapytania o zerowym wolumenie w Keyword Plannerze, przez co wypadają z klasycznego procesu planowania treści. Metodę wyceny takich fraz rozwijamy w osobnym materiale o tym, jak wyceniać frazy bez wolumenu.

Intencja zakupowa i porównawcza

Trzy segmenty warto trzymać osobno, bo wymagają różnych typów stron docelowych.

Intencja transakcyjna:

(?i)(cena|cennik|koszt|ile kosztuje|kup|kupić|zamów|promocja|rabat|za darmo|darmow)

Intencja porównawcza:

(?i)(vs|versus|czy lepiej|porównanie|porownanie|alternatywa|alternatywy|zamiennik|ranking|najlepsz)

Intencja lokalna i usługowa:

(?i)(w pobliżu|blisko mnie|warszawa|kraków|wrocław|poznań|gdańsk|agencja|firma|usługi)

Zestawienie tych trzech filtrów z listą stron docelowych szybko ujawnia rozjazd. Jeśli zapytania porównawcze trafiają na artykuł poradnikowy zamiast na zestawienie, pozycja będzie się trzymać w okolicach dziesiątego wyniku niezależnie od jakości tekstu, bo format nie odpowiada intencji.

Łączenie filtrów zapytania i strony

Prawdziwa wartość regexa pojawia się, gdy nałożysz na siebie filtr zapytania i filtr strony. Search Console pozwala trzymać oba jednocześnie, a wynik odpowiada na pytanie „które konkretnie URL-e odpowiadają na pytania użytkowników”.

Przykładowy scenariusz diagnostyczny wygląda tak. Najpierw ustawiasz filtr strony na jeden katalog, na przykład /blog/, potem filtr zapytania na wzorzec pytający. Sortujesz po wyświetleniach i patrzysz, ile różnych adresów zbiera te same pytania. Jeśli trzy artykuły dzielą ten sam zestaw zapytań pytających i żaden nie wchodzi do pierwszej piątki, masz klasyczną kanibalizację, którą trzeba rozwiązać scaleniem albo przebudową. Procedurę wykrywania i naprawy opisaliśmy w tekście o kanibalizacji słów kluczowych.

Drugi układ, który warto sprawdzić: filtr strony na wzorzec (?i)/(2023|2024)/ plus filtr zapytania na frazy z rokiem bieżącym. To zwykle lista treści do aktualizacji, posortowana według realnego popytu, a nie według daty publikacji.

Jak zapisać zestaw filtrów dla zespołu

Search Console nie ma funkcji zapisanych widoków, ale ma coś prawie równie dobrego: cały stan filtrów siedzi w adresie URL. Po ustawieniu filtra skopiuj adres z paska przeglądarki i wklej go do dokumentacji zespołu. Link odtworzy dokładnie ten sam widok u każdej osoby z dostępem do usługi.

Praktyczny minimalny zestaw, który wystarczy większości serwisów, obejmuje sześć zakładek: pytania, marka, nie-marka, długi ogon, transakcyjne, porównawcze. Warto trzymać je w jednej tabeli razem z kolumną „co sprawdzamy” i „próg alarmowy”, żeby przegląd był powtarzalny.

Segment Wzorzec Na co patrzeć
Pytania (?i)^(jak|co|czy|dlaczego|ile)b Spadek CTR przy stałych wyświetleniach
Marka (?i)nazwamark Trend wyświetleń, świadomość marki
Nie-marka ten sam wzorzec z negacją Realny wzrost widoczności
Długi ogon ^(S+s){4,}S+$ Nowe tematy do pokrycia
Transakcyjne (?i)(cena|kup|cennik) Dopasowanie strony docelowej
Porównawcze (?i)(vs|ranking|alternatywa) Braki w formacie zestawień

Gdy zestaw filtrów zaczyna być przeglądany co tydzień, ręczne klikanie przestaje wystarczać. Wtedy przenosi się go do eksportu przez API, gdzie te same wyrażenia można wpisać jako wymiar filtrujący i zrzucać wyniki do arkusza albo hurtowni. Konfigurację tej ścieżki opisuje przewodnik po zaawansowanych zapytaniach GSC API i eksporcie do BigQuery.

Jak czytać wynik, żeby nie wyciągnąć złego wniosku

Każdy z tych filtrów zwraca segment, a segment ma własną charakterystykę pozycji i CTR. Zapytania pytające mają naturalnie dłuższą formę, więc siłą rzeczy niższy wolumen i wyższą pozycję. Zapytania transakcyjne mają odwrotny profil: krótsze, bardziej konkurencyjne, z gorszą średnią pozycją. Porównywanie tych dwóch zbiorów wprost prowadzi donikąd.

Sensowna procedura wygląda tak: ustawiasz filtr, porównujesz okres do okresu w obrębie tego samego segmentu i dopiero wtedy oceniasz zmianę. Minimalny horyzont to 28 dni, a przy niskim ruchu 90 dni, bo krótsze okna są zdominowane przez wahania tygodniowe. Osobno sprawdź liczbę unikalnych zapytań w segmencie, nie tylko sumę wyświetleń. Rosnąca liczba różnych fraz przy stałych wyświetleniach oznacza, że serwis zaczyna łapać nowe tematy, nawet jeśli sumaryczny wykres wygląda płasko.

Ostatnia rzecz: dane w Search Console są próbkowane i anonimizowane. Zapytania o bardzo niskim wolumenie są usuwane z raportu, żeby nie dało się zidentyfikować użytkownika. To oznacza, że segment długiego ogona zawsze będzie zaniżony względem stanu faktycznego, i żaden filtr tego nie naprawi. Traktuj go jako próbkę kierunkową, a nie pełny obraz.

Trzy błędy, które psują wyniki

Po pierwsze, brak flagi (?i). Wzorzec działa, zwraca dane, tylko o kilkanaście procent za mało, więc nikt nie zauważa problemu.

Po drugie, użycie w przy polskich zapytaniach. Diakrytyki wypadają cicho, a segment długiego ogona robi się nieprawdziwie mały.

Po trzecie, porównywanie segmentu przefiltrowanego z niefiltrowaną sumą serwisu. Jeśli w jednym oknie masz segment pytań, a w drugim całość, każda różnica procentowa jest artefaktem doboru zbioru, a nie zmianą w wynikach.

FAQ

Czy filtr regex w Search Console rozróżnia wielkość liter

Tak, domyślnie rozróżnia. Żeby to wyłączyć, dodaj na początku wzorca flagę (?i), na przykład (?i)^jakb. Bez niej zapytania pisane wielką literą trafią poza segment.

Dlaczego mój wzorzec z lookaheadem zwraca błąd

Search Console korzysta ze składni RE2, która nie obsługuje lookaheadów ani lookbehindów. Zamiast negatywnego lookaheada użyj tego samego wzorca z warunkiem „Niepasujące do wyrażenia regularnego”.

Jak odfiltrować zapytania o określonej liczbie słów

Użyj powtórzenia grupy: ^(S+s){4,}S+$ dopasuje zapytania o co najmniej pięciu słowach. Klasa S jest bezpieczniejsza niż w, bo obejmuje polskie znaki diakrytyczne.

Ile zapytań pokazuje raport po nałożeniu filtra

Filtr działa na tym samym zbiorze co raport, więc limit 1000 wierszy w interfejsie nadal obowiązuje, ale wykres i sumy nad tabelą liczą się z całego przefiltrowanego zbioru. Po pełne dane sięgnij po eksport przez API lub Bulk Export.

Czy da się zapisać ustawiony filtr na stałe

Nie ma funkcji zapisanych widoków, ale stan filtrów jest zakodowany w adresie URL raportu. Skopiowanie i udostępnienie tego adresu odtwarza identyczny widok u innej osoby z dostępem do usługi.

Czy regex działa też na filtrze stron

Tak, ten sam typ warunku jest dostępny dla wymiaru Strona. Połączenie filtra strony i filtra zapytania to najszybsza metoda wykrywania kanibalizacji w obrębie jednego katalogu.