Dlaczego AI cytuje konkurencję zamiast Ciebie: 8 przyczyn

Jeśli zadajecie sobie pytanie, dlaczego AI nie cytuje mojej strony, choć konkurent z gorszym rankingiem w Google pojawia się w odpowiedziach ChatGPT, Perplexity i Gemini, odpowiedź prawie zawsze mieści się w ośmiu powtarzalnych przyczynach. Żadna z nich nie dotyczy „algorytmu, który was nie lubi”. Każda ma test, który potwierdza ją w kilkanaście minut, i poprawkę, którą da się wdrożyć bez przebudowy serwisu.

W skrócie:

  • Modele cytują fragmenty, nie strony: brak akapitu, który odpowiada wprost, to najczęstsza przyczyna pominięcia.
  • Co czwarta pominięta domena w naszych audytach blokowała boty AI na poziomie serwera lub CDN, często nieświadomie.
  • Marka bez wzmianek poza własną domeną przegrywa z marką, o której piszą inni, nawet przy słabszej treści.
  • Świeżość, format i język odpowiadają za pozostałe przypadki i da się je naprawić w 30 dni.

Jak sprawdzić, kogo model cytuje w waszej kategorii

Diagnozę zaczynacie od pomiaru, nie od zgadywania. Przygotujcie 20–30 pytań, które zadaje wasz klient (nie fraz kluczowych, tylko pełnych pytań w języku naturalnym), i zadajcie każde z nich w ChatGPT z włączonym wyszukiwaniem, w Perplexity oraz w Google AI Mode. Zapiszcie w arkuszu każdą cytowaną domenę i pozycję cytatu w odpowiedzi.

Po trzech rundach (modele nie są deterministyczne, więc jedno zapytanie to za mało) zobaczycie rozkład: zwykle 3–5 domen zbiera ponad połowę cytowań w danej kategorii. Mechanikę, która stoi za tym wyborem, opisujemy w tekście o tym, jak działa RAG w wyszukiwarkach AI: model najpierw pobiera kandydatów z indeksu, potem tnie ich na fragmenty i dopiero z tych fragmentów buduje odpowiedź. Każda z ośmiu przyczyn poniżej to awaria na jednym z tych etapów.

Przyczyna 1: treść nie odpowiada na pytanie wprost

Model szuka akapitu, który da się wkleić jako odpowiedź, a nie strony, która „porusza temat”. Jeśli wasz artykuł o kosztach wdrożenia zaczyna się od trzech akapitów historii branży, a liczba pojawia się dopiero w połowie tekstu, fragment z konkurencji, który w pierwszym zdaniu podaje „od 8 do 15 tys. zł netto”, wygra bez względu na autorytet domeny.

Test: otwórzcie stronę i sprawdźcie, czy w pierwszych 100 słowach każdej sekcji H2 jest zdanie, które samodzielnie odpowiada na pytanie z nagłówka. Jeśli nagłówek brzmi „Ile trwa wdrożenie”, a pierwsze zdanie nie zawiera jednostki czasu, sekcja przegrywa.

Przyczyna 2: brak fragmentów gotowych do zacytowania

Systemy RAG dzielą stronę na kawałki o długości mniej więcej 200–400 tokenów i oceniają każdy osobno. Akapit na 12 zdań, w którym definicja, wyjątek i przykład są splecione, daje słabą ocenę dopasowania dla każdego pytania, bo pasuje do wszystkich po trochu. Trzy krótkie akapity, każdy o jednej rzeczy, wygrywają z jednym długim.

Test: policzcie zdania w akapitach. Jeśli mediana przekracza 5, treść nie jest „chunkowalna”. Tabele porównawcze i listy numerowane mają dodatkową przewagę: model wyciąga z nich dane bez interpretacji. Które z tych sygnałów liczą się najbardziej w wyszukiwarce OpenAI, rozbieramy w analizie czynników cytowań w ChatGPT Search 2026.

Przyczyna 3: blokada botów AI po stronie serwera

To przyczyna najbardziej banalna i najczęściej przeoczona. GPTBot, OAI-SearchBot, PerplexityBot, ClaudeBot i Google-Extended to osobne aplikacje klienckie. Wiele hostingów, wtyczek bezpieczeństwa i konfiguracji Cloudflare blokuje je domyślnie, a właściciel strony widzi w Search Console, że Googlebot indeksuje wszystko bez zarzutu. OpenAI utrzymuje publiczną listę swoich botów wraz z zakresami adresów IP, które można zweryfikować w logach.

Test: trzy kroki. Po pierwsze, sprawdźcie robots.txt pod kątem reguł Disallow dla wymienionych botów. Po drugie, wykonajcie zapytanie curl z nagłówkiem User-Agent ustawionym na GPTBot i porównajcie kod odpowiedzi z kodem dla zwykłej przeglądarki: 403 lub 429 zamiast 200 oznacza blokadę na poziomie WAF. Po trzecie, przejrzyjcie logi serwera z ostatnich 14 dni: jeśli nie ma w nich ani jednego wpisu OAI-SearchBot, a strona istnieje od miesięcy, bot nie dociera do treści.

Przyczyna 4: słaby sygnał marki i wzmianek

Model, który ma do wyboru dwa równie dobre fragmenty, wybiera ten z domeny, którą „zna” z danych treningowych i z innych źródeł w indeksie. Ta znajomość bierze się z wzmianek: artykułów branżowych, wpisów na Wikipedii, cytowań w raportach, dyskusji na forach. Domena, o której nikt nie pisze poza nią samą, nie ma w modelu żadnej reprezentacji jako podmiot (encja), więc jej treść jest oceniana wyłącznie po jakości fragmentu.

Test: wpiszcie w ChatGPT nazwę waszej firmy bez kontekstu i poproście o opis. Jeśli model nie wie, czym się zajmujecie, lub myli was z inną firmą, brakuje sygnału encji. Porównajcie wynik z konkurencją, która pojawia się w cytowaniach: w większości przypadków model opisze ją poprawnie.

Przyczyna 5: dane rozproszone na wielu podstronach

Konkurent ma jedną stronę „Cennik i czas wdrożenia”, wy macie cennik na jednej podstronie, czas wdrożenia w FAQ, a zakres w PDF do pobrania. Na pytanie „ile kosztuje i ile trwa wdrożenie X” model znajdzie u konkurenta jeden fragment z pełną odpowiedzią, a u was trzy niekompletne. Wygrywa fragment kompletny.

Test: dla każdego z 20 pytań z pierwszego kroku wskażcie jedną podstronę, która odpowiada na nie w całości. Jeśli dla któregoś pytania musicie wskazać dwie lub więcej, macie kandydata do konsolidacji.

Przyczyny 6, 7 i 8: świeżość, format i język

Trzy pozostałe przyczyny występują rzadziej, ale każda z osobna potrafi wyzerować cytowania w konkretnej niszy.

Przyczyna Objaw Test
6. Świeżość Model cytuje artykuł konkurenta z datą z tego roku, wasz ma datę sprzed dwóch lat, choć treść jest aktualna. Sprawdźcie, czy strona ma widoczną datę aktualizacji i pole dateModified w schema.org. Brak obu to sygnał „stare”.
7. Format Kluczowe dane są w grafice, w PDF, w karuzeli JavaScript lub za zakładką ładowaną po kliknięciu. Wyłączcie JavaScript w przeglądarce i odświeżcie stronę. Czego nie widać, tego nie widzi też większość botów AI.
8. Język Pytanie pada po polsku, a wasza najlepsza treść jest po angielsku (lub odwrotnie). Zadajcie to samo pytanie w obu językach. Jeśli cytowania pojawiają się tylko w jednym, brakuje wersji językowej, a nie treści.

Przyczyna siódma jest szczególnie podstępna w Google. Model stojący za AI Overviews korzysta z indeksu Google, więc renderowanie JavaScript teoretycznie działa, ale zakładki i akordeony ładowane na żądanie często nie trafiają do fragmentu wybranego do source boxa. Jak wygląda ten wybór od strony Google, pokazujemy w tekście o optymalizacji pod Google AI Overviews.

Plan naprawczy na 30 dni

Kolejność ma znaczenie: najpierw usuwacie blokady (bez tego reszta nie zadziała), potem poprawiacie fragmenty, na końcu budujecie sygnał marki, bo on działa najwolniej.

  1. Dni 1–3: dostęp. Odblokujcie boty AI w robots.txt i w WAF. Zweryfikujcie curlem kod 200 dla każdego z pięciu głównych agentów. Zapiszcie datę, od której liczycie efekty.
  2. Dni 4–10: pięć stron priorytetowych. Wybierzcie pięć podstron odpowiadających na pytania z największą liczbą cytowań konkurencji. Do każdej sekcji H2 dopiszcie pierwsze zdanie z bezpośrednią odpowiedzią. Skróćcie akapity do maksymalnie czterech zdań.
  3. Dni 11–17: konsolidacja. Połączcie rozproszone dane w jedną podstronę na temat. Dodajcie tabelę tam, gdzie porównujecie liczby. Ustawcie przekierowania 301 ze stron wchłoniętych.
  4. Dni 18–24: świeżość i format. Dodajcie widoczną datę aktualizacji i dateModified. Przenieście dane z grafik i PDF do tekstu HTML.
  5. Dni 25–30: wzmianki. Zdobądźcie 3–5 wzmianek o marce poza własną domeną: komentarz eksperta w branżowym medium, wpis gościnny, obecność w zestawieniu narzędzi. Liczy się nazwa firmy w tekście, nie sam link.

Po 30 dniach powtórzcie pomiar z pierwszego kroku na tych samych 20–30 pytaniach. Realistyczny cel dla strony, która wcześniej miała zero cytowań, to pojawienie się w 10–20% odpowiedzi w swojej kategorii; w Perplexity efekt widać najszybciej, w ChatGPT zwykle po kilku tygodniach od odblokowania botów.

Najczęstsze błędy w diagnozie

Pierwszy błąd to pomiar na jednym zapytaniu i jednej sesji. Modele losują, więc brak cytowania w jednej odpowiedzi nic nie znaczy; dopiero brak w trzech rundach na 20 pytaniach jest sygnałem. Drugi błąd to naprawianie treści przed sprawdzeniem dostępu: tygodnie pracy redakcyjnej nie pomogą, jeśli bot dostaje 403. Trzeci błąd to mylenie pozycji w Google z szansą na cytowanie: pozycja pomaga wejść do puli kandydatów, ale o wyborze fragmentu decyduje jego forma, nie ranking strony.

FAQ: najczęstsze pytania

Dlaczego AI nie cytuje mojej strony, choć jest na pierwszej stronie Google?

Pozycja w Google wprowadza stronę do puli kandydatów, ale model cytuje fragment, nie stronę. Jeśli sekcja nie zaczyna się od bezpośredniej odpowiedzi, akapity są długie, a dane siedzą w grafice, fragment konkurenta z pozycji 8 wygra z waszym z pozycji 2. Sprawdźcie też, czy boty AI w ogóle mają dostęp; to osobna ścieżka niż Googlebot.

Jak sprawdzić, czy moja strona blokuje boty AI?

Trzy kroki: reguły w robots.txt dla GPTBot, OAI-SearchBot, PerplexityBot, ClaudeBot i Google-Extended; zapytanie curl z podmienionym User-Agent i porównanie kodu odpowiedzi (200 kontra 403 lub 429); przegląd logów serwera z 14 dni pod kątem obecności tych agentów. Brak wpisów w logach przy stronie istniejącej od miesięcy oznacza blokadę wyżej, zwykle w CDN lub WAF.

Ile trwa, zanim zmiany zaczną przekładać się na cytowania?

Perplexity odświeża indeks najszybciej i pierwsze cytowania potrafią pojawić się w ciągu 1–2 tygodni od odblokowania botów i poprawy fragmentów. ChatGPT Search i AI Overviews reagują wolniej, zwykle w perspektywie 3–6 tygodni. Sygnał marki (wzmianki) działa w skali miesięcy, dlatego uruchamiacie go równolegle, a nie na końcu.

Czy dodanie FAQ na stronie wystarczy, żeby model zaczął cytować?

Nie, ale pomaga. FAQ daje krótkie, samodzielne fragmenty w formie pytanie plus odpowiedź, czyli dokładnie to, czego szuka system RAG. Jeśli jednak strona blokuje boty, dane są rozproszone, a marki nikt nie zna, samo FAQ nie zmieni wyniku. Traktujcie je jako element drugiego tygodnia planu naprawczego, nie jako całą strategię.

Czy wzmianki bez linku naprawdę mają znaczenie dla cytowań AI?

Tak. Model buduje reprezentację marki z tekstu, w którym pojawia się jej nazwa w kontekście branży, produktu i lokalizacji. Link jest sygnałem dla Google, wzmianka jest sygnałem dla modelu językowego.

Co dalej

Po wykonaniu pomiaru z pierwszego kroku macie listę domen, z którymi konkurujecie o cytowania, i listę pytań, na które przegrywacie. Zanim zaczniecie poprawiać treść, warto zrozumieć, jak wygląda pełna ścieżka od zapytania do odpowiedzi; tłumaczymy ją w przewodniku o działaniu RAG w wyszukiwarkach AI.