Cytaty AI

Jak silniki odpowiedzi AI wybierają strony do cytowania — różnica między retrieved, mentioned i cited, dlaczego cytat nie jest rankingiem ani backlinkiem oraz co zwiększa szansę cytowania strony w Google AI Overviews, ChatGPT, Perplexity i Copilocie.

Opublikowano po raz pierwszy: 3 lip 2026 · Ostatnia aktualizacja: 8 sie 2026 · Advanced
Języki

Cytat AI to przypisany odsyłacz do źródła, który silnik odpowiedzi AI pokazuje obok wygenerowanego tekstu. Jest ostatnim z trzech odrębnych stanów — retrieved (AI przeczytało stronę, co widać tylko w logach), mentioned (marka wymieniona bez linku) i cited (URL pokazany jako źródło) — a większość narzędzi widzi tylko jeden z nich. Cytowanie działa przez RAG nad tym samym głównym indeksem, który zasila ranking, więc warunkiem jest możliwość crawlowania, indeksowania i uzyskania fragmentu. Nie jest to jednak ranking ani backlinki: badania Ahrefs wskazują na ostry spadek udziału organicznej dziesiątki w cytatach AI Overview między połową 2025 a początkiem 2026 r. (około 76% do około 38%), choć dokładne porównanie metodologii nie zostało niezależnie zweryfikowane — traktuj kierunek, nie precyzyjne liczby, jako ustalony. Wzmianki o marce w sieci lepiej przewidują widoczność AI niż Domain Rating, a około 90% cytatów o marce pochodzi ze stron trzecich. Cytat rzadko przynosi kliknięcie, a jego obecność nigdy nie dowodzi, że źródło wspiera sąsiednie twierdzenie — to osobne sprawdzenie.

W OpenAI deklarowanym celem OAI-SearchBot jest widoczność w wyszukiwaniu, natomiast GPTBot ma osobną kontrolę treningu. Evidence for this claim OpenAI identifies OAI-SearchBot as the crawler used to link to and surface websites in ChatGPT search results, separately from GPTBot training controls. Scope: OpenAI-declared crawler behavior; selection and citation are not guaranteed. Confidence: high · Verified: OpenAI: Crawlers W Google wybór odsyłaczy wspierających może korzystać z query fan-out wykraczającego poza jeden zestaw wyników. Evidence for this claim Google says AI Overviews and AI Mode show supporting links and can use query fan-out to find a wider and more diverse set of relevant pages. Scope: Google Search AI features; link selection is system-dependent. Confidence: high · Verified: Google: AI features and your website Samo pojawienie się cytatu nigdy nie jest dowodem, że cytowana strona potwierdza sąsiednie twierdzenie — to osobne sprawdzenie nałożone na atrybucję.

Evidence for this claim Citation presence alone is not proof the cited source supports the adjacent generated statement; a study of four 2023 generative search systems found meaningful gaps between citation recall and citation precision. Scope: Findings from evaluated 2023 generative search systems (Bing Chat, NeevaAI, Perplexity, YouChat); supports the general citation-verifiability distinction, not current-system rates. Confidence: high · Verified: Liu, Zhang & Liang: Evaluating Verifiability in Generative Search Engines (EMNLP 2023)

TL;DR — Cytat AI to przypisane źródło pokazane obok tekstu wygenerowanego przez AI, wybrane podczas generowania z tego, co system pobrał przez RAG — a nie uszeregowane na liście. To ostatni z trzech stanów: retrieved (zalogowane żądanie strony; nie dowód, że treść trafiła do kontekstu modelu), mentioned (nazwa w tekście, bez linku) i cited (przypisany URL). Google opiera AI Overviews na swoim głównym indeksie, więc strona musi być zindeksowana i kwalifikować się do fragmentu, aby można ją było cytować — ale cytat ≠ ranking (badania Ahrefs wskazują na gwałtowny spadek udziału pierwszej dziesiątki, z około 76% do około 38% między połową 2025 a początkiem 2026 r.; dokładne porównanie metodologii obu badań nadal nie jest zweryfikowane) i ≠ backlinki (wzmianki o marce w sieci korelują z widocznością AI na poziomie około 0,66, wobec około 0,33 dla Domain Rating). Około 90% cytatów dotyczących marki pochodzi ze stron trzecich, a platformy cytują skrajnie różnie (Perplexity cytuje prawie wszystko, co pobiera; ChatGPT prawie nic). Nawet cytat zwykle nie przynosi kliknięcia — i nigdy nie jest dowodem, że źródło potwierdza twierdzenie obok niego.

Cytat jest ostatnim z trzech stanów, nie całym obrazem

Citation is one observable state, not shorthand for every way a system may have used your content. Źródło: /ai-search/measurement-and-reporting/retrieved-mentioned-cited/

Retrieved means a system requested or fetched the content, evidenced by logs or retrieval traces — that request is not proof the content reached the model's context. Mentioned means the answer used the brand, entity, or facts in its prose, evidenced by the answer text. Cited means the interface exposed a source link or citation to the page, evidenced by a visible source URL. These states need separate measurement.

© Patrick Stox LLC · CC BY 4.0 ·

Zacznij od rozróżnienia, które usuwa większość zamieszania pomiarowego. Treść może znajdować się w jednym, dwóch albo wszystkich trzech stanach naraz — a każdy wymaga innego narzędzia obserwacji:

  • Retrieved. Trafienie w logach crawlera AI albo bota wnioskowania na żywo pokazuje, że strona otrzymała żądanie podczas przetwarzania zapytania. To prawdziwy dowód pobrania — ale żądanie w logach nie jest dowodem, że treść trafiła do kontekstu modelu ani że w ogóle jej użyto; logi pokazują to, o co poproszono, nie to, co wybrano. Da się to wykryć wyłącznie w logach serwera (user-agenty crawlerów AI) i jest niewidoczne dla narzędzi analizujących tylko odpowiedzi AI.
  • Mentioned. Nazwa marki, produktu lub osoby pojawia się w wygenerowanym tekście — bez hiperłącza. AI „wie o Tobie” z danych treningowych albo pobranej treści i wymienia Cię bez atrybucji. Mierzą to narzędzia analizy odpowiedzi, takie jak Ahrefs Brand Radar.
  • Cited. URL strony pokazany jako przypisane źródło — klikalny link, numerowane odwołanie albo nazwane pole źródła. Wymaga, aby AI zarówno pobrało treść, jak i uznało ją za wartą przypisania.

Luki między tymi stanami są całą historią. Treść może zostać pobrana bez wspomnienia, wspomniana bez cytatu, a także — w odwrotnym problemie „ghost citation” — zacytowana bez pojawienia się nazwy marki w tekście. Żądanie zaobserwowane w logach to odrębne, słabsze twierdzenie niż „wybrano do odpowiedzi” — traktuj retrieval jako dowód pobrania, nie dowód użycia. (Osobne ujęcie retrieved / mentioned / cited zasługuje na własne opracowanie; ten artykuł skupia się na końcu mechaniki cytowania).

Jak powstaje cytat: RAG nad aktywnym indeksem

Cytaty są wynikiem Retrieval-Augmented Generation — wzorca „najpierw pobierz, potem generuj”, stojącego za każdą większą wyszukiwarką odpowiedzi AI. Własna definicja Google wiąże go bezpośrednio z groundingiem: RAG to “a technique (also known as grounding) used to improve the quality, accuracy, and freshness of AI responses by relying on our core Search ranking systems to retrieve relevant, up-to-date web pages from our Search index.” (tłumaczenie) technika (znana także jako grounding), która poprawia jakość, dokładność i świeżość odpowiedzi AI przez wykorzystanie głównych systemów rankingowych Search do pobierania odpowiednich, aktualnych stron z indeksu Search. (dla samego pipeline’u retrieval — chunkingu, embeddingów, wyszukiwania wektorowego i rerankingu — zobacz siostrzane opracowania; tutaj interesuje mnie krok atrybucji).

Z tej definicji wynikają bezpośrednio dwa wnioski, które Google stwierdza wprost:

  • Nie ma osobnego indeksu AI. AI Overviews pobierają dane z tego samego głównego indeksu Search co zwykłe wyniki, więc “a page must be indexed and eligible to be shown in Google Search with a snippet, fulfilling the Search technical requirements. There are no additional technical requirements.” (tłumaczenie) strona musi być zindeksowana i kwalifikować się do pokazania w Google Search z fragmentem, spełniając wymagania techniczne Search. Nie ma dodatkowych wymagań technicznych. Crawlable, indeksowalna i kwalifikowana do fragmentu — to próg cytowania. Zablokuj Googlebota albo zwracaj błędy, a strona całkowicie traci kwalifikację.
  • Retrieval jest szerszy niż pojedyncze zapytanie. Google wykonuje query fan-out: “Both AI Overviews and AI Mode may use a ‘query fan-out’ technique — issuing multiple related searches across subtopics and data sources — to develop a response.” (tłumaczenie) AI Overviews i AI Mode mogą używać techniki „query fan-out” — wykonywać wiele powiązanych wyszukiwań w podtematach i źródłach danych — aby opracować odpowiedź. Strony są pobierane dla podzapytań, które nigdy nie pojawiają się w widocznej odpowiedzi. To „ciemny” retrieval — treść, która wniosła wkład bez atrybucji.
Evidence for this claim Google says AI Overviews and AI Mode may issue multiple related searches across subtopics and data sources and identify supporting pages while generating a response. Scope: Google Search Confidence: high · Verified: AI features and your website

Na poziomie API architektura wyraźnie pokazuje lukę między pobraniem a cytatem: ugruntowane generowanie Google zwraca tekst modelu z adnotacjami cytatów w tekście, z których każda łączy określony fragment z URL-em źródła — ale pełna lista pobranych źródeł nie jest ujawniana użytkownikowi końcowemu. Widzisz to, co wykorzystano, nie to, co przeczytano.

Dlaczego cytat nie jest rankingiem (i liczba, która to pokazuje)

Jedno z najbardziej użytecznych ustaleń kierunkowych dla osób wykonujących tę pracę: z czasem bycie cytowanym przez AI wydaje się odłączać od pozycji 1. W badaniach Ahrefs (badanie z lipca 2025 r., a następnie aktualizacja z marca 2026 r. wykonana przez Xibeijia Guan) raportowany udział cytatów AI Overviews pochodzących z organicznej dziesiątki miał spaść z około 76% w połowie 2025 r. do około 38% na początku 2026 r. — a niezależna liczba BrightEdge była jeszcze niższa. Zaznaczę to jasno: nie udało mi się niezależnie ponownie zweryfikować dokładnej metodologii i mianownika porównania 76%–38%, więc dopóki ta kontrola nie zostanie wykonana, traktuj kierunek (spadek udziału top 10) jako wniosek, nie precyzyjne wartości procentowe. Własne wyjaśnienie Google szerszego trendu mówi, że więcej źródeł dostarcza query fan-out: AI Overviews coraz częściej pobierają dane z SERP-ów podzapytań, a nie z pierwszej dziesiątki oryginalnego zapytania — ten mechanizm potwierdza bezpośrednio dokumentacja Google, niezależnie od powyższej statystyki.

Dwa praktyczne wnioski:

  • Pozycja 1 dla głównego zapytania nie gwarantuje już cytatu, a brak top 10 nie wyklucza cytowania. Uderzającym przykładem jest YouTube — to najczęściej cytowana domena w AI Overviews, a wiele cytowanych URL-i YouTube nie rankuje nawet w top 100 Google dla danego zapytania. Wideo jest pobierane w dużej mierze niezależnie od klasycznego rankingu.
  • Kwalifikacja do cytowania nadal zależy od klasycznego SEO (indeksowanie + kwalifikacja do fragmentu), nawet gdy wybór cytatu odchodzi od pozycji. Oba fakty są prawdziwe naraz, dlatego zarówno „AI zabiło SEO”, jak i „AI to po prostu SEO” są błędne.

Dlaczego cytat nie jest też backlinkiem

Drugi odruch — „więcej backlinków, więcej cytatów” — również nie znajduje dobrego potwierdzenia w danych. Badanie 75 000 marek Ahrefs autorstwa Louise Linehan i Xibeijia Guan wykazało, że najsilniejszym predyktorem pojawienia się w AI Overviews nie był Domain Rating ani backlinki, lecz wzmianki o marce w sieci, korelujące na poziomie około 0,664, wobec około 0,326 dla Domain Rating i jeszcze niżej dla liczby backlinków. W osobnej analizie, którą przeprowadziłem, wzmianki na stronach z wieloma odsyłaczami również korelowały ze wzmiankami AI.

To zmienia całą optykę. Nie chodzi o to, że autorytet przestał mieć znaczenie — rozmawianie o marce jest po prostu lepszym przybliżeniem tego, co nagradzają systemy AI, niż linkowanie do niej. Ustalenie McKinsey doprecyzowuje obraz: własna witryna marki to tylko około 5–10% źródeł, do których odwołują się platformy AI, omawiając markę. Około 90% cytatów o Tobie żyje na stronach trzecich — u wydawców, na platformach recenzji, w UGC, YouTube i na Reddicie. Jak powiedziałem w wystąpieniu Ahrefs Evolve: dawniej chodziło o “optimize your site” (tłumaczenie) optymalizuj witrynę, a teraz o “optimize how the internet talks about you” (tłumaczenie) optymalizuj sposób, w jaki internet o Tobie mówi. Szesnaście stron w witrynie Zapier, które wspominają Ahrefs, wystarczyło, aby Ahrefs pojawił się w ponad 1 400 odpowiedziach AI — to dźwignia, której nie dorówna żadna liczba poprawek on-site.

Platformy cytują skrajnie różnie

„Bycie cytowanym przez AI” nie jest jednym zachowaniem — ta sama strona może zostać pobrana na dwóch platformach, ale uzyskać przeciwne wyniki atrybucji:

  • Perplexity wykonuje wyszukiwanie w sieci w czasie rzeczywistym dla praktycznie każdego zapytania i jest zbudowane tak, aby przejrzyście pokazywać źródła — ma średnio najwięcej cytatów na odpowiedź z dużych platform i cytuje prawie wszystko, co pobiera. Najrzadziej „wspomina bez cytowania”.
  • ChatGPT w dużej mierze odpowiada z danych treningowych, bez retrieval, a gdy pobiera dane (przez warstwę wyszukiwania opartą na Bing), cytuje tylko małą część pobranych stron. Jego ogólny współczynnik cytowania jest najniższy wśród dużych platform. To najczystsza powierzchnia „wspomniane, ale niecytowane”.
  • Google AI Overviews / AI Mode dołącza cytaty do konkretnych segmentów tekstu, korzysta z głównego indeksu i fan-outu, a — jak wyżej — coraz częściej cytuje poza top 10.
  • Microsoft Copilot ujawnia coś, czego nie pokazują inni: zapytania groundingowe, czyli rzeczywiste frazy użyte do pobrania przywołanej treści. To najbliższy oficjalny odpowiednik pokazania warstwy retrieval.

Wniosek nie polega na ściganiu dziwactw jednej platformy — chodzi o to, że cytowanie jest probabilistyczne i niespójne. Odpowiedzi AI są zmienne; wielokrotne uruchomienie tego samego promptu daje różne listy marek i różne źródła, więc pojedyncze sprawdzenie mówi prawie nic.

Istnieją też udokumentowane granice produktów i trybów, które monitor powinien zapisywać jako odrębne wyniki, zamiast nazywać każdy brakujący link problemem wydawcy:

  • API wyszukiwania internetowego OpenAI: pole sources jest pełnym zestawem URL-i, z których model korzystał, a cytaty w tekście są mniejszym, wybranym zbiorem. Źródło może więc zostać pobrane bez cytowania, a dokumentacja API wymaga, aby widoczne cytaty w tekście były widoczne i klikalne. To kontrakt API, nie dowód, że konsumencki produkt ChatGPT udostępnia te same pola. Evidence for this claim In OpenAI API web search, the sources field lists all consulted URLs while inline citations show only selected relevant references; source count can exceed citation count, and search_context_size guarantees neither. Scope: OpenAI API web search response fields and configuration; not a claim about undisclosed retrieval or ChatGPT consumer-product presentation. Confidence: high · Verified: OpenAI API: Web search — Sources and search context size Evidence for this claim OpenAI requires inline citations to be clearly visible and clickable when an application displays web-search results or information from those results to end users. Scope: OpenAI API web search display contract; this does not assert identical fields or presentation in the ChatGPT consumer product. Confidence: high · Verified: OpenAI API: Web search — Output and citations
  • Microsoft Copilot: konsumencki Voice obecnie nie uruchamia wyszukiwania w sieci, więc brak cytatu jest oczekiwany. Evidence for this claim Microsoft's consumer Copilot transparency note says web-grounded text responses include citations, while voice prompts do not trigger web search and therefore have no citations. Scope: Consumer Microsoft Copilot Voice mode; Microsoft 365 Copilot and text/web-grounded modes have different behavior. Confidence: high · Verified: Microsoft Copilot: Transparency note W Microsoft 365 Copilot, gdy wyszukiwanie działa, widok Sources pokazuje zarówno źródła, jak i dokładne krótkie zapytanie wysłane do Binga; zapytanie pochodne zwykle używa tylko kilku słów z promptu lub pliku. Evidence for this claim Microsoft 365 Copilot's Sources view exposes the exact query sent to Bing and the sources used; the query generally uses a few prompt or uploaded-file words rather than the full input. Scope: Microsoft 365 Copilot Chat and agents when web search runs; organization policy can disable web search. Confidence: high · Verified: Microsoft 365 Copilot: How web search works
  • Gemini Apps: Google wprost mówi, że nie każda odpowiedź zawiera powiązane linki lub źródła. Brak przycisku Sources oznacza, że w tej odpowiedzi nie podano linków; sam w sobie nie dowodzi nieudanego retrieval ani blokowania czegokolwiek przez wydawcę. Evidence for this claim Gemini Apps may provide sources or related links, but not every response includes them; no Sources button means Gemini provided no links for that response. Scope: Gemini Apps source-link presentation; absence of links does not by itself establish retrieval failure or a publisher defect. Confidence: high · Verified: Google Gemini Apps: View related sources

Niewygodna prawda: cytat ≠ ruch

Na koniec ogranicz oczekiwania. Cytowanie jest dziś znacznie bardziej sygnałem świadomości i autorytetu niż kanałem ruchu. Niezależne badanie Pew wykazało, że gdy pojawia się podsumowanie AI, tylko niski jednocyfrowy odsetek użytkowników klika jakikolwiek link, a zaledwie około 1% klika cytowane źródło w obrębie podsumowania — zdecydowana większość sesji wyszukiwania AI kończy się bez wizyty na stronie. Optymalizuj pod cytaty, bo budują obecność i autorytet marki w odpowiedziach, które ludzie czytają — nie dlatego, że każdy cytat powinien przynieść kliknięcie.

Gdzie to się mieści: cytat to koniec atrybucji w groundingu i RAG, zasilany wyżej przez retrieval (chunking, embeddingi, wyszukiwanie wektorowe i ranking fragmentów), a obok niego działają mechanizmy świeżości i halucynacji odpowiedzi AI. Mechanika jest wspólna dla całego klastra; specyficzne dla cytatów są rozróżnienie trzech stanów, odłączenie od rankingu/backlinków i dźwignia wzmianek na stronach trzecich.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.