Citas de IA

Cómo los motores de respuesta con IA eligen qué páginas citar: la distinción entre recuperado/mencionado/citado, por qué la citación no es posicionamiento ni backlinks, y qué hace realmente que una página tenga más probabilidades de ser citada en Google AI Overviews, ChatGPT, Perplexity y Copilot.

Publicado por primera vez: 3 jul 2026 · Última actualización: 6 ago 2026 · Avanzado
Idiomas

Una cita de IA es el enlace de fuente atribuido que un motor de respuesta con IA muestra junto a su texto generado. Se sitúa al final de tres estados distintos —recuperado (la IA leyó la página, visible solo en los registros), mencionado (la marca aparece nombrada sin enlace) y citado (la URL se muestra como fuente)— y la mayoría de las herramientas solo ven uno de ellos. La citación funciona con RAG sobre el mismo índice principal que impulsa el posicionamiento, por lo que ser rastreable, estar indexado y ser apto para mostrarse con snippet es el requisito previo. Pero no es posicionamiento ni son backlinks: la investigación de Ahrefs apunta a que la proporción de citas de AI Overviews procedentes del top 10 orgánico cayó con fuerza entre mediados de 2025 y principios de 2026 (de aproximadamente el 76 % hacia aproximadamente el 38 %), aunque la metodología exacta detrás de esa comparación no se ha reverificado de forma independiente: dé por asentada la dirección, no las cifras precisas. Las menciones de marca en la web predicen la visibilidad en IA mejor que el Domain Rating, y ~90 % de las citas sobre una marca proceden de sitios de terceros. Además, ser citado rara vez significa un clic: la mayoría de las sesiones de IA terminan sin ninguno. Y que se muestre una cita nunca es prueba de que la fuente respalde realmente la afirmación contigua: esa es una comprobación aparte.

En el caso de OpenAI, el propósito declarado de OAI-SearchBot es la visibilidad en búsqueda, mientras que GPTBot tiene un control de entrenamiento independiente. Evidence for this claim OpenAI identifies OAI-SearchBot as the crawler used to link to and surface websites in ChatGPT search results, separately from GPTBot training controls. Scope: OpenAI-declared crawler behavior; selection and citation are not guaranteed. Confidence: high · Verified: OpenAI: Crawlers En el caso de Google, la selección de enlaces de apoyo puede basarse en la expansión de consultas (query fan-out) más allá de un único conjunto de resultados. Evidence for this claim Google says AI Overviews and AI Mode show supporting links and can use query fan-out to find a wider and more diverse set of relevant pages. Scope: Google Search AI features; link selection is system-dependent. Confidence: high · Verified: Google: AI features and your website Y que aparezca una cita nunca es prueba de que la página citada respalde la afirmación contigua: esa es una comprobación distinta que se superpone a la atribución. Evidence for this claim Citation presence alone is not proof the cited source supports the adjacent generated statement; a study of four 2023 generative search systems found meaningful gaps between citation recall and citation precision. Scope: Findings from evaluated 2023 generative search systems (Bing Chat, NeevaAI, Perplexity, YouChat); supports the general citation-verifiability distinction, not current-system rates. Confidence: high · Verified: Liu, Zhang & Liang: Evaluating Verifiability in Generative Search Engines (EMNLP 2023)

TL;DR — Una cita de IA es la fuente atribuida que se muestra junto al texto generado por IA, seleccionada en el momento de la generación a partir de lo que el sistema recuperó mediante RAG, no ordenada en una lista. Es el último de tres estados: recuperado (una solicitud registrada de su página; no es prueba de que el contenido llegara al contexto del modelo), mencionado (nombrado en el texto, sin enlace) y citado (URL atribuida). Google fundamenta (grounding) las AI Overviews en su índice principal, por lo que una página debe estar indexada y ser apta para mostrarse con snippet para poder ser citada; pero citación ≠ posicionamiento (la investigación de Ahrefs apunta a que la proporción del top 10 cayó con fuerza, de aproximadamente el 76 % hacia aproximadamente el 38 %, entre mediados de 2025 y principios de 2026, aunque la comparación metodológica exacta entre los dos estudios sigue sin verificarse) y ≠ backlinks (las menciones de marca en la web correlacionan ~0,66 con la visibilidad en IA frente a ~0,33 del Domain Rating). Alrededor del 90 % de las citas sobre una marca proceden de sitios de terceros, y las plataformas citan de formas radicalmente distintas (Perplexity cita casi todo lo que recupera; ChatGPT casi no cita nada). Incluso una cita no suele producir un clic, y una cita nunca es prueba de que la fuente respalde la afirmación contigua.

La citación es el último de tres estados, no el panorama completo

La cita es un único estado observable, no un atajo para referirse a todas las formas en que un sistema puede haber usado su contenido. Fuente: /ai-search/measurement-and-reporting/retrieved-mentioned-cited/

«Recuperado» (retrieved) significa que un sistema solicitó u obtuvo el contenido, con los logs o los rastros de recuperación como evidencia; esa solicitud no prueba que el contenido llegara al contexto del modelo. «Mencionado» (mentioned) significa que la respuesta usó la marca, la entidad o los datos en su texto, con el texto de la respuesta como evidencia. «Citado» (cited) significa que la interfaz mostró un enlace o una cita de la fuente hacia la página, con una URL de fuente visible como evidencia. Estos estados requieren mediciones separadas.

© Patrick Stox LLC · CC BY 4.0 ·

Empiece por la distinción que resuelve la mayor parte de la confusión en la medición. Su contenido puede estar en uno, dos o los tres estados a la vez, y cada uno requiere una herramienta distinta para observarlo:

  • Recuperado. Un registro de acceso de un rastreador de IA o de un bot de inferencia en vivo muestra que se realizó una solicitud a su página mientras el sistema procesaba una consulta. Eso es evidencia real de una descarga, pero una solicitud en sus registros no es prueba de que el contenido se incorporara al contexto del modelo ni de que se utilizara en absoluto; los registros muestran qué se solicitó, no qué se seleccionó. Esto es detectable solo en los registros del servidor (agentes de usuario (user-agent) de rastreadores de IA), y es invisible para cualquier herramienta que funcione puramente analizando respuestas de IA.
  • Mencionado. Su marca, producto o nombre aparece en el texto generado, sin hipervínculo. La IA «sabe de usted» por los datos de entrenamiento o por contenido recuperado y le nombra sin atribución. Medible mediante herramientas de análisis de respuestas como Ahrefs Brand Radar.
  • Citado. La URL de su página se muestra como fuente atribuida: un enlace en el que se puede hacer clic, una referencia numerada o un recuadro de fuente con su nombre. Esto requiere que la IA tanto haya recuperado su contenido como haya decidido que merecía atribución.

Las diferencias entre ellos son toda la historia. El contenido puede recuperarse sin ser mencionado; mencionarse sin ser citado; y —el problema inverso de la «cita fantasma»— citarse sin que el nombre de su marca llegue a aparecer nunca en el texto. Y una solicitud observada en sus registros es una afirmación distinta y más débil que «seleccionado en la respuesta»: trate la recuperación como evidencia de una descarga, no como prueba de uso. (El planteamiento específico de recuperado / mencionado / citado merece su propio tratamiento; este artículo es el extremo de la mecánica de citación.)

Cómo se genera realmente la cita: RAG sobre un índice en vivo

Las citas son un resultado de la generación aumentada por recuperación (RAG), el patrón de recuperar-y-luego-generar que hay detrás de todos los grandes motores de respuesta con IA. La propia definición de Google la vincula directamente con el grounding: RAG es “a technique (also known as grounding) used to improve the quality, accuracy, and freshness of AI responses by relying on our core Search ranking systems to retrieve relevant, up-to-date web pages from our Search index.” (traducción) «una técnica (también conocida como grounding) que se utiliza para mejorar la calidad, la precisión y la actualidad de las respuestas de IA apoyándose en nuestros sistemas principales de clasificación de Search para recuperar páginas web relevantes y actualizadas de nuestro índice de Search». (Para el propio proceso de recuperación —segmentación en fragmentos (chunking), embeddings (representaciones vectoriales), vector search, reordenación— consulte los análisis en profundidad hermanos; aquí me interesa lo que ocurre en el paso de atribución.)

De esa definición se derivan directamente dos consecuencias, y son las que Google afirma abiertamente:

  • No existe un índice de IA aparte. Las AI Overviews recuperan del mismo índice principal de Search que los resultados normales, de modo que “a page must be indexed and eligible to be shown in Google Search with a snippet, fulfilling the Search technical requirements. There are no additional technical requirements.” (traducción) «una página debe estar indexada y ser apta para mostrarse en Google Search con un snippet, cumpliendo los requisitos técnicos de Search. No hay requisitos técnicos adicionales». Rastreable, indexable y apta para snippet es el suelo mínimo de la citación. Bloquee a Googlebot o devuelva errores y quedará excluido por completo de la elegibilidad.
  • La recuperación es más amplia que la consulta única. Google ejecuta la expansión de consultas (query fan-out): “Both AI Overviews and AI Mode may use a ‘query fan-out’ technique — issuing multiple related searches across subtopics and data sources — to develop a response.” (traducción) «Tanto AI Overviews como AI Mode pueden usar una técnica de “query fan-out” —lanzar múltiples búsquedas relacionadas sobre subtemas y fuentes de datos— para elaborar una respuesta». Se recuperan páginas para subconsultas que nunca aparecen en la respuesta visible. Esas son las recuperaciones «oscuras»: contenido que contribuyó sin atribución.
Evidence for this claim Google says AI Overviews and AI Mode may issue multiple related searches across subtopics and data sources and identify supporting pages while generating a response. Scope: Google Search Confidence: high · Verified: AI features and your website

A nivel de API, la arquitectura hace explícita la brecha entre recuperado y no citado: la generación con grounding de Google devuelve el texto del modelo con anotaciones de cita en línea, cada una vinculando un fragmento concreto de texto con una URL de fuente, pero la lista completa de fuentes recuperadas no se expone al usuario final. Uno ve lo que se usó, no lo que se leyó.

Por qué la citación no es posicionamiento (y la cifra que lo demuestra)

Uno de los hallazgos direccionales más útiles para cualquiera que haga este trabajo: ser citado por la IA parece estar desacoplándose del posicionamiento en el n.º 1 con el tiempo. En la investigación de Ahrefs (el estudio de julio de 2025, y después una actualización de marzo de 2026 realizada por Xibeijia Guan), se informa de que la proporción de citas de AI Overviews procedentes de una posición orgánica del top 10 cayó desde aproximadamente el 76 % a mediados de 2025 hasta cerca del 38 % a principios de 2026, con la cifra independiente de BrightEdge incluso más baja. Quiero señalarlo con claridad: no he podido reverificar de forma independiente la metodología ni el denominador exactos que hay detrás de esa comparación del 76 % al 38 %, así que tome como conclusión la dirección (una proporción decreciente del top 10), no los porcentajes precisos, hasta que se haga esa comprobación. La propia explicación de Google para la tendencia más amplia es que la expansión de consultas (query fan-out) está haciendo más parte del abastecimiento: las AI Overviews toman cada vez más de las SERP de subconsultas en lugar del top 10 de la consulta original, y ese mecanismo está confirmado directamente en la propia documentación de Google, con independencia de la cifra exacta anterior.

Dos lecturas prácticas:

  • Posicionarse en el n.º 1 para su consulta principal ya no garantiza una cita, y no estar en el top 10 ya no le excluye. YouTube es un ejemplo llamativo: es el dominio más citado en las AI Overviews y una gran parte de las URL de YouTube citadas no se posicionan siquiera en el top 100 de Google para la consulta. El vídeo se incorpora en gran medida con independencia del posicionamiento clásico.
  • La elegibilidad para ser citado sigue condicionada por el SEO clásico (indexado + apto para snippet) incluso mientras la selección de citas se aleja de la posición de ranking. Ambas cosas son ciertas a la vez, y por eso «la IA mató al SEO» y «la IA es solo SEO» son ambas afirmaciones erróneas.

El otro reflejo —«más backlinks, más citas»— también rinde por debajo de lo que muestran los datos. El estudio de 75 000 marcas de Ahrefs realizado por Louise Linehan y Xibeijia Guan encontró que el predictor más fuerte de aparecer en las AI Overviews no era el Domain Rating ni los backlinks; eran las menciones de marca en la web, con una correlación en torno a 0,664, frente a aproximadamente 0,326 del Domain Rating y aún menor para el número de backlinks. En un análisis aparte que realicé, las menciones en páginas con muchos enlaces también correlacionaron con las menciones en IA.

Eso replantea todo el juego. No es que la autoridad haya dejado de importar, es que que se hable de uno es un mejor indicador de lo que premian los sistemas de IA que que a uno le enlacen. El hallazgo de McKinsey lo afina: el propio sitio web de una marca representa solo alrededor del 5–10 % de las fuentes que las plataformas de IA referencian al hablar de esa marca. Aproximadamente el 90 % de las citas sobre usted viven en sitios de terceros: editores, plataformas de reseñas, contenido generado por usuarios (UGC), YouTube, Reddit. Como lo planteé en mi charla de Ahrefs Evolve: el trabajo solía ser (traducción) «optimiza tu sitio» y ahora es “optimize how the internet talks about you.” (traducción) «optimiza cómo internet habla de ti». Dieciséis páginas del sitio de Zapier que mencionan a Ahrefs bastaron para que Ahrefs fuera citado en más de 1 400 respuestas de IA, un nivel de apalancamiento que ningún ajuste dentro del propio sitio iguala.

Las plataformas citan de formas completamente distintas

«Ser citado por la IA» no es un único comportamiento: la misma página puede recuperarse en dos plataformas con resultados de atribución opuestos:

  • Perplexity ejecuta una búsqueda web en tiempo real prácticamente para cada consulta y está diseñada para ser transparente con las fuentes: promedia el mayor número de citas por respuesta de todas las grandes plataformas y cita casi todo lo que recupera. Es la menos propensa a «mencionar sin citar».
  • ChatGPT responde gran parte del tiempo desde los datos de entrenamiento sin recuperación alguna, y cuando sí recupera (mediante su capa de búsqueda impulsada por Bing) cita solo una pequeña fracción de las páginas que descargó. Su tasa global de citación es la más baja de las grandes plataformas. Esta es la superficie más pura de «mencionado pero no citado».
  • Google AI Overviews / AI Mode adjuntan citas a segmentos concretos del texto, se abastecen del índice principal más la expansión de consultas (query fan-out) y, como se ha visto, citan cada vez más fuera del top 10.
  • Microsoft Copilot expone algo que las demás no: las grounding queries (consultas de grounding), las frases reales que utilizó para recuperar el contenido referenciado. Eso es lo más cerca que ninguna herramienta oficial llega a mostrar la capa de recuperación.

La conclusión no es perseguir las peculiaridades de una plataforma concreta, sino que la citación es probabilística e inconsistente. Las respuestas de IA son volátiles; el mismo prompt ejecutado repetidamente produce listas de marcas y fuentes distintas, así que una única comprobación no dice casi nada.

También hay límites documentados de producto y de modo que un sistema de monitorización debería almacenar como resultados distintos, en vez de calificar cada enlace ausente como un problema del editor:

  • API de búsqueda web de OpenAI: el campo sources es el conjunto completo de URL que el modelo consultó, mientras que las citas en línea son un conjunto seleccionado más pequeño. Por tanto, una fuente puede recuperarse sin ser citada, y la documentación de la API exige que las citas en línea mostradas sean visibles y clicables. Esto es un contrato de API, no una prueba de que el producto de consumo ChatGPT exponga los mismos campos. Evidence for this claim In OpenAI API web search, the sources field lists all consulted URLs while inline citations show only selected relevant references; source count can exceed citation count, and search_context_size guarantees neither. Scope: OpenAI API web search response fields and configuration; not a claim about undisclosed retrieval or ChatGPT consumer-product presentation. Confidence: high · Verified: OpenAI API: Web search — Sources and search context size Evidence for this claim OpenAI requires inline citations to be clearly visible and clickable when an application displays web-search results or information from those results to end users. Scope: OpenAI API web search display contract; this does not assert identical fields or presentation in the ChatGPT consumer product. Confidence: high · Verified: OpenAI API: Web search — Output and citations
  • Microsoft Copilot: la modalidad de consumo Voice actualmente no activa la búsqueda web, por lo que no cabe esperar citas. Evidence for this claim Microsoft's consumer Copilot transparency note says web-grounded text responses include citations, while voice prompts do not trigger web search and therefore have no citations. Scope: Consumer Microsoft Copilot Voice mode; Microsoft 365 Copilot and text/web-grounded modes have different behavior. Confidence: high · Verified: Microsoft Copilot: Transparency note En Microsoft 365 Copilot, cuando sí se ejecuta la búsqueda web, la vista Sources muestra tanto las fuentes como la consulta breve exacta enviada a Bing; esa consulta derivada suele usar solo unas pocas palabras del prompt o del archivo. Evidence for this claim Microsoft 365 Copilot's Sources view exposes the exact query sent to Bing and the sources used; the query generally uses a few prompt or uploaded-file words rather than the full input. Scope: Microsoft 365 Copilot Chat and agents when web search runs; organization policy can disable web search. Confidence: high · Verified: Microsoft 365 Copilot: How web search works
  • Aplicaciones Gemini: Google dice explícitamente que no todas las respuestas incluyen enlaces relacionados o fuentes. Que no haya botón de Sources significa que no se proporcionaron enlaces para esa respuesta; no prueba por sí mismo que la recuperación fallara ni que el editor bloqueara nada. Evidence for this claim Gemini Apps may provide sources or related links, but not every response includes them; no Sources button means Gemini provided no links for that response. Scope: Gemini Apps source-link presentation; absence of links does not by itself establish retrieval failure or a publisher defect. Confidence: high · Verified: Google Gemini Apps: View related sources

La verdad incómoda: citado ≠ tráfico

Por último, modere el objetivo. Ser citado es hoy por hoy mucho más una señal de notoriedad y autoridad que un canal de tráfico. Una investigación independiente (Pew) encontró que, cuando aparece un resumen de IA, solo un pequeño porcentaje de un dígito de usuarios hace clic en algún enlace, y solo alrededor del 1 % hace clic en una fuente citada dentro del resumen, con la gran mayoría de las sesiones de búsqueda con IA terminando sin ninguna visita al sitio. Optimice para conseguir citas porque construyen presencia de marca y autoridad en las respuestas que la gente lee, no porque deba esperar un clic por cada una.

Dónde encaja esto: la citación es el extremo de atribución del grounding y del RAG, funciona sobre la recuperación (segmentación en fragmentos (chunking), embeddings (representaciones vectoriales), vector search, passage ranking) aguas arriba, y convive con las dinámicas de actualidad y de alucinaciones de las respuestas de IA. La mecánica es compartida en todo este clúster; lo específico de las citas es la distinción de tres estados, el desacoplamiento respecto al posicionamiento y a los backlinks, y el apalancamiento de las menciones de terceros.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.