Citas de IA
Cómo los motores de respuesta con IA eligen qué páginas citar: la distinción entre recuperado/mencionado/citado, por qué la citación no es posicionamiento ni backlinks, y qué hace realmente que una página tenga más probabilidades de ser citada en Google AI Overviews, ChatGPT, Perplexity y Copilot.
Idiomas
Una cita de IA es el enlace de fuente atribuido que un motor de respuesta con IA muestra junto a su texto generado. Se sitúa al final de tres estados distintos —recuperado (la IA leyó la página, visible solo en los registros), mencionado (la marca aparece nombrada sin enlace) y citado (la URL se muestra como fuente)— y la mayoría de las herramientas solo ven uno de ellos. La citación funciona con RAG sobre el mismo índice principal que impulsa el posicionamiento, por lo que ser rastreable, estar indexado y ser apto para mostrarse con snippet es el requisito previo. Pero no es posicionamiento ni son backlinks: la investigación de Ahrefs apunta a que la proporción de citas de AI Overviews procedentes del top 10 orgánico cayó con fuerza entre mediados de 2025 y principios de 2026 (de aproximadamente el 76 % hacia aproximadamente el 38 %), aunque la metodología exacta detrás de esa comparación no se ha reverificado de forma independiente: dé por asentada la dirección, no las cifras precisas. Las menciones de marca en la web predicen la visibilidad en IA mejor que el Domain Rating, y ~90 % de las citas sobre una marca proceden de sitios de terceros. Además, ser citado rara vez significa un clic: la mayoría de las sesiones de IA terminan sin ninguno. Y que se muestre una cita nunca es prueba de que la fuente respalde realmente la afirmación contigua: esa es una comprobación aparte.
OpenAI utiliza un rastreador de búsqueda distinto de su rastreador de entrenamiento para mostrar y enlazar sitios web en la búsqueda de ChatGPT. Evidence for this claim OpenAI identifies OAI-SearchBot as the crawler used to link to and surface websites in ChatGPT search results, separately from GPTBot training controls. Scope: OpenAI-declared crawler behavior; selection and citation are not guaranteed. Confidence: high · Verified: OpenAI: Crawlers Google, de forma similar, describe los enlaces de apoyo como parte de sus experiencias de búsqueda con IA. Evidence for this claim Google says AI Overviews and AI Mode show supporting links and can use query fan-out to find a wider and more diverse set of relevant pages. Scope: Google Search AI features; link selection is system-dependent. Confidence: high · Verified: Google: AI features and your website
TL;DR — Una cita de IA es el pequeño enlace a la fuente que una respuesta de IA muestra junto a lo que ha escrito: la referencia en la que se puede hacer clic y que dice «esto proviene de esa página». Ser citado no es lo mismo que posicionarse en el n.º 1, y tampoco es lo mismo que tener muchos backlinks; y no es prueba de que la fuente respalde realmente lo que dijo la IA, algo que hay que comprobar por separado. Funciona sobre la base de que la IA lee páginas web reales y decide a cuáles atribuir el mérito. Para entrar en la competición, la página tiene que poder encontrarse y leerse, y que internet hable de usted ayuda más de lo que la mayoría espera.
Qué es una cita de IA
Una cita de IA es el enlace visible a la fuente que una respuesta de IA muestra junto a lo que ha escrito. Esa es toda la definición, pero que aparezca una cita no significa que la página citada respalde realmente la afirmación que aparece a su lado. Son dos cosas distintas que comprobar: si se muestra la fuente, y si la fuente respalda realmente lo que dijo la IA.
Cuando se le hace una pregunta a ChatGPT, Perplexity, las AI Overviews de Google o Microsoft Copilot, se obtiene una respuesta redactada, y algunas respuestas incluyen enlaces a fuentes. Esos enlaces son citas: las páginas a las que el producto atribuye esa respuesta. Pero la ausencia de un enlace no es automáticamente un problema de su página. Google afirma que las aplicaciones Gemini no incluyen fuentes en todas las respuestas, Evidence for this claim Gemini Apps may provide sources or related links, but not every response includes them; no Sources button means Gemini provided no links for that response. Scope: Gemini Apps source-link presentation; absence of links does not by itself establish retrieval failure or a publisher defect. Confidence: high · Verified: Google Gemini Apps: View related sources y Microsoft indica que Copilot Voice actualmente no ejecuta búsqueda web, por lo que las respuestas por voz no tienen citas por diseño. Evidence for this claim Microsoft's consumer Copilot transparency note says web-grounded text responses include citations, while voice prompts do not trigger web search and therefore have no citations. Scope: Consumer Microsoft Copilot Voice mode; Microsoft 365 Copilot and text/web-grounded modes have different behavior. Confidence: high · Verified: Microsoft Copilot: Transparency note
Piénselo como un trabajo escolar. La IA escribe la respuesta con sus propias palabras, pero muestra sus fuentes para que se puedan comprobar (y hacer clic en ellas). Ser una de esas fuentes es lo que significa «ser citado por la IA»; demostrar que la fuente respalda realmente la afirmación contigua es una segunda comprobación, aparte.
Una cita no es prueba de que la fuente tenga razón
Esta es la parte que los principiantes se saltan y que provoca errores reales: una cita es una atribución, no una verificación de datos. La investigación sobre los primeros sistemas de búsqueda generativa encontró diferencias reales entre “a citation is shown” (traducción) «se muestra una cita» y “the citation actually supports the sentence next to it” (traducción) «la cita respalda realmente la frase contigua»: algunas páginas citadas no respaldaban del todo la afirmación a la que estaban asociadas. Si utiliza una página citada para tomar una decisión, lea la página frente a la afirmación concreta antes de confiar en ella.
Recuperado, mencionado, citado: tres cosas distintas
Esta es la parte que casi todo el mundo mezcla. Hay tres cosas distintas que una IA puede hacer con su contenido, y no siempre ocurren juntas:
- Recuperado: la IA leyó su página entre bastidores para ayudar a redactar su respuesta. Esto solo se puede ver en los registros del servidor.
- Mencionado: el nombre de su marca aparece en el texto de la respuesta, pero sin enlace.
- Citado: su URL real se muestra como fuente en la que se puede hacer clic.
Su contenido puede leerse sin que se le nombre, y nombrarse sin que se le enlace. La mayoría de las herramientas de visibilidad en IA solo ven la última (las citas), razón por la cual buena parte de su influencia real permanece invisible.
Por qué no basta con «posicionarse en el n.º 1 y ya te citan»
La suposición intuitiva —«si soy el primer resultado de Google, la IA me citará»— es cada vez más errónea. Las respuestas de IA suelen tomar fuentes de un conjunto de búsquedas relacionadas realizadas entre bastidores, no solo de los primeros resultados de su pregunta exacta. Una página puede ser citada sin posicionarse en el top 10, y una página en el n.º 1 puede quedar fuera.
Tampoco existe un «índice de IA» aparte en Google: sus AI Overviews utilizan el mismo índice de Search que los resultados normales. Así que lo básico sigue condicionándolo todo: si su página no puede rastrearse ni indexarse, no puede ser citada. Más allá de eso, que se hable de usted en otros sitios (Reddit, YouTube, blogs del sector) resulta importar mucho, a menudo más que su propio sitio.
El inconveniente: ser citado no siempre significa tráfico
Incluso cuando se consigue una cita, la mayoría de la gente no hace clic. Muchas respuestas de IA dan a las personas lo que necesitaban sin que visiten el sitio. Así que «conseguir citas» es un objetivo real, pero es primero una señal de notoriedad y autoridad, y solo muy en segundo lugar una fuente de tráfico.
¿Quiere la mecánica real: cómo el RAG selecciona fuentes, los bots de los archivos de registro que revelan la recuperación, las diferencias de tasa de citación entre plataformas y las palancas de optimización concretas? Cambie a la pestaña Avanzado.
En el caso de OpenAI, el propósito declarado de OAI-SearchBot es la visibilidad en búsqueda, mientras que GPTBot tiene un control de entrenamiento independiente. Evidence for this claim OpenAI identifies OAI-SearchBot as the crawler used to link to and surface websites in ChatGPT search results, separately from GPTBot training controls. Scope: OpenAI-declared crawler behavior; selection and citation are not guaranteed. Confidence: high · Verified: OpenAI: Crawlers En el caso de Google, la selección de enlaces de apoyo puede basarse en la expansión de consultas (query fan-out) más allá de un único conjunto de resultados. Evidence for this claim Google says AI Overviews and AI Mode show supporting links and can use query fan-out to find a wider and more diverse set of relevant pages. Scope: Google Search AI features; link selection is system-dependent. Confidence: high · Verified: Google: AI features and your website Y que aparezca una cita nunca es prueba de que la página citada respalde la afirmación contigua: esa es una comprobación distinta que se superpone a la atribución. Evidence for this claim Citation presence alone is not proof the cited source supports the adjacent generated statement; a study of four 2023 generative search systems found meaningful gaps between citation recall and citation precision. Scope: Findings from evaluated 2023 generative search systems (Bing Chat, NeevaAI, Perplexity, YouChat); supports the general citation-verifiability distinction, not current-system rates. Confidence: high · Verified: Liu, Zhang & Liang: Evaluating Verifiability in Generative Search Engines (EMNLP 2023)
TL;DR — Una cita de IA es la fuente atribuida que se muestra junto al texto generado por IA, seleccionada en el momento de la generación a partir de lo que el sistema recuperó mediante RAG, no ordenada en una lista. Es el último de tres estados: recuperado (una solicitud registrada de su página; no es prueba de que el contenido llegara al contexto del modelo), mencionado (nombrado en el texto, sin enlace) y citado (URL atribuida). Google fundamenta (grounding) las AI Overviews en su índice principal, por lo que una página debe estar indexada y ser apta para mostrarse con snippet para poder ser citada; pero citación ≠ posicionamiento (la investigación de Ahrefs apunta a que la proporción del top 10 cayó con fuerza, de aproximadamente el 76 % hacia aproximadamente el 38 %, entre mediados de 2025 y principios de 2026, aunque la comparación metodológica exacta entre los dos estudios sigue sin verificarse) y ≠ backlinks (las menciones de marca en la web correlacionan ~0,66 con la visibilidad en IA frente a ~0,33 del Domain Rating). Alrededor del 90 % de las citas sobre una marca proceden de sitios de terceros, y las plataformas citan de formas radicalmente distintas (Perplexity cita casi todo lo que recupera; ChatGPT casi no cita nada). Incluso una cita no suele producir un clic, y una cita nunca es prueba de que la fuente respalde la afirmación contigua.
La citación es el último de tres estados, no el panorama completo
«Recuperado» (retrieved) significa que un sistema solicitó u obtuvo el contenido, con los logs o los rastros de recuperación como evidencia; esa solicitud no prueba que el contenido llegara al contexto del modelo. «Mencionado» (mentioned) significa que la respuesta usó la marca, la entidad o los datos en su texto, con el texto de la respuesta como evidencia. «Citado» (cited) significa que la interfaz mostró un enlace o una cita de la fuente hacia la página, con una URL de fuente visible como evidencia. Estos estados requieren mediciones separadas.
© Patrick Stox LLC · CC BY 4.0 ·
Empiece por la distinción que resuelve la mayor parte de la confusión en la medición. Su contenido puede estar en uno, dos o los tres estados a la vez, y cada uno requiere una herramienta distinta para observarlo:
- Recuperado. Un registro de acceso de un rastreador de IA o de un bot de inferencia en vivo muestra que se realizó una solicitud a su página mientras el sistema procesaba una consulta. Eso es evidencia real de una descarga, pero una solicitud en sus registros no es prueba de que el contenido se incorporara al contexto del modelo ni de que se utilizara en absoluto; los registros muestran qué se solicitó, no qué se seleccionó. Esto es detectable solo en los registros del servidor (agentes de usuario (user-agent) de rastreadores de IA), y es invisible para cualquier herramienta que funcione puramente analizando respuestas de IA.
- Mencionado. Su marca, producto o nombre aparece en el texto generado, sin hipervínculo. La IA «sabe de usted» por los datos de entrenamiento o por contenido recuperado y le nombra sin atribución. Medible mediante herramientas de análisis de respuestas como Ahrefs Brand Radar.
- Citado. La URL de su página se muestra como fuente atribuida: un enlace en el que se puede hacer clic, una referencia numerada o un recuadro de fuente con su nombre. Esto requiere que la IA tanto haya recuperado su contenido como haya decidido que merecía atribución.
Las diferencias entre ellos son toda la historia. El contenido puede recuperarse sin ser mencionado; mencionarse sin ser citado; y —el problema inverso de la «cita fantasma»— citarse sin que el nombre de su marca llegue a aparecer nunca en el texto. Y una solicitud observada en sus registros es una afirmación distinta y más débil que «seleccionado en la respuesta»: trate la recuperación como evidencia de una descarga, no como prueba de uso. (El planteamiento específico de recuperado / mencionado / citado merece su propio tratamiento; este artículo es el extremo de la mecánica de citación.)
Cómo se genera realmente la cita: RAG sobre un índice en vivo
Las citas son un resultado de la generación aumentada por recuperación (RAG), el patrón de recuperar-y-luego-generar que hay detrás de todos los grandes motores de respuesta con IA. La propia definición de Google la vincula directamente con el grounding: RAG es “a technique (also known as grounding) used to improve the quality, accuracy, and freshness of AI responses by relying on our core Search ranking systems to retrieve relevant, up-to-date web pages from our Search index.” (traducción) «una técnica (también conocida como grounding) que se utiliza para mejorar la calidad, la precisión y la actualidad de las respuestas de IA apoyándose en nuestros sistemas principales de clasificación de Search para recuperar páginas web relevantes y actualizadas de nuestro índice de Search». (Para el propio proceso de recuperación —segmentación en fragmentos (chunking), embeddings (representaciones vectoriales), vector search, reordenación— consulte los análisis en profundidad hermanos; aquí me interesa lo que ocurre en el paso de atribución.)
De esa definición se derivan directamente dos consecuencias, y son las que Google afirma abiertamente:
- No existe un índice de IA aparte. Las AI Overviews recuperan del mismo índice principal de Search que los resultados normales, de modo que “a page must be indexed and eligible to be shown in Google Search with a snippet, fulfilling the Search technical requirements. There are no additional technical requirements.” (traducción) «una página debe estar indexada y ser apta para mostrarse en Google Search con un snippet, cumpliendo los requisitos técnicos de Search. No hay requisitos técnicos adicionales». Rastreable, indexable y apta para snippet es el suelo mínimo de la citación. Bloquee a Googlebot o devuelva errores y quedará excluido por completo de la elegibilidad.
- La recuperación es más amplia que la consulta única. Google ejecuta la expansión de consultas (query fan-out): “Both AI Overviews and AI Mode may use a ‘query fan-out’ technique — issuing multiple related searches across subtopics and data sources — to develop a response.” (traducción) «Tanto AI Overviews como AI Mode pueden usar una técnica de “query fan-out” —lanzar múltiples búsquedas relacionadas sobre subtemas y fuentes de datos— para elaborar una respuesta». Se recuperan páginas para subconsultas que nunca aparecen en la respuesta visible. Esas son las recuperaciones «oscuras»: contenido que contribuyó sin atribución.
A nivel de API, la arquitectura hace explícita la brecha entre recuperado y no citado: la generación con grounding de Google devuelve el texto del modelo con anotaciones de cita en línea, cada una vinculando un fragmento concreto de texto con una URL de fuente, pero la lista completa de fuentes recuperadas no se expone al usuario final. Uno ve lo que se usó, no lo que se leyó.
Por qué la citación no es posicionamiento (y la cifra que lo demuestra)
Uno de los hallazgos direccionales más útiles para cualquiera que haga este trabajo: ser citado por la IA parece estar desacoplándose del posicionamiento en el n.º 1 con el tiempo. En la investigación de Ahrefs (el estudio de julio de 2025, y después una actualización de marzo de 2026 realizada por Xibeijia Guan), se informa de que la proporción de citas de AI Overviews procedentes de una posición orgánica del top 10 cayó desde aproximadamente el 76 % a mediados de 2025 hasta cerca del 38 % a principios de 2026, con la cifra independiente de BrightEdge incluso más baja. Quiero señalarlo con claridad: no he podido reverificar de forma independiente la metodología ni el denominador exactos que hay detrás de esa comparación del 76 % al 38 %, así que tome como conclusión la dirección (una proporción decreciente del top 10), no los porcentajes precisos, hasta que se haga esa comprobación. La propia explicación de Google para la tendencia más amplia es que la expansión de consultas (query fan-out) está haciendo más parte del abastecimiento: las AI Overviews toman cada vez más de las SERP de subconsultas en lugar del top 10 de la consulta original, y ese mecanismo está confirmado directamente en la propia documentación de Google, con independencia de la cifra exacta anterior.
Dos lecturas prácticas:
- Posicionarse en el n.º 1 para su consulta principal ya no garantiza una cita, y no estar en el top 10 ya no le excluye. YouTube es un ejemplo llamativo: es el dominio más citado en las AI Overviews y una gran parte de las URL de YouTube citadas no se posicionan siquiera en el top 100 de Google para la consulta. El vídeo se incorpora en gran medida con independencia del posicionamiento clásico.
- La elegibilidad para ser citado sigue condicionada por el SEO clásico (indexado + apto para snippet) incluso mientras la selección de citas se aleja de la posición de ranking. Ambas cosas son ciertas a la vez, y por eso «la IA mató al SEO» y «la IA es solo SEO» son ambas afirmaciones erróneas.
Por qué la citación tampoco son backlinks
El otro reflejo —«más backlinks, más citas»— también rinde por debajo de lo que muestran los datos. El estudio de 75 000 marcas de Ahrefs realizado por Louise Linehan y Xibeijia Guan encontró que el predictor más fuerte de aparecer en las AI Overviews no era el Domain Rating ni los backlinks; eran las menciones de marca en la web, con una correlación en torno a 0,664, frente a aproximadamente 0,326 del Domain Rating y aún menor para el número de backlinks. En un análisis aparte que realicé, las menciones en páginas con muchos enlaces también correlacionaron con las menciones en IA.
Eso replantea todo el juego. No es que la autoridad haya dejado de importar, es que que se hable de uno es un mejor indicador de lo que premian los sistemas de IA que que a uno le enlacen. El hallazgo de McKinsey lo afina: el propio sitio web de una marca representa solo alrededor del 5–10 % de las fuentes que las plataformas de IA referencian al hablar de esa marca. Aproximadamente el 90 % de las citas sobre usted viven en sitios de terceros: editores, plataformas de reseñas, contenido generado por usuarios (UGC), YouTube, Reddit. Como lo planteé en mi charla de Ahrefs Evolve: el trabajo solía ser (traducción) «optimiza tu sitio» y ahora es “optimize how the internet talks about you.” (traducción) «optimiza cómo internet habla de ti». Dieciséis páginas del sitio de Zapier que mencionan a Ahrefs bastaron para que Ahrefs fuera citado en más de 1 400 respuestas de IA, un nivel de apalancamiento que ningún ajuste dentro del propio sitio iguala.
Las plataformas citan de formas completamente distintas
«Ser citado por la IA» no es un único comportamiento: la misma página puede recuperarse en dos plataformas con resultados de atribución opuestos:
- Perplexity ejecuta una búsqueda web en tiempo real prácticamente para cada consulta y está diseñada para ser transparente con las fuentes: promedia el mayor número de citas por respuesta de todas las grandes plataformas y cita casi todo lo que recupera. Es la menos propensa a «mencionar sin citar».
- ChatGPT responde gran parte del tiempo desde los datos de entrenamiento sin recuperación alguna, y cuando sí recupera (mediante su capa de búsqueda impulsada por Bing) cita solo una pequeña fracción de las páginas que descargó. Su tasa global de citación es la más baja de las grandes plataformas. Esta es la superficie más pura de «mencionado pero no citado».
- Google AI Overviews / AI Mode adjuntan citas a segmentos concretos del texto, se abastecen del índice principal más la expansión de consultas (query fan-out) y, como se ha visto, citan cada vez más fuera del top 10.
- Microsoft Copilot expone algo que las demás no: las grounding queries (consultas de grounding), las frases reales que utilizó para recuperar el contenido referenciado. Eso es lo más cerca que ninguna herramienta oficial llega a mostrar la capa de recuperación.
La conclusión no es perseguir las peculiaridades de una plataforma concreta, sino que la citación es probabilística e inconsistente. Las respuestas de IA son volátiles; el mismo prompt ejecutado repetidamente produce listas de marcas y fuentes distintas, así que una única comprobación no dice casi nada.
También hay límites documentados de producto y de modo que un sistema de monitorización debería almacenar como resultados distintos, en vez de calificar cada enlace ausente como un problema del editor:
- API de búsqueda web de OpenAI: el campo
sourceses el conjunto completo de URL que el modelo consultó, mientras que las citas en línea son un conjunto seleccionado más pequeño. Por tanto, una fuente puede recuperarse sin ser citada, y la documentación de la API exige que las citas en línea mostradas sean visibles y clicables. Esto es un contrato de API, no una prueba de que el producto de consumo ChatGPT exponga los mismos campos. Evidence for this claim In OpenAI API web search, the sources field lists all consulted URLs while inline citations show only selected relevant references; source count can exceed citation count, and search_context_size guarantees neither. Scope: OpenAI API web search response fields and configuration; not a claim about undisclosed retrieval or ChatGPT consumer-product presentation. Confidence: high · Verified: OpenAI API: Web search — Sources and search context size Evidence for this claim OpenAI requires inline citations to be clearly visible and clickable when an application displays web-search results or information from those results to end users. Scope: OpenAI API web search display contract; this does not assert identical fields or presentation in the ChatGPT consumer product. Confidence: high · Verified: OpenAI API: Web search — Output and citations - Microsoft Copilot: la modalidad de consumo Voice actualmente no activa la búsqueda web, por lo que no cabe esperar citas. Evidence for this claim Microsoft's consumer Copilot transparency note says web-grounded text responses include citations, while voice prompts do not trigger web search and therefore have no citations. Scope: Consumer Microsoft Copilot Voice mode; Microsoft 365 Copilot and text/web-grounded modes have different behavior. Confidence: high · Verified: Microsoft Copilot: Transparency note En Microsoft 365 Copilot, cuando sí se ejecuta la búsqueda web, la vista Sources muestra tanto las fuentes como la consulta breve exacta enviada a Bing; esa consulta derivada suele usar solo unas pocas palabras del prompt o del archivo. Evidence for this claim Microsoft 365 Copilot's Sources view exposes the exact query sent to Bing and the sources used; the query generally uses a few prompt or uploaded-file words rather than the full input. Scope: Microsoft 365 Copilot Chat and agents when web search runs; organization policy can disable web search. Confidence: high · Verified: Microsoft 365 Copilot: How web search works
- Aplicaciones Gemini: Google dice explícitamente que no todas las respuestas incluyen enlaces relacionados o fuentes. Que no haya botón de Sources significa que no se proporcionaron enlaces para esa respuesta; no prueba por sí mismo que la recuperación fallara ni que el editor bloqueara nada. Evidence for this claim Gemini Apps may provide sources or related links, but not every response includes them; no Sources button means Gemini provided no links for that response. Scope: Gemini Apps source-link presentation; absence of links does not by itself establish retrieval failure or a publisher defect. Confidence: high · Verified: Google Gemini Apps: View related sources
La verdad incómoda: citado ≠ tráfico
Por último, modere el objetivo. Ser citado es hoy por hoy mucho más una señal de notoriedad y autoridad que un canal de tráfico. Una investigación independiente (Pew) encontró que, cuando aparece un resumen de IA, solo un pequeño porcentaje de un dígito de usuarios hace clic en algún enlace, y solo alrededor del 1 % hace clic en una fuente citada dentro del resumen, con la gran mayoría de las sesiones de búsqueda con IA terminando sin ninguna visita al sitio. Optimice para conseguir citas porque construyen presencia de marca y autoridad en las respuestas que la gente lee, no porque deba esperar un clic por cada una.
Dónde encaja esto: la citación es el extremo de atribución del grounding y del RAG, funciona sobre la recuperación (segmentación en fragmentos (chunking), embeddings (representaciones vectoriales), vector search, passage ranking) aguas arriba, y convive con las dinámicas de actualidad y de alucinaciones de las respuestas de IA. La mecánica es compartida en todo este clúster; lo específico de las citas es la distinción de tres estados, el desacoplamiento respecto al posicionamiento y a los backlinks, y el apalancamiento de las menciones de terceros.
Resumen con IA
Una versión condensada de la versión Avanzado:
- Una cita de IA = la fuente atribuida que se muestra junto al texto generado por IA, elegida en el momento de la generación a partir de lo que el sistema recuperó mediante RAG, no ordenada en una lista de enlaces azules.
- Tres estados, tres herramientas: recuperado (una solicitud registrada de su página, no prueba de que el contenido llegara al contexto del modelo; visible solo en los registros del servidor), mencionado (nombrado en el texto, sin enlace; herramientas de análisis de respuestas), citado (URL atribuida; herramientas de seguimiento de citas). El contenido puede recuperarse sin ser mencionado, mencionarse sin ser citado, e incluso citarse sin ser nombrado («citas fantasma»).
- Funciona con RAG sobre el índice principal. Google: no hay un índice de IA aparte; una página debe estar indexada y ser apta para snippet para poder ser citada, ese es el suelo mínimo. La expansión de consultas (query fan-out) recupera para subconsultas, creando recuperaciones «oscuras» (no citadas).
- Citación ≠ posicionamiento. La investigación de Ahrefs apunta a que la proporción orgánica del top 10 en las citas de AI Overviews cayó con fuerza entre mediados de 2025 y principios de 2026 (de aproximadamente el 76 % hacia aproximadamente el 38 %); la metodología exacta detrás de esa comparación sigue sin verificarse, así que dé por asentada la dirección, no las cifras precisas; YouTube es el dominio más citado y a menudo no está en el top 100 para la consulta.
- Citación ≠ backlinks. Las menciones de marca en la web correlacionan ~0,66 con la visibilidad en IA frente a ~0,33 del Domain Rating; ~90 % de las citas sobre una marca proceden de sitios de terceros (McKinsey: sitio propio = 5–10 %).
- Citación ≠ respaldo. Una página citada no queda automáticamente probada como respaldo de la afirmación contigua: la investigación sobre los sistemas de búsqueda generativa de 2023 encontró diferencias reales entre la presencia de la cita y el respaldo de la cita. Compruebe la afirmación contra la página, no solo si se muestra un enlace.
- Las plataformas difieren enormemente: Perplexity cita casi todo lo que recupera; ChatGPT casi no cita nada y a menudo responde desde los datos de entrenamiento. Copilot expone de forma única las grounding queries.
- Citado ≠ tráfico. La mayoría de las sesiones de IA terminan sin un clic; ~1 % hace clic en fuentes citadas dentro de los resúmenes (Pew). Trate la citación como una señal de autoridad/notoriedad.
- Cambio estratégico: de «optimiza tu sitio» a «optimiza cómo internet habla de ti».
«Quiero más citas de IA: ¿por dónde empiezo?»
Los problemas de citación se sitúan en etapas distintas. Diagnostique qué etapa está fallando antes de cambiar nada: la solución para cada una es completamente diferente.
Paso 1: ¿puede la IA siquiera llegar hasta usted? Revise los registros de su servidor y sus reglas de robots.
- ¿No ve accesos de rastreadores de IA (
Googlebot-Extended,OAI-SearchBot,PerplexityBot, los bots de inferencia-User)? → Puede que los esté bloqueando, o que no sea recuperable en absoluto. Arregle primero la rastreabilidad: nada de lo que viene después importa hasta que se le pueda descargar. - ¿Ve bots
-Userrecibiendo respuestas de error? → Cada error a un bot de inferencia en vivo es una cita perdida en una conversación real. Corrija esas respuestas.
Paso 2: ¿le recuperan pero no le citan? Los registros muestran recuperación, pero no aparece como fuente.
- → Es un problema de calidad/estructura/exhaustividad, no de acceso. Haga que la respuesta sea autosuficiente y claramente la mejor fuente para la subpregunta. Ser recuperado es necesario pero está lejos de ser suficiente (ChatGPT cita solo ~15 % de lo que recupera).
Paso 3: ¿le mencionan pero no le citan? El nombre de su marca aparece en las respuestas, pero sin enlace hacia usted.
- → La IA le conoce pero no le atribuye. Refuerce las señales de atribución directa y haga que su propia página sea la fuente canónica evidente para la afirmación concreta. Cuente también con que parte de esto sea estructural (el «mencionar sin citar» al estilo de ChatGPT).
Paso 4: ¿apenas está presente (ni siquiera mencionado)?
- → Es un problema de reputación, y es mayoritariamente externo a su sitio. ~90 % de las citas sobre una marca proceden de sitios de terceros. Consiga que se hable de usted en las fuentes de las que la IA realmente extrae (publicaciones del sector, Reddit, YouTube, sitios de reseñas). Optimice cómo internet habla de usted, no solo sus propias páginas.
Paso 5: ¿le citan pero no obtiene tráfico?
- → Es lo esperable, por ahora. La mayoría de las sesiones de IA terminan sin un clic. Traslade la métrica de éxito a la presencia de marca en las respuestas (mención + cita juntas), no a los clics, y asegúrese de que se le nombra, no solo de que se le enlaza, para que los usuarios asocien la respuesta con usted.
¿Qué capa de medición responde a cada pregunta?
| Pregunta | Capa / herramienta |
|---|---|
| ¿Me recuperaron? | Análisis de registros del servidor (agentes de usuario (user-agent) de bots de IA) |
| ¿Me mencionaron? | Monitorización de marca / análisis de respuestas (p. ej., Brand Radar) |
| ¿Me citaron? | Seguimiento de citas (informes de páginas citadas de Brand Radar, AI Performance de Bing WMT) |
| ¿Obtuve tráfico? | GSC + analítica (y aun así, los clics de IA son difíciles de aislar) |
Documentación oficial
Documentación de fuente primaria sobre cómo las funciones de IA se abastecen de contenido y lo citan.
- Guía de Google: elegibilidad para los enlaces de apoyo en AI Overviews/AI Mode, expansión de consultas (query fan-out) y cómo se informa del tráfico de las funciones de IA en Search Console.
- Guía de Google: la definición de RAG/grounding sobre el índice principal, además del planteamiento de que «sigue siendo SEO» y el desmontaje de mitos (nada de llms.txt, ningún requisito de segmentación en fragmentos (chunking), ningún marcado especial).
- Guía de Google: confirma que no hay requisitos adicionales más allá de la indexación estándar y la elegibilidad para snippet.
- Guía de Google: el flujo de grounding a nivel de desarrollador: ejecución de la búsqueda, síntesis y anotaciones
url_citationen línea que vinculan fragmentos de texto con URL de fuentes. - Guía de Google: el informe de junio de 2026 que ofrece visibilidad solo de impresiones para las funciones de IA (todavía sin clics, CTR ni datos de consultas).
Microsoft / Bing
- Recurso oficial de Microsoft y Bing: la primera herramienta oficial de plataforma que expone a los webmasters los recuentos de citas y las grounding queries.
- Recurso oficial de Microsoft y Bing: la vista Sources, la consulta derivada enviada a Bing y el control de búsqueda web a nivel de organización.
- Recurso oficial de Microsoft y Bing: el grounding de texto para consumo y la excepción actual de ausencia de búsqueda web/citas para las peticiones por voz.
OpenAI / Gemini
- Recurso de OpenAI y Google: los requisitos de visualización de citas visibles y clicables, y la distinción entre todas las
sourcesconsultadas y las citas en línea seleccionadas. - Recurso de OpenAI y Google: Google afirma que no todas las respuestas de las aplicaciones Gemini incluyen enlaces o un botón de Sources.
Citas de la fuente
Declaraciones oficiales de Google y Microsoft. Cada enlace de Google es un enlace profundo que salta al pasaje citado en la página de origen.
Google: RAG, grounding y el índice principal
- “A technique (also known as grounding) used to improve the quality, accuracy, and freshness of AI responses by relying on our core Search ranking systems to retrieve relevant, up-to-date web pages from our Search index.” (traducción) «Una técnica (también conocida como grounding) que se utiliza para mejorar la calidad, la precisión y la actualidad de las respuestas de IA apoyándose en nuestros sistemas principales de clasificación de Search para recuperar páginas web relevantes y actualizadas de nuestro índice de Search». — Google Search Central, guía de optimización para IA. Ir a la cita
- “Our generative AI features on Google Search are rooted in our core Search ranking and quality systems.” (traducción) «Nuestras funciones de IA generativa en Google Search se asientan en nuestros sistemas principales de clasificación y calidad de Search». — Google Search Central, la guía de optimización para IA.
Google: qué hace que una página sea elegible para ser citada
- “To be eligible to be shown as a supporting link in AI Overviews or AI Mode, a page must be indexed and eligible to be shown in Google Search with a snippet, fulfilling the Search technical requirements. There are no additional technical requirements.” (traducción) «Para poder mostrarse como enlace de apoyo en AI Overviews o AI Mode, una página debe estar indexada y ser apta para mostrarse en Google Search con un snippet, cumpliendo los requisitos técnicos de Search. No hay requisitos técnicos adicionales». — Google Search Central, IA y tu sitio web. Ir a la cita
- “There are no additional requirements to appear in AI Overviews or AI Mode, nor other special optimizations necessary.” (traducción) «No hay requisitos adicionales para aparecer en AI Overviews o AI Mode, ni otras optimizaciones especiales necesarias». — Google Search Central, IA y tu sitio web. Ir a la cita
Google: expansión de consultas (query fan-out) (por qué existen las recuperaciones «oscuras»)
- “Both AI Overviews and AI Mode may use a ‘query fan-out’ technique — issuing multiple related searches across subtopics and data sources — to develop a response.” (traducción) «Tanto AI Overviews como AI Mode pueden usar una técnica de “query fan-out” —emitir múltiples búsquedas relacionadas sobre subtemas y fuentes de datos— para elaborar una respuesta». — Google Search Central, IA y tu sitio web. Ir a la cita
- “While responses are being generated, our advanced models identify more supporting web pages, allowing us to display a wider and more diverse set of helpful links associated with the response than with a classic web search.” (traducción) «Mientras se generan las respuestas, nuestros modelos avanzados identifican más páginas web de apoyo, lo que nos permite mostrar un conjunto más amplio y diverso de enlaces útiles asociados a la respuesta que en una búsqueda web clásica». — Google Search Central, IA y tu sitio web. Ir a la cita
Microsoft Bing: sacar a la luz la capa de recuperación
- “We are happy to introduce AI Performance in Bing Webmaster Tools, a new set of insights that shows how publisher content appears across Microsoft Copilot, AI-generated summaries in Bing, and select partner integrations.” (traducción) «Nos complace presentar AI Performance en Bing Webmaster Tools, un nuevo conjunto de datos que muestra cómo aparece el contenido de los editores en Microsoft Copilot, en los resúmenes generados por IA en Bing y en integraciones seleccionadas de socios». — Bing Webmaster Blog, febrero de 2026. Leer el anuncio
Lista de comprobación de preparación para las citas de IA
Una pasada para confirmar que puede ser citado y, después, que está preparado para verlo:
¿Puede siquiera ser recuperado y citado?
- Las páginas importantes están indexadas y son aptas para snippet (el suelo mínimo de la citación de IA).
- No está bloqueando en
robots.txta los bots de IA que quiere que lleguen hasta usted:Googlebot-Extended,OAI-SearchBot,PerplexityBoty los bots de inferencia-User. - Los bots de inferencia en vivo (
ChatGPT-User,Perplexity-User,Claude-User) reciben200limpios, no errores: cada error es una cita en tiempo real perdida. - El contenido no está condicionado a JS pesado en el cliente que los descargadores de IA no renderizarán.
¿Son sus páginas la fuente evidente para una afirmación?
- Las respuestas clave son autosuficientes y aparecen pronto en la página.
- Los encabezados reflejan las preguntas (y subpreguntas) concretas que hace la gente.
- La página ofrece sustancia no genérica —un enfoque propio, datos o experiencia de primera mano— y no conocimiento común reformulado.
¿Está construyendo la señal externa que realmente impulsa la citación?
- Está haciendo seguimiento de las menciones de marca en la web, no solo de los backlinks.
- Tiene presencia en las fuentes de terceros de las que la IA extrae (publicaciones del sector, Reddit, YouTube, plataformas de reseñas).
¿Puede medir los tres estados?
- Análisis de registros implantado para recuperado.
- Monitorización de marca implantada para mencionado.
- Seguimiento de citas (informes de páginas citadas de Brand Radar, AI Performance de Bing WMT) para citado.
- Está comprobando cada prompt varias veces, sabiendo que los resultados de la IA son volátiles.
Los modelos mentales
1. Recuperado → Mencionado → Citado (→ Clicado). Cuatro estados, cada uno estrictamente más difícil de alcanzar que el anterior y cada uno con necesidad de una herramienta distinta para observarlo. Cuando la visibilidad en IA parece «rota», localice qué transición está fallando —acceso, atribución, reputación o clic—, porque la solución de cada una no tiene relación con las demás.
2. La elegibilidad para ser citado es SEO clásico; la selección de citas no. Para ser elegible hacen falta las puertas de siempre: indexado, apto para snippet, rastreable. Para ser seleccionado, la posición de ranking parece importar menos con el tiempo (una proporción del top 10 del 76 % → 38 % informada, no plenamente reverificada) y que se hable de uno importa más. Sostenga ambas ideas a la vez.
3. Para la IA, las menciones ganan a los enlaces. Las menciones de marca en la web predicen la visibilidad en IA (~0,66) mejor que el Domain Rating (~0,33). El indicador que mejor se corresponde con lo que premia la IA es “is this brand discussed on authoritative pages,” (traducción) «¿se habla de esta marca en páginas con autoridad?»; no “is this URL linked.” (traducción) «¿está enlazada esta URL?». Optimice la conversación, no solo el grafo de enlaces.
4. Su sitio es una minoría de sus propias citas. ~90 % de las citas sobre una marca proceden de sitios de terceros; su propio dominio es el 5–10 %. No se puede alcanzar la visibilidad en IA solo desde el propio sitio: la mayor parte de la superficie son páginas de otras personas hablando de usted.
5. Ser citado no es (todavía) un canal de tráfico. La mayoría de las sesiones de IA terminan sin un clic. Trate la citación como presencia de marca en la capa de respuesta, y asegúrese de que se le nombra junto al enlace, o la asociación se pierde.
6. Es probabilístico, así que mida en agregado. El mismo prompt arroja fuentes distintas en ejecuciones distintas. Una comprobación es ruido; ejecute los prompts repetidamente y siga la tendencia del agregado.
Citas de IA: chuleta
Los tres (cuatro) estados
| Estado | Qué significa | Cómo se ve |
|---|---|---|
| Recuperado | La IA descargó su página como material de origen | Registros del servidor (agentes de usuario (user-agent) de bots de IA) |
| Mencionado | Marca nombrada en la respuesta, sin enlace | Monitorización de marca / análisis de respuestas |
| Citado | Su URL se muestra como fuente atribuida | Seguimiento de citas (Brand Radar, Bing WMT) |
| Clicado | El usuario visita realmente | GSC + analítica (difícil de aislar) |
Bots: entrenamiento/índice frente a inferencia en vivo
| Bot | Propietario | Tipo |
|---|---|---|
GPTBot / OAI-SearchBot | OpenAI | Entrenamiento / índice de búsqueda |
ChatGPT-User | OpenAI | Inferencia en vivo (descarga en tiempo real) |
PerplexityBot / Perplexity-User | Perplexity | Índice / inferencia en vivo |
ClaudeBot / Claude-User | Anthropic | Entrenamiento / inferencia en vivo |
Googlebot-Extended | Elegibilidad para recuperación por IA |
Un acceso de -User ≈ «el motor descargó esta página para citarla potencialmente en una respuesta en vivo».
Citación ≠ posicionamiento ≠ backlinks: datos rápidos
- Proporción orgánica del top 10 en las citas de AI Overviews: según lo informado, ~76 % (mediados de 2025) → ~38 % (principios de 2026) (Ahrefs; comparación metodológica exacta sin verificar: tome la dirección como la señal).
- Menciones de marca en la web ≈ 0,66 de correlación con la visibilidad en IA frente a ~0,33 del Domain Rating.
- ~90 % de las citas sobre una marca están en sitios de terceros (sitio propio: 5–10 %).
- No hay un índice de IA aparte: indexado + apto para snippet es el suelo mínimo en Google.
- Comportamiento de citación por plataforma: Perplexity cita casi todo lo que recupera; ChatGPT cita una pequeña fracción y a menudo responde desde los datos de entrenamiento.
- Citado ≠ clic: en el estudio de navegación en EE. UU. de Pew de marzo de 2025, los usuarios hicieron clic en una fuente citada en el 1 % de las visitas a Google con un resumen de IA.
Playbook: pasar de «no citado» a «citado»
Un plan por etapas, ejecutado en orden: las etapas anteriores condicionan a las posteriores.
Etapa 1: garantizar el acceso (esta semana).
Extraiga los registros del servidor, confirme que los bots de IA están llegando hasta
usted y confirme que reciben 200. Desbloquee cualquier descargador de IA que realmente
quiera (por defecto: no los bloquee). Corrija primero los errores servidos a los bots de
inferencia -User: esas son pérdidas en vivo, dentro de una conversación.
Etapa 2: hacer que la página sea la fuente evidente (este mes). Para cada tema prioritario, asegúrese de que la respuesta concreta sea autosuficiente, aparezca pronto y esté bajo un encabezado que refleje la pregunta real. Añada la capa no genérica —datos, un resultado de primera mano, una opinión— que una reformulación genérica no puede igualar. Esto es lo que le mueve de recuperado a citado.
Etapa 3: construir la conversación externa (continuo). Como ~90 % de sus citas viven en sitios de terceros, invierta donde la IA realmente extrae: consiga menciones en publicaciones del sector, siembre una presencia genuina en Reddit y YouTube, gánese cobertura en plataformas de reseñas. El objetivo son menciones de marca en la web en páginas con autoridad, no solo enlaces. Esta es la etapa de mayor apalancamiento y la más lenta.
Etapa 4: recuperar la demanda alucinada. Los motores de IA a veces inventan URL plausibles pero inexistentes en su dominio. Encuéntrelas (registros, informes de 404) y redirija con un 301 a la página correcta en vivo para que el tráfico —y la intención de citación implícita— no se desperdicie.
Etapa 5: medir todo el embudo, en agregado. Monte la pila de tres capas (registros → monitorización de marca → seguimiento de citas), ejecute los prompts prioritarios repetidamente y siga la tendencia del agregado en lugar de reaccionar a cualquier respuesta volátil aislada.
Qué no hacer
Suponer que el n.º 1 = citado. Cada vez más falso: la investigación de Ahrefs sitúa la proporción orgánica del top 10 en las citas de AI Overviews en aproximadamente un ~38 %, frente a un ~76 % informado anteriormente (la metodología exacta entre los dos estudios sigue sin verificarse, pero la dirección es coherente con la expansión de consultas (query fan-out)). Una página en el n.º 1 no tiene garantía alguna; una página fuera del top 100 puede aun así ser citada (véase YouTube).
Tratar los backlinks como la palanca de las citas de IA. Las menciones de marca en la web predicen mejor que el Domain Rating la visibilidad en IA. Perseguir enlaces ignorando si se habla de usted optimiza la señal equivocada.
Optimizar solo dentro del propio sitio. Su propio dominio es ~5–10 % de las citas sobre su marca. Si toda su estrategia de IA son sus propias páginas, está ignorando ~90 % de la superficie.
Leer las herramientas centradas solo en citas como su «presencia completa en IA». Solo ven el estado citado. La recuperación y las menciones permanecen invisibles: puede estar moldeando respuestas de forma intensa con casi ninguna cita visible.
Confiar en una cita como prueba automática de respaldo. Una cita es atribución, no verificación. Lea la página citada frente a la afirmación concreta antes de darla por respaldada.
Confundir GPTBot con ChatGPT-User. Un acceso de rastreo de entrenamiento dice
poco sobre la citación en vivo; el bot de inferencia -User es la señal que importa.
Bloquear el equivocado (o bloquear directamente los bots de inferencia) puede eliminarle
silenciosamente de las respuestas.
Bloquear bots de IA por reflejo. Bloquee los descargadores de inferencia o
Googlebot-Extended y se elimina a sí mismo de la recuperación, la mención y la
citación de una sola vez. Para la mayoría de los editores, eso es autolesionarse.
Juzgar la visibilidad a partir de una única ejecución de un prompt. Los resultados de la IA son volátiles: el mismo prompt arroja listas de marcas y fuentes distintas entre ejecuciones. Una comprobación es ruido.
Trocear el contenido en «fragmentos amigables para la IA» diminutos. Google dice explícitamente que no hay ningún requisito de dividir el contenido en piezas diminutas; una estructura clara en una página normal es suficiente. (Lo mismo con llms.txt y los marcados «especiales»: Google no los usa para esto.)
Ver quién le está recuperando: buscar bots de IA en sus registros con grep
La recuperación es el único estado que solo puede observarse en los registros del servidor. Estos comandos extraen los agentes de usuario (user-agent) de los rastreadores de IA de un registro de acceso estándar.
macOS / Linux (shell)
# All major AI bots, with a count per user-agent
grep -iE "GPTBot|OAI-SearchBot|ChatGPT-User|PerplexityBot|Perplexity-User|ClaudeBot|Claude-User|Googlebot-Extended" access.log \
| grep -oiE "GPTBot|OAI-SearchBot|ChatGPT-User|PerplexityBot|Perplexity-User|ClaudeBot|Claude-User|Googlebot-Extended" \
| sort | tr 'A-Z' 'a-z' | uniq -c | sort -rn
# The signal that matters most: live-inference (-User) bots that hit an ERROR
grep -iE "ChatGPT-User|Perplexity-User|Claude-User" access.log \
| awk '$9 ~ /^(4|5)/ {print $9, $7}' | sort | uniq -c | sort -rnExpresión regular para una plataforma de registros (Splunk / BigQuery / Loki)
(?i)\b(gptbot|oai-searchbot|chatgpt-user|perplexitybot|perplexity-user|claudebot|claude-user|googlebot-extended)\bDivida la alternancia en un grupo de «entrenamiento/índice» y otro de «inferencia -User» para
separar el ruido de rastreo de las descargas en tiempo real dentro de una conversación.
Extraer los enlaces de fuente de una respuesta de IA (navegador)
Pegue esto en la Console de Chrome DevTools en una página de respuesta de IA para listar los dominios de las fuentes citadas: una forma rápida de comprobar quién se llevó los huecos de citación para una consulta.
// Console snippet: unique cited domains among outbound links on the page
[...new Set([...document.querySelectorAll('a[href^="http"]')]
.map(a => { try { return new URL(a.href).hostname.replace(/^www\./,''); }
catch { return null; } })
.filter(Boolean))]
.sort()
.forEach(d => console.log(d));Bookmarklet: resaltar su propio dominio en un conjunto de citas
Guarde esto en un marcador y haga clic en él sobre una respuesta de IA para recuadrar cualquier enlace que apunte a su sitio: una comprobación visual rápida de «¿me citaron aquí?».
javascript:(()=>{const dom='example.com';document.querySelectorAll('a[href*="'+dom+'"]').forEach(a=>{a.style.outline='3px solid #85BB65';a.style.background='rgba(133,187,101,.15)';});})();Sustituya example.com por su dominio. (Los registros siguen siendo lo que le informa
sobre la recuperación; esto solo inspecciona las citas visibles en la respuesta
renderizada.)
Herramientas para ver cada estado
Recuperado (registros)
- Analizadores de archivos de registro del servidor: Screaming Frog Log File Analyser (tiene un flujo de trabajo de monitorización de bots de IA), Botify y Ahrefs Bot Analytics desglosan el tráfico por bot de IA individual y por categoría. Este es el único lugar donde la recuperación es visible.
- Analítica de CDN / edge (p. ej., Cloudflare): desgloses de bots si no dispone de registros en bruto.
Mencionado (análisis de respuestas)
- Ahrefs Brand Radar: monitoriza las respuestas de IA en distintos motores y saca a la luz las menciones de marca como coincidencias de texto, incluida una vista de «encontrado, pero no citado» (mencionado sin enlace hacia usted).
Citado (seguimiento de citas)
- Ahrefs Brand Radar — Cited Domains / Cited Pages: qué sitios de terceros son citados cuando se habla de usted, y cuáles de sus propias páginas se citan más.
- Bing Webmaster Tools — AI Performance: recuentos oficiales de citas de Copilot, media de páginas citadas y grounding queries; la fuente más fiable para Copilot.
- Google Search Console — informe de rendimiento de IA generativa: visibilidad solo de impresiones para las funciones de IA (todavía sin clics, CTR ni dimensión de consulta).
Comprobación de realidad
- Ninguna herramienta por sí sola ve los tres estados: necesita la pila completa, no un único panel.
Revisión mensual de citas de IA
- Congele la lista de prompts, los nombres de plataforma/modelo, la geografía, el estado de la cuenta y la fecha de ejecución.
- Ejecute los mismos prompts en sesiones nuevas y guarde las respuestas completas con los enlaces de fuente visibles, no capturas de pantalla de una bandeja de citas recortada.
- Normalice cada URL citada a su destino canónico final y registre la página de origen, el prompt, la plataforma, la posición y si la marca fue mencionada en la respuesta.
- Separe la cita, la mención sin enlace, la evidencia de recuperación en los registros y la visita de referencia.
- Verifique que las páginas citadas respaldan las afirmaciones contiguas; marque las discrepancias y las URL fabricadas para revisión manual.
- Compare con la ejecución anterior por cohorte de prompts y por plataforma. No combine prompts cambiantes en una aparente tendencia de visibilidad.
- Asigne acciones a los responsables de contenido, técnico, PR digital o medición, y archive la evidencia en bruto junto con el informe.
Validar la medición de citas
| Prueba a ejecutar | Resultado esperado | Interpretación del fallo | Ventana de monitorización | Disparador de reversión |
|---|---|---|---|---|
| Repetir una muestra en sesiones limpias | Los resultados se guardan como observaciones variables, no como rankings supuestamente deterministas | El proceso no puede reproducir ni explicar sus condiciones de captura | En cada ejecución de informe | Pause el informe de tendencias si las condiciones de ejecución no están documentadas |
| Resolver las URL citadas y comparar canónicas | Cada cita se corresponde con una página final válida, sin duplicados accidentales | Las redirecciones y las variantes de URL inflan o dividen los recuentos | Durante la recogida | Reprocese el informe si la normalización cambia los totales de forma material |
| Leer cada página citada frente a la afirmación citada | La página respalda la afirmación contigua de la respuesta | Se está confundiendo la presencia de la cita con el respaldo factual | En cada hallazgo de alto impacto | Escale en lugar de promover una cita engañosa |
| Comparar la captura de citas con la analítica de referencias | Los campos de cita y de clic siguen siendo distintos | Se está informando de la visibilidad como si fuera tráfico | Mensual | Retire el KPI combinado si las etapas no pueden separarse |
| Mantener constante una cohorte de prompts entre periodos | Las filas de tendencia usan los mismos prompts y condiciones de plataforma | La deriva de prompts crea una ganancia o pérdida falsa | En cada periodo de comparación | Reformule la línea base cuando cambie el conjunto de prompts |
Métricas de citas de IA
| Métrica | Qué le dice | Cómo obtenerla | Referencia o rango realista | Cadencia |
|---|---|---|---|---|
| Tasa de citación | Proporción de respuestas monitorizadas que citan el sitio | Cuente las respuestas con una cita normalizada del sitio y divida entre las respuestas elegibles | Use una línea base fija de prompt/plataforma; no existe una tasa buena universal | Mensual |
| Páginas citadas únicas | Amplitud de páginas que reciben atribución | Deduplique las URL canónicas finales de las citas capturadas | Compare con las ejecuciones previas del propio sitio y con el inventario de contenido | Mensual |
| Tasa de citas respaldadas | Si las páginas citadas respaldan realmente las afirmaciones contiguas | Muestra manual o revisión completa para los prompts de alto riesgo | Lleve hacia cero las citas de alto impacto no respaldadas | Mensual o por incidente |
| Reparto entre mención y cita | Con qué frecuencia se nombra la marca con enlace de fuente frente a sin él | Codifique por separado el texto de la respuesta y la lista de citas | Compare por plataforma y por cohorte de prompts | Mensual |
| Visitas de referencia por citas | Tráfico observable que sigue a los enlaces de citas | Datos de referencia/origen de la analítica, con las salvedades de cada plataforma | Use la línea base del propio sitio; no todas las superficies transmiten una atribución limpia | Mensual |
Recursos que merecen su tiempo
Mis textos e investigaciones relacionados
- Texto relacionado: mi estudio original sobre citación frente a posicionamiento, sobre el que se construye la actualización.
- Texto relacionado: mi análisis a gran escala de dónde aparecen las AI Overviews y qué dominios son citados.
Mis ponencias
- Ponencia relacionada (Speaker Deck): mi charla de Ahrefs Evolve 2025, origen del planteamiento «optimiza cómo internet habla de ti» y del ejemplo de apalancamiento de citas de Zapier mencionando a Ahrefs. Ponencia relacionada.
- Ponencia relacionada (Marketing Speak, ep. 539): una conversación más larga sobre la realidad de recuperado/mencionado/citado.
Del sector
- Lo que realmente sabemos sobre optimizar para la búsqueda con LLM: una panorámica de Ahrefs sobre el estudio de 75 000 marcas de Louise Linehan y Xibeijia Guan, incluidas las correlaciones de menciones de marca y de Domain Rating.
- Actualización: el 38 % de las citas de AI Overviews procede del top 10: el estudio de marzo de 2026 de Xibeijia Guan que informa de que la proporción de citas del top 10 cayó de ~76 % a ~38 % (la comparación metodológica exacta con el estudio anterior no se ha reverificado de forma independiente aquí), y de YouTube como el dominio más citado.
- Optimización para motores generativos: la guía estratégica de Ahrefs para conseguir citas.
- Evaluación de la verificabilidad en motores de búsqueda generativos: Liu, Zhang y Liang (Stanford, EMNLP 2023): solo ~51,5 % de las frases generadas están plenamente respaldadas por sus citas, y ~74,5 % de las citas respaldan realmente su frase.
- Presentamos AI Performance en Bing Webmaster Tools: el informe oficial de Microsoft de citas + grounding queries.
- El informe de citas de IA de 2026: OtterlyAI (más de 1 millón de puntos de datos): la estadística de grounding de que “99.6% of AI influence is invisible” (traducción) «el 99,6 % de la influencia de la IA es invisible» y que ~73 % de los sitios tienen problemas de rastreabilidad que bloquean el acceso de la IA.
- La IA es muy incoherente al recomendar marcas: SparkToro: menos de 1 probabilidad entre 100 de obtener listas de marcas idénticas en 100 ejecuciones del mismo prompt.
- Cómo cita fuentes cada plataforma: Discovered Labs: ChatGPT cita solo ~15 % de lo que recupera; ~82,9 % de las citas B2B proceden de fuentes de terceros.
- Monitoriza bots de IA en Log File Analyser: Screaming Frog sobre la distinción entre los bots
-Usery los de entrenamiento, y por qué cada error a un bot de inferencia es una cita perdida. - Cómo funcionan los motores de búsqueda con IA: Ryan Law (Ahrefs) sobre el RAG como mecanismo de grounding detrás de las citas.
Estadísticas que merece la pena citar
- ~76 % → ~38 % (comparación metodológica sin verificar): proporción informada de citas de AI Overviews procedentes del top 10 orgánico, mediados de 2025 frente a principios de 2026; el posicionamiento y la citación de IA parecen estar desacoplándose a medida que madura la expansión de consultas (query fan-out), pero los denominadores exactos detrás de esta comparación concreta no se han reconfirmado de forma independiente. Fuente
- ρ ≈ 0,664 frente a ~0,326: menciones de marca en la web frente a Domain Rating como predictores de la inclusión en AI Overviews en el estudio de 75 000 marcas de Ahrefs realizado por Louise Linehan y Xibeijia Guan; ganan las menciones. Fuente
- ~5–10 %: la proporción de fuentes que las plataformas de IA referencian sobre una marca que están en el sitio propio de la marca; ~90 % son de terceros (McKinsey, retransmitido). Contexto
- ~15 %: la fracción de páginas recuperadas que ChatGPT cita realmente; ser recuperado es necesario pero está lejos de ser suficiente (Discovered Labs, retransmitido). Fuente
- 51,5 % / 74,5 %: de frases generadas por IA plenamente respaldadas por citas, y de citas que respaldan realmente su frase, respectivamente (Stanford, EMNLP 2023). Fuente
- ~1 %: de usuarios que hacen clic en una fuente citada dentro de un resumen de IA; la mayoría de las sesiones de IA terminan sin una visita al sitio (Pew, retransmitido). Ser citado rara vez significa ser clicado. Contexto
Ponga a prueba sus conocimientos: citas de IA
Cinco preguntas rápidas sobre cómo los motores de respuesta con IA eligen qué citar. Elija una respuesta para cada una y después compruébelas.
Registro de cambios
Actualizado el 6 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 6 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 6 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 22 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 20 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 19 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 17 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.