استشهادات الذكاء الاصطناعي

كيف تختار محركات الإجابات بالذكاء الاصطناعي الصفحات التي تستشهد بها، وما الفرق بين الاسترجاع والذكر والاستشهاد، وما الذي يجعل الصفحة أرجح للظهور كمصدر في Google AI Overviews وChatGPT وPerplexity وCopilot.

نُشر أول مرة: 3 يوليو 2026 · آخر تحديث: 6 أغسطس 2026 · Advanced
اللغات

استشهاد الذكاء الاصطناعي هو رابط المصدر المنسوب الذي يظهر بجانب النص المولّد. وهو الحالة الأخيرة من ثلاث حالات يجب قياسها منفصلة: استُرجعت الصفحة، ذُكرت العلامة بلا رابط، أو عُرض عنوان URL كمصدر. يعتمد الاستشهاد على الاسترجاع المعزز بالتوليد، لذا يلزم أن تكون الصفحة قابلة للزحف والفهرسة وظهور المقتطف. لكنه لا يساوي الترتيب ولا الروابط الخلفية؛ وتبقى الأرقام المقارنة لاتجاه استشهادات AI Overviews بحاجة إلى تحقق منهجي مستقل. تسبق الإشارات المميزة للعلامة الظهور في الذكاء الاصطناعي أكثر من Domain Rating، ونحو 90% من الاستشهادات عن العلامة تأتي من مواقع طرف ثالث، كما أن ظهور الاستشهاد لا يثبت أن المصدر يدعم الادعاء المجاور.

بالنسبة إلى OpenAI، الغرض المعلن لـOAI-SearchBot هو الظهور في البحث، بينما يملك GPTBot إعداداً منفصلاً للتحكم في التدريب. Evidence for this claim OpenAI identifies OAI-SearchBot as the crawler used to link to and surface websites in ChatGPT search results, separately from GPTBot training controls. Scope: OpenAI-declared crawler behavior; selection and citation are not guaranteed. Confidence: high · Verified: OpenAI: Crawlers وبالنسبة إلى Google، قد يعتمد اختيار الروابط الداعمة على تشعب الاستعلامات خارج مجموعة نتائج واحدة. Evidence for this claim Google says AI Overviews and AI Mode show supporting links and can use query fan-out to find a wider and more diverse set of relevant pages. Scope: Google Search AI features; link selection is system-dependent. Confidence: high · Verified: Google: AI features and your website وظهور الاستشهاد أصلاً ليس دليلاً قط على أن الصفحة المستشهد بها تدعم الادعاء المجاور — فهذا فحص مستقل يضاف إلى الإسناد. Evidence for this claim Citation presence alone is not proof the cited source supports the adjacent generated statement; a study of four 2023 generative search systems found meaningful gaps between citation recall and citation precision. Scope: Findings from evaluated 2023 generative search systems (Bing Chat, NeevaAI, Perplexity, YouChat); supports the general citation-verifiability distinction, not current-system rates. Confidence: high · Verified: Liu, Zhang & Liang: Evaluating Verifiability in Generative Search Engines (EMNLP 2023)

الخلاصة — استشهاد الذكاء الاصطناعي هو المصدر المنسوب المعروض بجانب النص المولّد بالذكاء الاصطناعي، ويُختار وقت التوليد من بين ما استرجعه النظام عبر RAG — لا مما رتّبه في قائمة. وهو آخر ثلاث حالات: مُسترجَع (طلب مسجل لصفحتك، وليس دليلاً على وصول المحتوى إلى سياق النموذج)، ومذكور (ورد اسمه في النص بلا رابط)، ومُستشهَد به (عنوان URL منسوب). تعتمد Google AI Overviews على فهرسها الأساسي، لذلك يجب أن تكون الصفحة مفهرسة ومؤهلة لظهورها بمقتطف كي يُستشهد بها — لكن الاستشهاد لا يساوي الترتيب (تشير أبحاث Ahrefs إلى هبوط حاد في حصة النتائج العشر الأولى، من نحو 76% إلى نحو 38% بين منتصف 2025 وبداية 2026، مع بقاء مقارنة المنهجية الدقيقة بين الدراستين غير موثقة) ولا يساوي الروابط الخلفية (ترتبط الإشارات إلى العلامة على الويب بالظهور في الذكاء الاصطناعي بنحو 0,66 مقابل نحو 0,33 لـDomain Rating). يأتي نحو 90% من الاستشهادات عن العلامة من مواقع طرف ثالث، وتستشهد المنصات بطرق متباينة جداً (Perplexity تكاد تستشهد بكل ما تسترجعه، بينما ChatGPT تكاد لا تستشهد بشيء). وحتى الاستشهاد غالباً لا ينتج نقرة — كما أنه ليس دليلاً على دعم المصدر للادعاء المجاور.

الاستشهاد هو الحالة الثالثة، وليس الصورة كلها

Citation is one observable state, not shorthand for every way a system may have used your content. المصدر: /ai-search/measurement-and-reporting/retrieved-mentioned-cited/

Retrieved means a system requested or fetched the content, evidenced by logs or retrieval traces — that request is not proof the content reached the model's context. Mentioned means the answer used the brand, entity, or facts in its prose, evidenced by the answer text. Cited means the interface exposed a source link or citation to the page, evidenced by a visible source URL. These states need separate measurement.

© Patrick Stox LLC · CC BY 4.0 ·

ابدأ بالتمييز الذي يحل معظم ارتباك القياس. يمكن أن يكون محتواك في حالة واحدة أو حالتين أو الحالات الثلاث كلها في الوقت نفسه — ولكل حالة أداة مختلفة لرصدها:

  • مُسترجَع. تُظهر إصابة في السجل من زاحف ذكاء اصطناعي أو روبوت استدلال مباشر أن طلباً وصل إلى صفحتك أثناء معالجة النظام لاستعلام. هذا دليل حقيقي على الجلب — لكن الطلب في سجلاتك ليس دليلاً على إدخال المحتوى في سياق النموذج أو استخدامه؛ فالسجلات تُظهر ما طُلب، لا ما اختير. ولا يمكن رصد ذلك إلا في سجلات الخادم (عملاء زحف الذكاء الاصطناعي)، ويختفي عن أي أداة تعمل بتحليل إجابات الذكاء الاصطناعي وحدها.
  • مذكور. يظهر اسم علامتك أو منتجك أو اسمك في النص المولّد — من دون رابط تشعبي. يعرفك الذكاء الاصطناعي من بيانات التدريب أو من المحتوى المسترجع ويسميك من دون إسناد. ويمكن قياس ذلك بأدوات تحليل الإجابات مثل Ahrefs Brand Radar.
  • مُستشهَد به. يُعرض عنوان URL لصفحتك بوصفه مصدراً منسوباً — رابطاً قابلاً للنقر أو مرجعاً مرقماً أو صندوق مصدر مسمى. ويتطلب ذلك أن يكون الذكاء الاصطناعي قد استرجع محتواك وقرر أنه يستحق الإسناد.

الفجوات بينها هي القصة كلها. يمكن استرجاع المحتوى من دون ذكره، وذكره من دون الاستشهاد به، بل توجد — في مشكلة «الاستشهاد الشبح» العكسية — استشهادات من دون ظهور اسم علامتك في النص. كما أن الطلب المرصود في سجلاتك ادعاء أضعف ومختلف عن «اختير المحتوى في الإجابة» — فتعامل مع الاسترجاع بوصفه دليلاً على الجلب، لا دليلاً على الاستخدام. (ويستحق إطار المسترجَع / المذكور / المستشهَد به معالجة مستقلة؛ فهذا المقال يتناول طرف آليات الاستشهاد.)

كيف يُنشأ الاستشهاد فعلياً: RAG فوق فهرس حي

الاستشهادات ناتج التوليد المعزز بالاسترجاع — نمط الاسترجاع ثم التوليد الذي يقف خلف كل محرك إجابات رئيسي بالذكاء الاصطناعي. ويربط تعريف Google نفسه ذلك مباشرة بالتأصيل: RAG هو “a technique (also known as grounding) used to improve the quality, accuracy, and freshness of AI responses by relying on our core Search ranking systems to retrieve relevant, up-to-date web pages from our Search index.”(ترجمة) «تقنية (تُعرف أيضاً باسم التأصيل) لتحسين جودة إجابات الذكاء الاصطناعي ودقتها وحداثتها، بالاعتماد على أنظمة ترتيب البحث الأساسية لدينا لاسترجاع صفحات ويب ملائمة وحديثة من فهرس البحث.» (أما خط أنابيب الاسترجاع نفسه — تقسيم المقاطع والتضمينات والبحث المتجهي وإعادة الترتيب — فانظر إلى التحليلات المتخصصة الشقيقة؛ فما يهمني هنا هو ما يحدث في خطوة الإسناد.)

ينتج عن ذلك التعريف أثران مباشران، وهما ما تصرّح به Google صراحةً:

  • لا يوجد فهرس ذكاء اصطناعي منفصل. تسترجع AI Overviews من فهرس البحث الأساسي نفسه الذي تستخدمه النتائج العادية، ولذلك “a page must be indexed and eligible to be shown in Google Search with a snippet, fulfilling the Search technical requirements. There are no additional technical requirements.”(ترجمة) «يجب أن تكون الصفحة مفهرسة ومؤهلة للظهور في بحث Google بمقتطف، مستوفيةً المتطلبات التقنية للبحث. ولا توجد متطلبات تقنية إضافية.» وقابلية الزحف والفهرسة والأهلية للمقتطف هي الحد الأدنى للاستشهاد. احجب Googlebot أو أعد أخطاء، فتُزال الصفحة بالكامل من الأهلية.
  • الاسترجاع أوسع من الاستعلام الواحد. تجري Google تشعباً للاستعلام: “Both AI Overviews and AI Mode may use a ‘query fan-out’ technique — issuing multiple related searches across subtopics and data sources — to develop a response.”(ترجمة) «قد تستخدم AI Overviews وAI Mode تقنية «تشعب الاستعلام» — بإجراء عمليات بحث متعددة ذات صلة عبر الموضوعات الفرعية ومصادر البيانات — لتطوير إجابة.» وتُسترجع الصفحات لاستعلامات فرعية لا تظهر قط في الإجابة المرئية. تلك هي عمليات الاسترجاع «المظلمة» — محتوى أسهم من دون إسناد.
Evidence for this claim Google says AI Overviews and AI Mode may issue multiple related searches across subtopics and data sources and identify supporting pages while generating a response. Scope: Google Search Confidence: high · Verified: AI features and your website

على مستوى API، تجعل البنية فجوة «مُسترجَع لكن غير مستشهَد به» صريحة: يعيد التوليد المؤسَّس على Google نص النموذج مع تعليقات استشهاد مضمنة، يربط كل منها مقطعاً نصياً محدداً بعنوان URL لمصدر — لكن القائمة الكاملة للمصادر المسترجعة لا تُعرض للمستخدم النهائي. ترى ما استُخدم، لا ما قُرئ.

لماذا لا يساوي الاستشهاد الترتيب (والرقم الذي يثبت ذلك)

من أكثر النتائج الاتجاهية فائدة لأي شخص يعمل في هذا المجال: يبدو أن الاستشهاد من الذكاء الاصطناعي ينفصل تدريجياً عن احتلال المرتبة الأولى. في أبحاث Ahrefs (دراسة يوليو 2025 ثم تحديث مارس 2026 الذي أجراه Xibeijia Guan)، يُقال إن حصة استشهادات AI Overview القادمة من موضع عضوي ضمن النتائج العشر الأولى هبطت من نحو 76% في منتصف 2025 إلى نحو 38% في بداية 2026 — مع رقم مستقل من BrightEdge أقل حتى. أريد التنبيه إلى ذلك بوضوح: لم أستطع إعادة التحقق مستقلاً من المنهجية والمقام الدقيقين وراء مقارنة 76% إلى 38%، لذا اجعل الخلاصة هي الاتجاه (تراجع حصة النتائج العشر الأولى)، لا النسب الدقيقة، حتى يكتمل ذلك الفحص. وتشرح Google الاتجاه الأوسع بأن تشعب الاستعلامات يشارك أكثر في جلب المصادر: إذ تسحب AI Overviews بصورة متزايدة من نتائج الاستعلامات الفرعية بدلاً من النتائج العشر الأولى للاستعلام الأصلي — وهذه الآلية مؤكدة مباشرة في وثائق Google نفسها، بصرف النظر عن الإحصاء المحدد أعلاه.

قراءتان عمليتان:

  • احتلال المرتبة الأولى في استعلامك الرئيسي لم يعد يضمن الاستشهاد، كما أن عدم احتلال المراتب العشر الأولى لم يعد يستبعدك. YouTube مثال صارخ — فهو النطاق الأكثر استشهاداً في AI Overviews، ولا تحتل نسبة كبيرة من عناوين YouTube المستشهد بها أي مرتبة ضمن أفضل 100 نتيجة للاستعلام. ويُجلب الفيديو إلى حد كبير بصورة مستقلة عن الترتيب التقليدي.
  • تظل أهلية الاستشهاد محكومة بـSEO التقليدي (مفهرس + مؤهل للمقتطف)، حتى بينما يبتعد اختيار الاستشهاد عن موضع الترتيب. الأمران صحيحان معاً، ولذلك فإن عبارتي «الذكاء الاصطناعي قتل SEO» و«الذكاء الاصطناعي مجرد SEO» كلتاهما خاطئتان.

لماذا لا يساوي الاستشهاد الروابط الخلفية أيضاً

الرد الفعل الآخر — «روابط خلفية أكثر، استشهادات أكثر» — لا تؤيده البيانات أيضاً. وجدت دراسة Ahrefs التي شملت 75 000 علامة وأجراها Louise Linehan وXibeijia Guan أن أقوى متنبئ بالظهور في AI Overviews لم يكن Domain Rating ولا الروابط الخلفية؛ بل الإشارات إلى العلامة على الويب، بارتباط يقارب 0,664 مقابل نحو 0,326 لـDomain Rating، وأقل من ذلك لعدد الروابط الخلفية. وفي تحليل منفصل أجريته، ارتبطت الإشارات في الصفحات كثيرة الروابط أيضاً بإشارات الذكاء الاصطناعي.

هذا يعيد صياغة اللعبة كلها. ليس المعنى أن السلطة لم تعد مهمة، بل إن الحديث عنك مؤشر أفضل لما تكافئه أنظمة الذكاء الاصطناعي من الحصول على رابط. ويزيد اكتشاف McKinsey الأمر وضوحاً: لا يمثل موقع العلامة نفسه إلا نحو 5–10% من المصادر التي تشير إليها منصات الذكاء الاصطناعي عند الحديث عن تلك العلامة. ويعيش نحو 90% من الاستشهادات عنك على مواقع طرف ثالث — ناشرين ومنصات مراجعات ومحتوى ينشئه المستخدمون وYouTube وReddit. وكما قلت في حديث Ahrefs Evolve: كانت المهمة «حسّن موقعك»، وأصبحت الآن «حسّن طريقة حديث الإنترنت عنك». وكانت ست عشرة صفحة على موقع Zapier تذكر Ahrefs كافية لظهور Ahrefs مستشهداً بها في أكثر من 1 400 إجابة من إجابات الذكاء الاصطناعي — وهو أثر لا يضاهيه أي قدر من التعديلات داخل الموقع.

تختلف المنصات اختلافاً كاملاً في الاستشهاد

«الحصول على استشهاد من الذكاء الاصطناعي» ليس سلوكاً واحداً — فقد تُسترجع الصفحة نفسها على منصتين وتنتج عنها نتيجتا إسناد متعاكستان:

  • Perplexity تجري بحثاً آنياً على الويب لكل استعلام تقريباً، وبُنيت لتكون شفافة بشأن المصادر — فهي في المتوسط أكثر المنصات الكبرى إظهاراً للاستشهادات لكل إجابة، وتستشهد بكل ما تسترجعه تقريباً. وهي الأقل احتمالاً لأن «تذكر من دون استشهاد».
  • ChatGPT يجيب كثيراً من بيانات التدريب من دون استرجاع إطلاقاً، وعندما يسترجع (عبر طبقة البحث المدعومة بـBing) لا يستشهد إلا بنسبة صغيرة من الصفحات التي جلبها. ومعدل الاستشهاد العام لديه هو الأدنى بين المنصات الكبرى. وهذه أوضح واجهة لحالة «مذكور لكن غير مستشهَد به».
  • Google AI Overviews / AI Mode تربط الاستشهادات بمقاطع نصية محددة، وتستمد المصادر من الفهرس الأساسي ومن تشعب الاستعلامات، وتستشهد — كما سبق — خارج النتائج العشر الأولى على نحو متزايد.
  • Microsoft Copilot تكشف شيئاً لا تكشفه المنصات الأخرى: استعلامات التأصيل، أي العبارات الفعلية التي استخدمتها لجلب المحتوى المشار إليه. وهذا أقرب ما تقدمه أداة رسمية إلى إظهار طبقة الاسترجاع.

الخلاصة ليست ملاحقة غرائب منصة واحدة، بل أن الاستشهاد احتمالي وغير متسق. إجابات الذكاء الاصطناعي متقلبة؛ فالمطالبة نفسها عند تشغيلها مراراً تنتج قوائم علامات تجارية ومصادر مختلفة، ولذلك لا يخبرك فحص واحد إلا بالقليل.

هناك أيضاً حدود موثقة للمنتجات والأوضاع ينبغي أن يخزنها نظام المراقبة بوصفها نتائج منفصلة، بدلاً من اعتبار كل رابط مفقود مشكلة ناشر:

  • واجهة بحث الويب في OpenAI: حقل sources هو المجموعة الكاملة لعناوين URL التي استشارها النموذج، بينما الاستشهادات المضمنة مجموعة أصغر مختارة. لذلك يمكن استرجاع مصدر من دون الاستشهاد به، كما تشترط وثائق API أن تكون الاستشهادات المضمنة المعروضة مرئية وقابلة للنقر. هذا عقد API، وليس دليلاً على أن منتج ChatGPT للمستهلك يعرض الحقول نفسها. Evidence for this claim In OpenAI API web search, the sources field lists all consulted URLs while inline citations show only selected relevant references; source count can exceed citation count, and search_context_size guarantees neither. Scope: OpenAI API web search response fields and configuration; not a claim about undisclosed retrieval or ChatGPT consumer-product presentation. Confidence: high · Verified: OpenAI API: Web search — Sources and search context size Evidence for this claim OpenAI requires inline citations to be clearly visible and clickable when an application displays web-search results or information from those results to end users. Scope: OpenAI API web search display contract; this does not assert identical fields or presentation in the ChatGPT consumer product. Confidence: high · Verified: OpenAI API: Web search — Output and citations
  • Microsoft Copilot: لا يؤدي Voice للمستهلك بحثاً على الويب حالياً، ولذلك لا يُتوقع استشهاد. Evidence for this claim Microsoft's consumer Copilot transparency note says web-grounded text responses include citations, while voice prompts do not trigger web search and therefore have no citations. Scope: Consumer Microsoft Copilot Voice mode; Microsoft 365 Copilot and text/web-grounded modes have different behavior. Confidence: high · Verified: Microsoft Copilot: Transparency note أما في Microsoft 365 Copilot، فعندما يُجرى بحث ويب يعرض منظور Sources كلاً من المصادر والاستعلام القصير الدقيق المرسل إلى Bing؛ ويستخدم ذلك الاستعلام المشتق عادةً بضع كلمات فقط من المطالبة أو الملف. Evidence for this claim Microsoft 365 Copilot's Sources view exposes the exact query sent to Bing and the sources used; the query generally uses a few prompt or uploaded-file words rather than the full input. Scope: Microsoft 365 Copilot Chat and agents when web search runs; organization policy can disable web search. Confidence: high · Verified: Microsoft 365 Copilot: How web search works
  • تطبيقات Gemini: تقول Google صراحةً إن كل إجابة لا تتضمن روابط ذات صلة أو مصادر. وعدم وجود زر Sources يعني أنه لم تُقدم روابط لتلك الإجابة؛ ولا يثبت وحده فشل الاسترجاع أو حجب الناشر لأي شيء. Evidence for this claim Gemini Apps may provide sources or related links, but not every response includes them; no Sources button means Gemini provided no links for that response. Scope: Gemini Apps source-link presentation; absence of links does not by itself establish retrieval failure or a publisher defect. Confidence: high · Verified: Google Gemini Apps: View related sources

الحقيقة غير المريحة: الاستشهاد لا يساوي الزيارات

وأخيراً، اضبط الهدف. الاستشهاد إشارة وعي وسلطة أكثر بكثير من كونه قناة زيارات في الوقت الحالي. وجدت أبحاث مستقلة (Pew) أنه عندما يظهر ملخص من الذكاء الاصطناعي، لا ينقر إلا عدد صغير من المستخدمين — بنسبة أحادية الرقم — على أي رابط، وينقر نحو 1% فقط على مصدر مستشهَد به داخل الملخص، بينما تنتهي الغالبية الكبيرة من جلسات البحث بالذكاء الاصطناعي من دون زيارة موقع. حسّن الاستشهادات لأنها تبني حضور العلامة وسلطتها في الإجابات التي يقرأها الناس — لا لأنك ينبغي أن تتوقع نقرة لكل استشهاد.

أين يندرج هذا؟ الاستشهاد هو طرف الإسناد من التأصيل وRAG، ويعمل فوق الاسترجاع (تقسيم المقاطع والتضمينات والبحث المتجهي وترتيب المقاطع)، ويجاور ديناميكيات حداثة إجابات الذكاء الاصطناعي وهلوساتها. الآليات مشتركة عبر هذه المجموعة؛ وما يخص الاستشهادات هو تمييز الحالات الثلاث، وانفصالها عن الترتيب والروابط الخلفية، وأثر الإشارات من مواقع الطرف الثالث.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.