
أهم النقاط
- أجرت تجربة عاملية 252,000 محاولة على ستة نماذج LLM وثمانية عشر عاملًا، ووجدت أن الصلة بالموضوع وموضع المصدر في القائمة أقوى ما يتنبأ بالاستشهاد به أولًا.
- وجدت دراسة تتبّع لأكثر من 100,000 إجابة من محركات البحث بالذكاء الاصطناعي أن 2.9% فقط من الاستشهادات تشير إلى نطاق العلامة نفسها، و75.2% تشير إلى شركات أخرى في المجال.
- رفع إطار AgentGEO نسب الاستشهاد أكثر من 40% قياسًا بالصفحات قبل التحسين، وعدّل 5% فقط من محتوى الصفحة مقابل 25% في الطرق الأخرى.
- في مجموعة تشخيصية من 949 زوجًا، يعود 62.2% من حالات الفشل إلى أن المحتوى لا يطابق ما يحتاجه الطلب، لا إلى مشكلات تقنية.
- دراستان من الثلاث مسودات من 2026 والثالثة مقبولة في SIGIR 2026، وكل منها اختبرت عددًا محدودًا من نماذج LLM قد لا يمثل المحركات الفعلية.
تنتشر في مدونات الصناعة منذ عامين نصائح GEO تقول إن الاقتباسات تساعد، وكذلك الإحصاءات والبيانات المنظَّمة، وسندها في الغالب مقالات تجميعية يستشهد بعضها ببعض لا دراسة مسمّاة.
بدأ هذا يتغير. فثلاث أوراق نُشرت أو قُبلت في 2026 أجرت تجارب مضبوطة أو دراسات تتبّع واسعة عمّا يجعل محركات الذكاء الاصطناعي التوليدية تستشهد بمصدر. ويقوم هذا المقال على نصوصها الفعلية لا على ملخص ملخص.
ما الذي يرجّح الاستشهاد؟
أدق الثلاث دراسة عاملية لـ Vishwakarma وKumar وJamidar، قُبلت في SIGIR 2026. بنى الفريق بيئة اختبار بوثيقتين لتوليد الإجابة المعزَّز بالاسترجاع: يحقن المصدرين في سياق النموذج، ويغيّر عاملًا واحدًا بينهما، ثم يقيس أي مصدر تشير إليه أول علامة استشهاد في الإجابة.
أجرى الفريق عبر ستة نماذج LLM نحو 252,000 محاولة تغطي ثمانية عشر عاملًا، مع إخفاء هوية العلامات وتبديل ترتيب المصادر بالتساوي، ليفصل أثر المحتوى عن انحياز الموضع البسيط.
والنتيجة تهدم كثيرًا من موروث GEO: الصلة بالموضوع وموضع المصدر في القائمة هما أكبر ما يحدد الاستشهاد به أولًا، لا أي لمسة منفردة في الصفحة. ويساعد ذكر السعر الصريح وحداثة التاريخ باستمرار لكن بفارق أصغر.
وتضيف اكتمال المحتوى وإشارات الثقة مكاسب أصغر منهما. أما التعديلات الشكلية وحدها، وهي ما تنبّه إليه أدوات القوائم المرجعية، فلم يظهر لها أثر يُقاس.
إلى أين تذهب الاستشهادات؟
دراسة تتبّع منفصلة وأكبر بكثير لـ Pratyush Kumar، أُجريت على منصة Ranqo، حلّلت 102,025 إجابة من الذكاء الاصطناعي على 102 علامة تجارية في خمسة محركات بين مارس ومايو 2026. وأبرز أرقامها ليس نسبة ارتفاع بإضافة اقتباس، بل وجهة الاستشهادات نفسها.
لا تشير إلى نطاق العلامة نفسها إلا 2.9% من 149,912 استشهادًا جاءت من طلبات ذكرت علامة، بينما تشير 75.2% إلى شركات أخرى في المجال. وتأخذ المصادر المؤسسية نحو 78% من كل الاستشهادات، ويتوزع الباقي بين YouTube وReddit والإعلام التحريري وWikipedia.
وكانت قوائم best-of المرتبة أكثر أشكال المحتوى استشهادًا بنحو 21%. ووجدت الدراسة أيضًا أن الظهور يتصاعد بحدّة مع مكانة العلامة: ظهرت العلامات العالمية المعروفة في 73% من الإجابات ذات الصلة عند التشغيل الأول، والعلامات الراسخة متوسطة الحجم في 44%، والصغيرة في 11% فقط.
كيف تُشخَّص حالات الفشل؟
ورقة ثالثة لـ Tian وChen وTang وLiu وJia تتعامل مع الاستشهاد على أنه شيء يُشخَّص لا يُقاس فقط. يصنّف إطار AgentGEO سبب فشل صفحة معيّنة في الاستشهاد بها، ثم يطبّق إصلاحًا موجّهًا بدل إعادة كتابة عامة.
اختُبر الإطار على 12,240 طلب بحث من 204 صفحة ويب حقيقية، فبلغت نسبة الاستشهاد على GPT نحو 79.52% مقابل 56.58% للصفحات قبل التحسين، أي تحسنًا نسبيًا يتجاوز 40%، ومقابل 68.80% لأفضل طريقة مرجعية. ولم يمسّ إلا 5% من محتوى الصفحة، مقابل 25% في الطرق المرجعية.
وتحليل الفشل هو الأنفع للناشرين. ففي مجموعة تشخيصية منفصلة من 949 زوجًا من الصفحات،
يعود 62.2% من الحالات إلى أن المحتوى لا يطابق ما يحتاجه الطلب، و27.1% إلى مشكلات أوسع في جودة المحتوى، و10.1% فقط إلى سلامة تقنية مثل حظر الوصول أو فشل العرض. الوصول التقني نادرًا ما يكون العائق، والصلة هي العائق.
هل رقم 68% و32% حقيقي؟
تعيد نتائج البحث في هذا الموضوع ادعاءً محددًا: أن 68% من استشهادات الذكاء الاصطناعي تأتي من مصادر خارجية و32% فقط من مواقع العلامات نفسها. هذا الرقم لا يرد في أي من الأوراق الأربع التي راجعناها، ومنها دراسة Kumar التي تقيس هذا التقسيم على نطاق واسع.
والرقم الحقيقي عند Kumar أشد تطرفًا في الاتجاه نفسه: 2.9% من الاستشهادات تقع على نطاق العلامة، لا 32%. فيبدو أن رقم 68/32 المتداول إما من مصدر لا يمكن التحقق منه، أو صيغة مشوّهة لأرقام دراسة أخرى. لذلك لم نستخدمه.
ويتتبع مسح نقدي يغطي المجال من 2023 إلى 2026 رقمًا آخر إلى مصدره. فمقتطفات البحث تذكر «252,000 محاولة على ستة نماذج وثمانية عشر عاملًا» دون اسم ورقة، والمسح ينسب هذا الرقم إلى ورقة Vishwakarma وزملائه في SIGIR 2026، وقد جلبناها وتأكدنا منها مباشرة.
ويذكر المسح نفسه، نقلًا عن ورقة GEO الأصلية لعام 2024 لـ Aggarwal وزملائه، مكسبًا نسبيًا نحو 41% في عدد الكلمات المعدَّل بالموضع عند إضافة اقتباسات. ولم نتحقق منه من نص Aggarwal نفسه، فنعدّه أبعد بخطوة من الدراسات الأولية الثلاث أعلاه.
ماذا يعني هذا لنا؟
خلاصة الناشرين الموثَّقة أضيق من نصيحة GEO في مدونات SEO. فموضع المصدر في المجموعة المسترجعة والصلة بطلب البحث الفعلي يتصدران كل نتيجة عاملية راجعناها، ولم تجد أي دراسة حيلة تنسيق تتفوق على أن تكون المصدر الأوثق صلة والأفضل موضعًا للسؤال المطروح.
وتستحق ميزة قوائم best-of أن يُعمل بها: فللصفحة المبنية مقارنةً مرتبة ميزة استشهاد مقيسة على صفحة هبوط عامة.
وتفكيك AgentGEO للفشل عدسة تشخيص مفيدة حتى بدون الأداة: إذا لم يُستشهد بصفحة، فتحقق أولًا من أنها تجيب فعلًا عن الطلب قبل أن تلجأ إلى ترميز schema أو صياغات تستجدي الاستشهاد.
وما لم يثبت بعد هو أي صيغة مستقرة. فكل رقم هنا من مجموعة محددة من نماذج LLM اختُبرت في تواريخ محددة من 2026، ولم يُراجَع معظمها علميًا. والمجال فتي إلى حد أن إحصاءً شائعًا مثل تقسيم 68/32 يتداول أشهرًا دون أن يعود إلى دراسة حقيقية.
فإذا ذكر لك مزوّد خدمة نسبة GEO، فاسأل من أي ورقة هي، ثم اقرأ الورقة بنفسك.
الأدلة
- العيّنة
- 3 دراسات: 252,000 محاولة و102,025 إجابة و12,240 طلب بحث
الفرضية: بدأت مجموعة صغيرة لكنها متنامية من الأبحاث الأكاديمية تقيس تجريبيًا أي عوامل في المحتوى تتنبأ باستشهاد محركات البحث التوليدية بالذكاء الاصطناعي بمصدر ما، بدل الاعتماد على موروث في صناعة SEO يتكرر من مدونة إلى أخرى دون مصدر يمكن تتبّعه.
الطريقة: قرأنا أربع أوراق أكاديمية حديثة عن generative engine optimization وسلوك الاستشهاد في الذكاء الاصطناعي، وجلبنا ملخصاتها ونصوصها المتاحة بأنفسنا، فلم نكتفِ بمقتطف من نتائج البحث ولا بملخص مدونة ثانوية. وحين تعذّر تأكيد رقم متداول في الورقة التي يُنسب إليها، أو تعذّر تتبّع ملخص دراسة في مسح إلى نصها الأصلي، حذفنا الرقم أو نسبناه بقدر ما أمكن التحقق منه فقط.
النتائج
- أجرت دراسة Vishwakarma وزملائه العاملية 252,000 محاولة على ستة نماذج LLM وثمانية عشر عاملًا في بيئة اختبار بوثيقتين تختلفان في عامل واحد فقط في كل مرة. وبيّنت النماذج المختلطة أن الصلة بالموضوع وموضع المصدر في القائمة أكبر ما يحدد الاستشهاد به أولًا، وأن ذكر السعر الصريح وحداثة التاريخ يساعدان باستمرار، وأن اكتمال المحتوى وإشارات الثقة تضيف مكاسب أصغر، وأن التعديلات الشكلية وحدها أثرها ضعيف. والورقة مقبولة في SIGIR 2026.
- حلّلت دراسة التتبّع لـ Kumar عدد 102,025 إجابة على 102 علامة تجارية في خمسة محركات هي ChatGPT وGemini وPerplexity وClaude وGrok بين مارس ومايو 2026. وجدت أن 2.9% فقط من الاستشهادات تشير إلى نطاق العلامة نفسها، و75.2% تشير إلى شركات أخرى في المجال. وكانت قوائم best-of المرتبة أكثر أشكال المحتوى استشهادًا بنحو 21% من الاستشهادات.
- وجدت الدراسة نفسها سلّمًا واضحًا لمكانة العلامة في الظهور عند التشغيل الأول: ظهرت العلامات العالمية المعروفة في 73% من الإجابات ذات الصلة، والعلامات الراسخة متوسطة الحجم في 44%، والعلامات الصغيرة أو المتخصصة في 11% فقط، أي نحو 30 نقطة مئوية لكل درجة.
- اختبر إطار AgentGEO لـ Tian وزملائه على 12,240 طلب بحث من 204 صفحة ويب، وشخّص سبب فشل كل صفحة في الاستشهاد بدل تطبيق إعادة كتابة عامة. وبلغت نسبة الاستشهاد على GPT نحو 79.52% مقابل 56.58% للصفحات قبل التحسين، وهو التحسن النسبي الذي يتجاوز 40%، ومقابل 68.80% لأفضل طريقة مرجعية، مع تعديل 5% فقط من محتوى الصفحة مقابل 25% في الطرق المرجعية.
- في المجموعة التشخيصية المنفصلة للورقة، وهي 949 زوجًا من صفحات غير مستشهد بها ومنافسة مستشهد بها من GEO-Bench، يعود 62.2% من حالات فشل الاستشهاد إلى أن المحتوى لا يطابق ما يحتاجه الطلب، و27.1% إلى جودة المحتوى، و10.1% إلى سلامة تقنية، و0.6% إلى عوائق بنيوية. أي أن أغلب الحالات في تلك المجموعة تتعلق بالصلة لا بالوصول التقني.
الحدود: دراستان من الثلاث مسودات من 2026 لم تُراجَع علميًا، والثالثة، الدراسة العاملية، مقبولة في SIGIR 2026 لكنها كانت لا تزال قادمة وقت كتابة المسح. ولكل ورقة نماذج LLM وتصميم تجربة وتعريف للاستشهاد مختلف، فأرقامها تصف إعدادها هو ولا يصح جمعها في قاعدة واحدة. ودراسة Kumar صادرة عن منصة تجارية لقياس الظهور في الذكاء الاصطناعي (Ranqo) تحلل علاماتها المتتبَّعة، وهي بيانات حقيقية واسعة لكنها ليست عينة أكاديمية مستقلة. وتتأخر أبحاث GEO عن سلوك محركات البحث الفعلية بحكم بنيتها، لأن المحركات تحدّث منطق الاسترجاع والاستشهاد أسرع مما تُكتب الورقة وتُراجع وتُنشر، فكل نتيجة هنا تصف المحركات والتواريخ التي أُجريت فيها الدراسة، لا سلوك نسختها اليوم. أما الادعاء المتداول بأن 68% من استشهادات الذكاء الاصطناعي تأتي من مصادر خارجية و32% من مواقع العلامات، فلم نستطع تأكيده في أي ورقة راجعناها، فلم نستخدمه. والرقم الذي قاسه Kumar فعلًا، 2.9% فقط من الاستشهادات على نطاق العلامة، موثَّق وأشد تطرفًا من ذلك الادعاء المتداول.
المصادر
- 1.What Gets Cited: Competitive GEO in AI Answer Engines، arXiv, accepted to ACM SIGIR 2026، 25 مايو 2026مصدر أساسي
- 2.Generative Engine Optimization at Scale: Measuring Brand Visibility Across AI Search Engines، arXiv، 18 يونيو 2026مصدر أساسي
- 3.Diagnosing and Repairing Citation Failures in Generative Engine Optimization، arXiv، 10 مارس 2026مصدر أساسي
- 4.Optimizing Visibility in Generative Engines: A Critical Survey of Generative Engine Optimization 2023-2026، arXiv، 18 يوليو 2026
عن الكاتب

مؤسس UpgradIQ FZC LLC
يعمل Adam Hafez في SEO التقني وقياس البحث، من الزحف والفهرسة إلى استشهاد محركات الإجابة. أسّس UpgradIQ، التي تربط تغيّر الترتيب بسببه من بيانات Search Console وGA4. ينشر ما تدعمه البيانات، ويذكر حدودها.
- SEO التقني
- القياس بـ Search Console وGA4
- تحسين الظهور في محركات الإجابة
- البيانات المنظَّمة
قراءات ذات صلة
اختبار ChatGPT لوسوم ملونة للمنتجات
يختبر ChatGPT وسومًا مثل best all-rounder وbest for beginners على نتائج المنتجات بلونين أخضر ورمادي. ولم تعلّق OpenAI على الاختبار.
OpenAI تضع علامة مائية على نصوص ChatGPT
تضيف OpenAI علامة مائية غير مرئية لنصوص ChatGPT وCodex في الاتحاد الأوروبي، مع اشتراك اختياري عبر API عالميًا. التحرير يضعفها، ولا تستخدمها Google.
Search Console تنبّه إلى تجاوز خاصية AI
تقول صفحة مساعدة Google إن مالك خاصية النطاق الأعلى يرى إشعارًا حين تتجاوز خاصية فرعية إعداد الخاصية الأم في Search generative AI control.
كيف تحوّل Google الاستعلام إلى نتائج
ملخص حضور من ROAST لحديث Mueller وIllyes في برشلونة: توسيع المرادفات، واستعلامات fan-out التي لا تظهر في Search Console، والاسترجاع قبل الترتيب.



