انتقل إلى المحتوى
SEO Madmanby Adam Hafez
أداة مجانية

مدقق علامة meta للروبوتات ونتيجة Googlebot

تحقق من قواعد meta robots وX-Robots-Tag وفق قائمة Google، واكتشف القيم الخاطئة والتعارضات. أداة مجانية تعمل في متصفحك.

تعمل بالكامل في متصفحك. لا يُرفع ما تُدخله، ولا يُسجَّل، ولا يُحفظ.

لا يُرسل أي شيء تلصقه هنا إلى أي مكان، فالتحليل يجري في متصفحك فقط.

    أهم النقاط

    • توثّق Google أسماء علامة meta للروبوتات robots وgooglebot وgooglebot-news، وتقبل القواعد نفسها في عنوان X-Robots-Tag.
    • عندما تتعارض قواعد الروبوتات تطبّق Google الأكثر تقييدًا، لذلك تتقدم nosnippet على max-snippet.
    • القاعدة none تساوي noindex مع nofollow، فذكر أي منهما معها زائد.
    • تقبل max-image-preview القيم none أو standard أو large فقط، وتأخذ max-snippet وmax-video-preview عددًا صحيحًا لا يقل عن -1.
    • لم تعد القاعدة noarchive تتحكم في أي شيء في بحث Google، لأن ميزة الرابط المخزّن مؤقتًا أُزيلت.

    ما تحتاج إليه

    • علامات meta للروبوتات، ملصوقة كـ HTML
    • أسطر عنوان X-Robots-Tag

    أدوات أخرى

    كلها مجانية، وكلها تعمل في المتصفح.

    تصفّح الأدوات

    طريقة الاستخدام

    1. 1الصق العلامات وأسطر العناوينسطر لكل منها. تعمل علامة meta الكاملة وسطر X-Robots-Tag معًا، ويمكنك خلطهما لترى كيف يجتمع HTML الصفحة مع عناوين HTTP.
    2. 2اقرأ النتيجة المجمّعة لـ Googlebotيجمع المربع في الأعلى كل ما ينطبق على Googlebot، أي العلامات الموجهة إلى كل برامج الزحف أو إلى googlebot، ويطبّق القاعدة الأكثر تقييدًا عند التعارض.
    3. 3أصلِح كل ما يظهر كخطأالأخطاء قواعد لن تحللها Google، مثل max-image-preview بقيمة لا تقبلها، أو unavailable_after بلا تاريخ مقروء.
    4. 4راجِع التحذيراتالتحذير يدل على قاعدة خارج قائمة Google الموثّقة، أو قاعدة مكررة، أو تاريخ unavailable_after مضى بالفعل.
    5. 5ضع اسم برنامج الزحف في عنوان HTTP لا في القاعدةعنوان X-Robots-Tag ببادئة googlebot يستهدف برنامج الزحف هذا وحده، والعنوان بلا بادئة ينطبق على كل برامج الزحف.

    علامة meta للروبوتات وعنوان X-Robots-Tag يؤديان العمل نفسه في مكانين، وقد تحمل الصفحة الاثنين معًا. تفحص هذه الأداة كليهما وفق قائمة القواعد التي تنشرها Google، وتعرض ما يصل إليه Googlebot بعد جمعهما. تعمل في متصفحك، ولا يُرسل أي شيء تلصقه إلى أي مكان.

    ماذا تفحص الأداة؟

    كل سطر تلصقه يُقرأ إما علامة meta وإما عنوان X-Robots-Tag، وتُفحص كل قاعدة فيه وفق مواصفات Google:

    • اسم العلامة: يجب أن يكون اسم علامة meta هو robots أو googlebot أو googlebot-news، وهي الأسماء التي توثّقها Google. وأي اسم آخر يأخذ تحذيرًا.
    • القواعد البسيطة مثل noindex وnofollow وnone وnosnippet لا تأخذ قيمة، والقيمة بعد إحداها خطأ.
    • max-snippet وmax-video-preview تحتاجان إلى عدد صحيح: 0 للمنع، و-1 بلا حد، أو حد موجب. وتقول Google إن max-snippet:0 يساوي nosnippet.
    • max-image-preview تقبل none أو standard أو large، ولا شيء غيرها.
    • unavailable_after تحتاج إلى تاريخ مقروء. تقبل Google الصيغ الشائعة ومنها RFC 822 وRFC 850 وISO 8601. والتاريخ الذي مضى يأخذ تحذيرًا، لأن الصفحة تُعامل حينها كمنتهية الصلاحية.
    • القواعد المجهولة تظهر كتنبيه بدل التخمين، وهذا يكشف الأخطاء الإملائية وقواعد محركات بحث أخرى.

    وتفحص الأداة القواعد مقابل بعضها أيضًا: قاعدة مكررة في سطر واحد، وnone مع noindex أو nofollow، وnosnippet مع max-snippet، وindexifembedded بلا noindex تقترن بها.

    كيف تقرأ النتائج؟

    المربع في الأعلى هو النتيجة المجمّعة لـ Googlebot. يجمع كل ما يخاطب كل برامج الزحف أو googlebot، ويبيّن هل تُفهرس الصفحة، وهل تُتبع روابطها، وهل المقتطفات النصية ممنوعة.

    الأسطر الموجهة إلى googlebot-news أو إلى برنامج زحف آخر بالاسم تُفحص، لكنها لا تدخل في هذا الجمع.

    تحت المربع يظهر كل سطر مع برنامج الزحف الذي ينطبق عليه. الأحمر خطأ لن تحلله Google، والبرتقالي تحذير، والرمادي ملاحظة عن تكرار أو تعارض محسوم. والسطر بلا ملاحظات يظهر “سليم” مع قواعده.

    مثال عملي

    يحمل الحقل عند فتح الأداة أربعة أسطر فيها مشكلات مقصودة:

    • <meta name="robots" content="noindex, max-snippet:50, nosnippet"> ينطبق على كل برامج الزحف. وتقول الملاحظة إن nosnippet وmax-snippet تتعارضان، وتُطبَّق الأكثر تقييدًا، أي nosnippet.
    • <meta name="googlebot" content="max-image-preview:huge"> خطأ: max-image-preview تقبل none أو standard أو large.
    • X-Robots-Tag: googlebot: unavailable_after: 25 Jun 2010 15:00:00 PST يستهدف googlebot، وتاريخه مضى، فتُعد الصفحة منتهية الصلاحية.
    • X-Robots-Tag: noarchive, nofollow يأخذ تحذيرًا بسبب noarchive التي لم تعد Google تستخدمها.

    وتكون النتيجة المجمّعة: لا تُفهرس (noindex) · الروابط لا تُتبع (nofollow) · بلا مقتطف نصي.

    أخطاء شائعة تكشفها

    • قيم مختلَقة مثل max-image-preview:huge أو max-snippet:short.
    • قواعد ملغاة باقية من قوالب قديمة، وأبرزها noarchive.
    • تناقض بين العنوان وHTML: عنوان يقول noindex وعلامة meta لا تقول شيئًا يجتمعان على noindex، لأن القاعدة الأكثر تقييدًا هي التي تُطبَّق.
    • قواعد زائدة مثل none بجانب noindex، وهي تجعل القوالب أصعب في القراءة.

    وهناك خطأ لا تراه الأداة من العلامات وحدها: قاعدة Disallow في robots.txt. تقول Google إن الصفحة الممنوعة من الزحف لا تُكتشف قواعد فهرستها وعرضها أبدًا. ويحكم ذلك الملفَّ المعيار RFC 9309، وتفحصه أداة اختبار robots.txt.

    أدوات ومقالات ذات صلة

    المصادر

    1. 1.Robots meta tag, data-nosnippet, and X-Robots-Tag specifications، Google Search Centralمصدر أساسي
    2. 2.RFC 9309: Robots Exclusion Protocol، IETF

    أسئلة شائعة

    ما قيم علامة meta للروبوتات التي تدعمها Google؟

    تقبل الأداة القواعد الموجودة في صفحة مواصفات Google: all وnoindex وnofollow وnone وnosnippet وindexifembedded وnotranslate وnoimageindex بلا قيمة، ثم max-snippet وmax-image-preview وmax-video-preview وunavailable_after بقيمة. وأي قاعدة أخرى تظهر كقاعدة غير موثّقة.

    ماذا يحدث عندما تتعارض قواعد الروبوتات؟

    تطبّق Google القاعدة الأكثر تقييدًا. ومثالها صفحة تحمل max-snippet:50 وnosnippet معًا، فتُطبَّق nosnippet. والنتيجة المجمّعة في الأداة تتبع المنطق نفسه مع noindex وnofollow وnosnippet.

    هل أستخدم علامة meta أم عنوان X-Robots-Tag؟

    كلاهما يعمل مع صفحات HTML. أما الملفات التي لا تحتوي HTML، مثل ملفات PDF والصور، فعنوان X-Robots-Tag هو الخيار الوحيد، لأنه لا مكان فيها لعلامة meta.

    لماذا تتجاهل Google علامة noindex في صفحتي؟

    السبب الأكثر شيوعًا قاعدة Disallow في robots.txt على العنوان نفسه. تقول Google إن الصفحة الممنوعة من الزحف لا تُكتشف قواعد فهرستها فتُتجاهل. احذف Disallow ليزحف Googlebot إلى الصفحة ويقرأ noindex.

    هل ما زالت noarchive مدعومة؟

    تقول Google إن noarchive لم تعد تتحكم في ظهور الرابط المخزّن مؤقتًا، لأن الميزة أُزيلت. لا ضرر منها، لكنها لا تفعل شيئًا في بحث Google، لذلك تضع عليها الأداة تحذيرًا.

    الأدوات

    مولّد وسوم hreflang وفحصها

    أنشئ وسوم link rel=alternate hreflang لعناوين URL المترجمة، وافحص الرموز والإشارة الذاتية وx-default. أداة مجانية تعمل في متصفحك.