فحص طول العناوين والأوصاف بالجملة
الصق صفحات كثيرة واعرف أي العناوين والأوصاف التعريفية ستُقتطع في نتائج البحث، مقيسة بالبكسل. أداة مجانية تعمل في متصفحك.
اختبر هل مسار URL ممنوع على Googlebot أو GPTBot أو أي برنامج زحف، واعرف القاعدة التي تحسم ذلك بالضبط. أداة مجانية تعمل في متصفحك.
تعمل بالكامل في متصفحك. لا يُرفع ما تُدخله، ولا يُسجَّل، ولا يُحفظ.
لا يُرسل أي شيء تلصقه هنا إلى أي مكان، فالتحليل يجري في متصفحك فقط.
نشر ملف robots.txt سهل. أما معرفة ما يفعله فعلًا ببرنامج زحف واحد على عنوان واحد فهو ما يخطئ فيه أغلب الناس، لأن القاعدة الفائزة كثيرًا ما تكون غير التي يتوقعونها. وتشغّل هذه الأداة الملف على حالة واحدة، وتعرض خطوات الحل.
تطبّق الأداة قواعد المطابقة في RFC 9309، ويتبعها توثيق Google لملف robots.txt في كل نقطة:
يقول سطر النتيجة مسموح أو ممنوع لبرنامج الزحف والمسار اللذين أدخلتهما. وتحته يشرح التتبّع السبب بالترتيب:
إذا لم تطابق أي قاعدة في المجموعة، يقول التتبّع ذلك وتكون النتيجة مسموح. والمسار الذي لا يبدأ بشرطة مائلة يُرفض قبل أي تقييم.
في الملف الجاهز مجموعة * ومجموعة Googlebot. ومع User-agent هو Googlebot والمسار /private/pricing.html، تعرض الأداة:
Allow: /private/pricing.html، هو أطول قاعدة مطابقة بـ 21 حرفًا، لذلك يحسم النتيجة.Disallow: /private/، يطابق أيضًا لكنه أقصر بـ 9 أحرف، لذلك يخسر.غيّر المسار إلى /admin وستبقى النتيجة مسموح لـ Googlebot. فمجموعة * تمنع /admin، لكن لـ Googlebot مجموعته الخاصة، وليس فيها قاعدة لـ /admin.
غيّر User-agent إلى Bingbot فيصبح المسار نفسه ممنوعًا بالسطر 3، لأن Bingbot بلا مجموعة مسمّاة فيعود إلى
*. وجرّب Bingbot مع /report.pdf، فيتغلب السطر 6، Disallow: /*.pdf$، على Allow: / ذات الحرف الواحد.
Disallow: /*.pdf$ تمنع /report.pdf لكنها لا تمنع
/report.pdf?download=1، وتعرض الأداة الفرق مباشرة.تذكّر أن robots.txt طلب يختار برنامج الزحف الملتزم احترامه. ويقول RFC 9309 إنه ليس وسيلة لتفويض الوصول، وإن إدراج مسار في الملف يجعله علنيًا. فنتيجة ممنوع تصف ما يقوله الملف، لا ما سيفعله كل برنامج زحف.
الصق ملف robots.txt للموقع في الأداة، وأدخِل رمز User-agent لبرنامج الزحف ومسار URL الذي يبدأ بشرطة مائلة. تقول النتيجة مسموح أو ممنوع، ويسمّي التتبّع المجموعة التي انطبقت والسطر الذي حسم النتيجة.
لأن برنامج الزحف يتبع المجموعة الأكثر تحديدًا التي تطابقه فقط. فإذا كان في الملف مجموعة Googlebot، يستخدمها Googlebot ولا يستخدم أي قاعدة من مجموعة *، لذلك كرّر في مجموعته كل قاعدة تريده أن يلتزم بها.
صاحبة المسار الأطول، أيًا كان ترتيبها في الملف. ويسميها RFC 9309 المطابقة ذات أكبر عدد من الثُمانيات. وإذا تساوى الطول تُستخدم Allow، وتوثّق Google قاعدة الحسم نفسها لصالح الأقل تقييدًا.
ليس بالضرورة. يوقف robots.txt الزحف لا الفهرسة. ويقول توثيق Google لعلامة robots meta إن الصفحة الممنوعة في robots.txt لن يُعثر على noindex فيها. ولإبقاء صفحة خارج الفهرس، اسمح بالزحف إليها واستخدم noindex.
تفحص أداة التحقق الملف كله بحثًا عن أخطاء الصياغة والحقول غير المدعومة والقواعد في غير موضعها. أما هذه الأداة فتفترض أن الملف سليم، وتجيب عن حالة واحدة في كل مرة، لبرنامج زحف واحد ومسار واحد.
تقول Google إنها تخزّن محتوى ملف robots.txt مؤقتًا لمدة تصل إلى 24 ساعة عادةً، لذلك قد يستغرق تطبيق التغيير يومًا.
الصق صفحات كثيرة واعرف أي العناوين والأوصاف التعريفية ستُقتطع في نتائج البحث، مقيسة بالبكسل. أداة مجانية تعمل في متصفحك.
الصق أزواج url -> canonical، وتتبّع كل قفزة، واكشف الحلقات والسلاسل متعددة القفزات بين العناوين الأساسية. مجانية وتعمل في متصفحك.
افحص عنوان الصفحة ووسم rel=canonical فيها: العنوان المطلق، وHTTPS، والإشارة الذاتية أو لصفحة أخرى، والنطاق، ومعلمات التتبّع. مجانية في متصفحك.
صنّف قيم LCP وINP وCLS إلى جيّد أو بحاجة إلى تحسين أو بطيء، واعرف إن كانت المقاييس الثلاثة تنجح معًا. مجانية وتعمل في متصفحك.