فحص طول العناوين والأوصاف بالجملة
الصق صفحات كثيرة واعرف أي العناوين والأوصاف التعريفية ستُقتطع في نتائج البحث، مقيسة بالبكسل. أداة مجانية تعمل في متصفحك.
افحص كل سطر في robots.txt بحثًا عن أخطاء الصياغة والحقول غير المدعومة والمسارات الخاطئة وعناوين خريطة الموقع النسبية. مجانية وتعمل في متصفحك.
تعمل بالكامل في متصفحك. لا يُرفع ما تُدخله، ولا يُسجَّل، ولا يُحفظ.
لا يُرسل أي شيء تلصقه هنا إلى أي مكان، فالتحليل يجري سطرًا بسطر في متصفحك فقط.
الصق ملف robots.txt كاملًا، وستتحقق الأداة من سلامته: صياغة كل سطر، واسم كل حقل، وكل قيمة مسار أو عنوان URL، وهل لكل قاعدة user-agent تنتمي إليه. تعمل الأداة في متصفحك سطرًا بسطر، ولا يُرسل أي شيء تلصقه إلى أي مكان.
يعرّف RFC 9309 سطر robots.txt بأنه حقل ثم نقطتان رأسيتان ثم قيمة، مع تجميع القواعد تحت أسطر user-agent التي تسبقها. وتضيف مستندات Google التفاصيل. وتطبّق الأداة هذه الفحوص:
Dis allow: /x خطأ، فلن يُعرف الحقل.التعليقات بعد # والأسطر الفارغة صالحة دائمًا.
يعرض سطر الملخص عدد المشكلات. تأتي الأخطاء أولًا: هي أسطر سيتجاهلها برنامج الزحف، فالقاعدة التي أردتها غير موجودة فعليًا. والتحذيرات أسطر تُحلَّل لكنها لا تفعل شيئًا لـ Google، أو مشكلات في الملف كله. وإذا لم يوجد أي منهما، يقول الملخص إنه لا توجد مشكلات.
يعرض كل سطر مُنبَّه إليه رقمه، والسطر نفسه، والسبب. ولا تظهر الأسطر التي حُلّلت بلا مشكلات، لذلك فالقائمة القصيرة علامة جيدة.
يحتوي الملف المعبأ مسبقًا ثلاثة أخطاء متعمدة. وتعرض الأداة: خطآن، تحذير واحد.
Allow /admin/public بلا نقطتين رأسيتين، فهو خطأ. وبصيغته الحالية يبقى /admin/public
ممنوعًا بقاعدة Disallow التي فوقه.Crawl-delay: 10 تحذير، فمستندات Google تقول إنها لا تدعمه.Sitemap: sitemap.xml خطأ، لأنه يحتاج إلى العنوان الكامل، مثل
https://example.com/sitemap.xml.لا تنبّه الأداة إلى السطر 7، Disallow: /search، مع أن سطرًا فارغًا يفصله عن المجموعة التي فوقه.
فأسطر user-agent هي التي تحدد المجموعات لا الأسطر الفارغة، لذلك يبقى ضمن مجموعة *.
Disallow: private/، وهذا لا يتبع الصيغة التي توثّقها Google.الصياغة نصف السؤال فقط. ينتهي الملف المعبأ مسبقًا بمجموعة Googlebot بلا أي قاعدة allow أو disallow. هذه صياغة صالحة، لذلك تُنجحها الأداة.
لكنها تعني أن Googlebot يتبع مجموعة فارغة ويتجاهل كل قواعد * التي فوقها، وهذا ما يعامله RFC 9309 كسماح بكل عناوين URL. ولترى ما يسمح به الملف فعلًا لبرنامج زحف واحد ومسار واحد، استخدم أداة اختبار robots.txt.
افتح yoursite.com/robots.txt في المتصفح، وانسخ الملف كله، والصقه في الأداة. ستعرض كل سطر يخالف الصياغة أو يستخدم حقلًا لا تدعمه Google، مع رقم السطر والسبب.
لا. تدعم مستندات Google عن robots.txt الحقول user-agent وallow وdisallow وsitemap فقط، وتقول إن الحقول الأخرى مثل crawl-delay غير مدعومة. لذلك تعرض الأداة أسطر crawl-delay وhost وclean-param وrequest-rate وvisit-time وnoindex كتحذيرات.
يُتخطى. يقول RFC 9309 إن برامج الزحف يجب أن تحاول تحليل كل سطر وأن تستخدم القواعد القابلة للتحليل، وتقول Google إنها تتجاهل الأسطر غير الصالحة. ويبقى باقي الملف فعّالًا، ولهذا قد تبقى قاعدة معطوبة دون أن يلاحظها أحد لأشهر.
تفرض Google حدًا قدره 500 KiB وتتجاهل المحتوى بعده. ويلزم RFC 9309 برامج الزحف بتحليل 500 كيبيبايت على الأقل. وتنبّه الأداة عندما يزيد الملف الملصق على 500 KiB.
تعامل Google أسماء الحقول مثل Disallow على أنها غير حساسة لحالة الأحرف، لكن قيم المسارات حساسة لها. لذلك فإن Disallow /Admin لا يمنع /admin.
تتحقق هذه الأداة من سلامة صياغة كل سطر في الملف. أما أداة الاختبار فتأخذ برنامج زحف واحدًا ومسار URL واحدًا، وتخبرك هل المسار مسموح أم ممنوع، وبأي سطر.
الصق صفحات كثيرة واعرف أي العناوين والأوصاف التعريفية ستُقتطع في نتائج البحث، مقيسة بالبكسل. أداة مجانية تعمل في متصفحك.
الصق أزواج url -> canonical، وتتبّع كل قفزة، واكشف الحلقات والسلاسل متعددة القفزات بين العناوين الأساسية. مجانية وتعمل في متصفحك.
افحص عنوان الصفحة ووسم rel=canonical فيها: العنوان المطلق، وHTTPS، والإشارة الذاتية أو لصفحة أخرى، والنطاق، ومعلمات التتبّع. مجانية في متصفحك.
صنّف قيم LCP وINP وCLS إلى جيّد أو بحاجة إلى تحسين أو بطيء، واعرف إن كانت المقاييس الثلاثة تنجح معًا. مجانية وتعمل في متصفحك.