قابلية الفهرسة للصفحات: لماذا تتخطى محركات البحث الصفحات التي تريد تصنيفها
كيف تمنع وسوم noindex، رؤوس X-Robots-Tag، وقواعد robots.txt فهرسة الصفحات، وكيف تؤكد أن الصفحات التي تهتم بها مفتوحة.
القابلية للفهرسة هي البوابة الأولى. لا يمكن لمحركات البحث فهرسة صفحة يرفضون فهرستها، وبالتالي لا يمكن تصنيفها، أو كسب مقتطف، أو الظهور في إجابة ذكاء اصطناعي، بغض النظر عن جودة الكتابة. القواعد التي تتحكم فيها صغيرة وسهلة أن تُنقل بالخطأ: وسمة noindex في الميتا، رأس X-Robots-Tag، قاعدة robots.txt، أو canonical يشير إلى مكان آخر. معظم أضرار القابلية للفهرسة تعود إلى نشر. يُرسل بناء الاختبار مع blanket noindex intact. قاعدة CDN تضيف X-Robots-Tag: noindex عبر مسار كامل. إعداد CMS يلتفت لتمپليت واحد ويزيل 200 صفحة منتج بصمت. كل ذلك يُعيد 200 صحيحة، لذا يبقى مراقبة التوافر خضراء بينما يتراجع المرور على مدى أسابيع. تُقرأ التحققات أدناه القواعد كما يفعل الزاحف، في المكانين اللذين غالبًا ما يختلفان: الـ HTML الذي تقدمه والرؤوس المحيطة به. خريطة الموقع التي تُدرج روابط محظورة أو noindexed تطلب من محركات البحث فهرسة صفحات أمرتها في الوقت نفسه بتخطّيها؛ وهذه الفحوصات موجودة في دليل خرائط XML. اعمل من خلالها بالترتيب. تأكد أن الصفحة الرئيسية مفتوحة، تأكد أن طبقة الرأس تتفق مع الـ HTML، ثم تأكد أن الصفحات التي تهتم بها فعليًا قابلة للوصول.
الصفحة الرئيسية لا تحتوي على directive noindex
لماذا هو مهم
أمر noindex عرضي أو حجب في robots يزيل الصفحات من نتائج البحث دون أي خطأ ظاهر على الموقع.
كيف نتحقق منه
تم فحص الصفحة الرئيسية بحثًا عن توجيهات noindex في وسوم meta robots.
كيف تُصلح ذلك
احذف توجيه 'noindex' من وسم meta robots للصفحة الرئيسية أو رأس X-Robots-Tag.
رأس X-Robots-Tag noindex
كيف نتحقق منه
تم فحص الصفحة الرئيسية بحثًا عن رأس X-Robots-Tag: noindex.
كيف تُصلح ذلك
احذف أي رأس X-Robots-Tag: noindex من استجابة صفحتك الرئيسية.
الصفحات المهمة غير قابلة للفهرسة
كيف نتحقق منه
تم فحص الصفحات الرئيسية للتحقق من وجود حظر على الفهرسة.
كيف تُصلح ذلك
احذف noindex من الصفحات التي يجب أن تظهر في نتائج البحث. لماذا هذا مهم: يطلب توجيه noindex من محركات البحث استبعاد الصفحة بالكامل من فهرستها—بغض النظر عن جودة المحتوى، لا يمكن تصنيفها إذا لم تُفهرس.
الصفحة المهمة محظورة في robots.txt
لماذا هو مهم
قاعدة robots.txt التي تشمل صفحة مهمة تمنع محركات البحث من الزحف إليها، فلا يمكن للصفحة أن تحقق ترتيبًا مهما كانت جودتها.
كيف نتحقق منه
تم تقييم قواعد robots.txt مقابل الصفحات المهمة.
كيف تُصلح ذلك
احذف قواعد Disallow من robots.txt التي تمنع الصفحات المهمة.
الصفحة المهمة لا تحتوي على noindex
لماذا هو مهم
توجيه noindex يزيل صفحة مهمة من نتائج البحث رغم أنها لا تزال تُحمَّل بشكل طبيعي للزوار.
كيف نتحقق منه
تم فحص الصفحات المهمة لوجود وسوم noindex في الميتا.
كيف تُصلح ذلك
احذف وسوم meta noindex أو X-Robots-Tag من الصفحات التي يجب أن تصنف.
لم يتم اكتشاف تحقق Search Console
لماذا هو مهم
Search Console هو المكان الذي يبلغ فيه Google عن كيفية فهرسة موقعك ويحذرك عند حدوث خلل؛ وبدونه تمر إخفاقات الفهرسة دون ملاحظة لأشهر.
كيف نتحقق منه
تم فحص الصفحة الرئيسية بحثًا عن وسم google-site-verification وتم الاستعلام عن سجلات TXT في DNS للنطاق.
كيف تُصلح ذلك
تحقق من النطاق في Google Search Console؛ سجل TXT في DNS يتحقق من جميع النطاقات الفرعية دفعة واحدة. بدونه لا يمكنك رؤية كيفية فهرسة Google للموقع ولا تلقّي تنبيهات عند تعطل الفهرسة. إذا كان الموقع متحققًا عبر ملف HTML أو Analytics فيمكنك تجاهل هذا التحذير.
انظر كيف يصنف موقعك
احصل على تقرير مجاني مدعوم بالذكاء الاصطناعي SEO مع نتائج قابلة للتنفيذ وإصلاحات أولوية لموقعك.
لا حاجة للتسجيل.