العودة إلى الأدلة

جاهزية البحث بالذكاء الاصطناعي: أن تكون قابلة للاستخدام للمساعدين وكذلك للروبوتات

GPTBot، ClaudeBot و PerplexityBot تقرأ robots.txt بشكل مستقل. كيف تُحدد سياسة روبوت واضحة وتُنشر ملف llms.txt يستحق المتابعة.

يجيب المساعدون عن الأسئلة بقراءة الصفحات مباشرة والاقتباس منها، بدلاً من إعادة قائمة روابط مرتّبة. يصلون إلى موقعك عبر روبوتات مسماة، من بينها GPTBot، ClaudeBot، PerplexityBot و Google-Extended، وكل واحد منها يقرأ robots.txt بشكل مستقل. يمكن أن يكون الموقع مفتوحًا بالكامل لـ Googlebot ومغلقًا لكل مساعد، عادةً لأن قاعدة افتراضية تم نسخها من قالب. القرار الأول هو سياسة، وهو لك: أي وكلاء يمكنهم قراءة محتواك، ولما. جعل ذلك واضحًا في robots.txt يفوق تركه للافتراضي، في أي اتجاه. تصريح واضح يسمح للمساعد أن يكون مرحبًا؛ منع واضح هو إشارة واضحة بدلاً من صمت غامض. ملف llms.txt هو الطبقة الثانية. إنه مستند Markdown قصير في جذر موقعك يذكر ما هو الموقع ويربط إلى الصفحات التي تريد أن تُستشهد بها أكثر. يكمل خرائط الموقع والبيانات المنظمة، ولا يحقق أي شيء بمفرده: الصفحات التي يربطها لا تزال يجب أن تكون قابلة للوصول، حديثة وتستحق الاقتباس. هذه التحقّقات تقرأ robots.txt من منظور المساعد، ثم تسترجع llms.txt وتتابع كل رابط داخله يشير إلى المصدر نفسه. ملف يذكر صفحات لم تعد تُحلّ تكلف مزيدًا من المصداقية من عدم وجود ملف على الإطلاق.

لا شيء من هذا يحتاج إلى فحص يدوي. كل فحص في هذه الصفحة يعمل أيضًا عند الطلب ويعيد النتائج نفسها لسياسة الزواحف وllms.txt وتحقّق المراجع بصيغة JSON، عبر واجهة API لتقارير SEO وخادم MCP.

مفقود قواعد الزاحف الذكي في robots.txt

لماذا هو مهم

تقلل قواعد الزواحف الذكية الصريحة من الغموض وتوضح أي أنظمة بحث بالذكاء الاصطناعي يمكنها استخدام محتواك العام.

كيف نتحقق منه

تم فحص robots.txt للبحث عن قواعد Allow/Disallow صريحة للروبوتات الذكاء الاصطناعي.

كيف تُصلح ذلك

حدد سياسة robots.txt صريحة للزواحف البحثية للذكاء الاصطناعي التي تنوي خدمتها، مثل OAI-SearchBot، وتأكد من أن قواعد CDN أو WAF تسمح بنفس الطلبات. يُطلب وصول OAI-SearchBot ليُعتبر محتوى الصفحة ضمن ملخصات البحث وملفات ChatGPT، لكن الوصول لا يضمن الظهور أو التموقع.

تم حظر الزواحف الذكية

لماذا هو مهم

إذا كانت زواحف الذكاء الاصطناعي محظورة، فمن غير المرجح أن يظهر محتواك في الإجابات المولدة بالذكاء الاصطناعي حتى لو كان أفضل مصدر.

كيف نتحقق منه

تم فحص robots.txt للبحث عن قواعد منع الزحف الآلي (AI crawler).

كيف تُصلح ذلك

احذف قواعد Disallow التي تمنع زواحف البحث AI من الوصول إلى المحتوى.

llms.txt مفقود

لماذا هو مهم

يمنح llms.txt وكلاء الذكاء الاصطناعي خريطة موجزة يحددها مالك الموقع لغرض الموقع وموارده المفضلة، مما يقلل الجهد اللازم لاستخراج البنية من HTML معقد. وهو يدعم اكتشاف السياق وقت الاستدلال؛ ولا يضمن الترتيب أو الإدراج في تدريب النماذج.

كيف نتحقق منه

تم فحص وجود llms.txt في موقعه المعروف (well-known).

كيف تُصلح ذلك

أنشئ ملف /llms.txt يلخص موقعك لتدريب واسترجاع LLM. لماذا هذا مهم: تستخدم منصات AI الكبرى llms.txt لفهم بنية الموقع ونطاق المحتوى؛ وجود واحد يحسّن دقة تمثيل AI لعلامتك التجارية ومنتجاتك.

تنسيق llms.txt غير صالح

لماذا هو مهم

أصبحت أدوات البحث بالذكاء الاصطناعي أكثر انتقائية فيما يمكنها قراءته والرجوع إليه.

كيف نتحقق منه

تم التحقق من llms.txt مقابل مواصفات تنسيق llmstxt.org.

كيف تُصلح ذلك

أصلح مشاكل التنسيق في ملف llms.txt. اتبع مواصفات llmstxt.org.

روابط llms.txt مكسورة

كيف نتحقق منه

تم جلب الروابط من نفس الأصل في llms.txt والتحقق منها.

كيف تُصلح ذلك

تأكد من أن جميع عناوين URL المشار إليها في llms.txt تُحل إلى صفحات صالحة على موقعك.

تم اكتشاف فجوات في الجاهزية للذكاء الاصطناعي

كيف نتحقق منه

دمج التقرير سياسة الزاحف الذكاء الاصطناعي الملاحظ، وتوافر وصلاحية llms.txt، وفحوصات روابط الموارد المفضلة دون استنتاج الترتيب أو شمول النموذج.

كيف تُصلح ذلك

عالج فجوات الجاهزية للذكاء الاصطناعي المدرجة: أضف قواعد صريحة لزواحف الذكاء الاصطناعي في robots.txt، وأنشئ ملف /llms.txt، وتأكد من أن روابط llms.txt تحل بشكل صحيح. لماذا يهم: تستخدم محركات البحث بالذكاء الاصطناعي (ChatGPT Search وPerplexity وGemini) ملفات robots.txt وllms.txt لتحديد ما يمكنها قراءته واقتباسه؛ يؤدي غياب هذه الإشارات إلى تقليل ظهورك في الإجابات المولدة بالذكاء الاصطناعي.

انظر كيف يصنف موقعك

احصل على تقرير مجاني مدعوم بالذكاء الاصطناعي SEO مع نتائج قابلة للتنفيذ وإصلاحات أولوية لموقعك.

لا حاجة للتسجيل.