Back to articles

76% من المواقع التي تحتوي على ملف llms.txt تُخطئ في ذلك

SEOReport Team·
llms-txtai-seoai-searchai-readinesstechnical-seodata-analysis

قمنا بتدقيق 142 مواقع بين مايو ويوليو 2026. لم يكن لدى 56% ملف llms.txt على الإطلاق، و48 من 63 التي نشرت واحداً فشلت في الصلاحية. إليكم 3 الأخطاء التي تُعزى إلى ما يقرب من كل فشل.

من بين 142 موقعاً قمنا بتدقيقهم بين 4 مايو و19 يوليو 2026، كان لدى 79 منهم لا يوجد ملف llms.txt على الإطلاق. من بين 63 التي نشرت واحداً، نشر 48 واحداً معطلاً. هذا يترك 13 مواقع — 9% من العينة — مع ملف صالح. مقترح llms.txt بسيط: ضع ملف markdown في جذر نطاقك يقدّم لوكلاء الذكاء الاصطناعي خريطة مُعَدَّة، نصية، لملفك. عندما يطرح شخص سؤالاً على ChatGPT، Claude، أو Perplexity حول سؤال يمكن لموقعك الإجابة عليه، يقوم وكيل يجلب ملف llms.txt عند وقت الاستدلال بالحصول على السياق الذي اخترته بالضبط — بدلاً من محاولة استخراج أفضل من صفحتك الرئيسية HTML. يُعدّ المواصفة عمداً بسيطة: H1 باسم موقعك، ملخص في blockquote، وقوائم markdown للروابط إلى أهم محتوياتك. بعد عام من التبني، لم يعد الفجوة مجرد وعي. إنها تنفيذ.

مجموعة البيانات

مواقع مع بيانات تدقيق لكل فحص142
مواقع بدون ملف llms.txt79 (55.6%)
مواقع مع ملف موجود63 (44.4%)
الملفات التي فشلت في الصلاحية48 (76.2% من الموجودة)
الملفات الصالحة13 (20.6% من الموجودة)

المنهجية: أحدث لقطة تدقيق مكتملة لكل نطاق، مأخوذة من فحوصات الإنتاج بين مايو 4 وJuly 19, 2026. جميع المجالات مجهولة. العينة مختارة ذاتيًا — المواقع التي قام مالكوها بإجراء تدقيق — وتميل نحو العقارات الصغيرة والمتوسطة الحجم، لذا اعتبرها توجيهية أكثر من كونها تعدادًا للويب.

llms.txt Outcomes Across 142 Audited Websites

الأخطاء 3 وراء كل ملف غير صالح تقريبًا

يتحقق محركنا من llms.txt مقابل بنية المواصفة، وأدلة الفشل متسقة بشكل ملحوظ. الأخطاء 3 تشكل تقريبًا كل شيء — معظم الملفات المكسورة تحتوي على 2 أو 3 منها مرة واحدة:

  1. لا توجد روابط مرجعية (40 من 48 ملفات غير صالحة). الملف موجود، لكنه لا يحتوي على روابط ماركداون. هذا هو الهدف الكامل للتنسيق — قائمة مختارة من عناوين URL يجب على الوكيل قراءتها. ملف بدون روابط هو ملصق بدون خريطة.
  2. غياب اقتباس الملخص (38 من 48). تنص المواصفة على وجود اقتباس > Summary مباشرة بعد العنوان يوضح للوكيل ما هو الموقع وكيف يفسر الروابط. بدون ذلك، يحصل الوكيل على قائمة عناوين URL بدون إطار لاختيار بينها.
  3. غياب عنوان H1 (33 من 48). القسم الوحيد الذي تحدده المواصفة على أنه مطلوب صارم. الملفات التي تفتح مع نص سردي، أو تعليق، أو H2 لا تعطي المحللات ما يمكنهم ترسيخه.

النمط أسفل كل 3 هو نفسه: الفرق تقوم بإنشاء عنصر نائب — أحيانًا حرفيًا كلمة "llms.txt" مكررة، أو فقرة من نص تسويقي — وتستخدمه كخانة اختيار. يتعلم الوكيل الذي يقرأ مثل هذا الملف لا شيء ويتقدم. تم إهدار الجلب.

عندما تكون الروابط نفسها ميتة

الصلاحية هي البنية. الفحص التالي هو ما إذا كانت عناوين URL المرجعية تحل فعليًا. معظم المواقع ذات البنية الصحيحة تمر بهذا أيضًا، لكن الفشل مفيد: 7 المواقع التي أدرجت روابط عادت بأخطاء، بمتوسط 19 مراجع ميتة لكل موقع. أدرجت إحدى العقارات الإلكترونية 3,042 عنوان URL للمنتجات في llms.txt الخاص بها لم تعد تحل — كان الملف واضحًا أنه تم إنشاؤه مرة واحدة من تغذية منتجات ولم يُعاد إنشاؤه أبدًا. هذه الحكاية هي عينة من 7، لذا اعتبرها تحذيرًا أكثر من إحصائية. لكن الآلية تستحق التذكر: llms.txt هو وثيقة حية. إذا تحرك كتالوجك أو وثائقك أو صفحات التسعير، يتعفن الملف — وقد يخلص الوكيل المتبع للروابط الميتة إلى أن محتواك قد اختفى، وليس أنه تحرك.

كيف يبدو ملف صالح

المثال الخاص بالمواصفة هو أفضل قالب. ملف llms.txt أدنى وأصلي يحتاج إلى H1، وكتلة اقتباس ملخّص، وقائمة واحدة على الأقل من الروابط المعلّقة:

markdown
# Acme Analytics
> Acme Analytics is a reporting API for ecommerce teams. This file lists our most useful resources for AI agents.
## Docs
- [API quickstart](https://acme.example/docs/quickstart): Authentication and first request in 5 minutes
- [Metrics reference](https://acme.example/docs/metrics): Every metric, its definition, and its SQL
## Product
- [Pricing](https://acme.example/pricing): Plans and usage limits
- [Changelog](https://acme.example/changelog): Release notes since 2024
## Optional
- [Full documentation index](https://acme.example/docs): Everything else, for larger context windows

القسم Optional له معنى محدد: قد يتخطى الوكلاء الذين يفتقرون إلى السياق ذلك. ضع أفضل موادك أعلاه.

graph TD A[يلتقط الوكيل /llms.txt] --> B{ملف موجود?} B -->|404 أو خطأ| C[يعود الوكيل إلى الزحف HTML] B -->|200| D{بنية صالحة?} D -->|لا H1، ملخّص، أو روابط| E[الاسترجاع مضيعة — لا سياق قابل للاستخدام] D -->|صالح| F{المراجع تُحلّق?} F -->|روابط ميتة| G[يخلص الوكيل إلى أن المحتوى قد اختفى] F -->|روابط حية| H[يقرأ الوكيل صفحاتك المُختارة]

لماذا يستحق هذا 30 دقائق

تخبر خريطة الموقع محركات البحث بما هو موجود. robots.txt يخبر الزواحف ما هو مسموح به. llms.txt هو الملف الوحيد الذي يخبر وكيل الذكاء الاصطناعي ما يهم — مكتوب بالتنسيق الذي يقرأه بطبيعته، في اللحظة التي يقرر فيها ما إذا كان موقعك يساعد في إجابة سؤال المستخدم. إنه أيضًا واحد من القليل من أدوات البحث بالذكاء الاصطناعي التي تتحكم فيها بالكامل: لا مزود نموذج، لا خوارزمية تصنيف، لا انتظار للزحف. تسلسل الإصلاح قصير. اكتب الملف من القالب أعلاه — 10 دقائق. اربط فقط بالصفحات التي تُحلّق، وفضّل عناوين URL ثابتة. أعد توليد أو مراجعة ذلك كلما تغيرت بنية معلوماتك. ثم تحقق منه بالطريقة التي يفعلها وكيل: احصل عليه، قم بتحليله، اتبع الروابط. كل تدقيق نقوم به يفحص جميع طبقات 3 — الحضور، الصلاحية، وما إذا كانت المراجع تُحل — كجزء من عائلة جاهزية الذكاء الاصطناعي. إذا كنت تريد معرفة أي من مجموعات الـ 3 تنتمي إليها موقعك، يمكنك تشغيل تقريرك الخاص وإيجاد فحوصات llms.txt في قسم جاهزية الذكاء الاصطناعي.

النقطة الأساسية

التبني هو الفجوة الأولى: 56% من المواقع المدققة لا توجد لها ملف. لكن الاكتشاف الأكثر حدة هو أن نشر ملف ليس خط النهاية — 3 في 4 من المواقع التي نشرت واحدة لا يمكن للوكيل استخدامها. المواقع في الأقلية الصحيحة لم تفعل شيئاً غريباً. كتبوا H1، ملخصاً جملة 2، وقائمة روابط تعمل. هذا هو الشريط بأكمله — و91% من العينة تحت ذلك.

انظر كيف يصنف موقعك

احصل على تقرير مجاني مدعوم بالذكاء الاصطناعي SEO مع نتائج قابلة للتنفيذ وإصلاحات أولوية لموقعك.

لا حاجة للتسجيل.