تخطي إلى المحتوى الرئيسي
ROBOTS.TXTمجاني · بدون تسجيل

مولّد قواعد robots.txt لزواحف AI

هذه الزواحف الـ20 التي يتعرّف عليها فحصنا. قرّر لكل زاحف هل يصل إلى محتواك — وكتلة robots.txt تتحدّث مباشرة.

GPTBotOpenAI
تدريب نماذج OpenAI
ChatGPT-UserOpenAI
تصفح ChatGPT المباشر عند سؤال المستخدم
ClaudeBotAnthropic
تدريب نماذج Anthropic
Claude-SearchBotAnthropic
زاحف بحث Claude — يفهرس الصفحات لتظهر في نتائج البحث
Claude-UserAnthropic
جلب مباشر عند سؤال المستخدم في Claude
Claude-WebAnthropic
اسم قديم من Anthropic لم تعد تذكره
anthropic-aiAnthropic
زاحف Anthropic القديم
PerplexityBotPerplexity
فهرسة Perplexity للإجابات المستشهدة
Google-ExtendedGoogle
تدريب Gemini والاعتماد على صفحاتك في إجابات تطبيقات Gemini (لا يؤثر على بحث Google)
BytespiderByteDance
زاحف ByteDance/TikTok
CCBotCommon Crawl
أرشيف Common Crawl (تستخدمه نماذج كثيرة للتدريب)
AmazonbotAmazon
زاحف Alexa/Amazon
FacebookBotMeta
زاحف Meta لنماذج الذكاء الاصطناعي
Applebot-ExtendedApple
تدريب نماذج Apple
DiffbotDiffbot
استخراج البيانات المهيكلة
cohere-aiCohere
تدريب نماذج Cohere
OAI-SearchBotOpenAI
زاحف بحث ChatGPT — يجلب الصفحات للاستشهاد بها في الإجابات
Perplexity-UserPerplexity
جلب مباشر عند سؤال المستخدم في Perplexity
DuckAssistBotDuckDuckGo
توليد إجابات DuckAssist
meta-externalagentMeta
تدريب نماذج Meta وفهرسة المحتوى لمنتجاتها

كتلة robots.txt الخاصة بك

# AI crawler access rules
# AI guidance file: /llms.txt
# Allowed crawlers need no section of their own: they follow your User-agent: * rules.
# A section with only Allow: / would make that crawler ignore those rules (RFC 9309).

ادمجها في ملف robots.txt الحالي في جذر الموقع. الزواحف المسموح لها لا تحتاج قسماً خاصاً بها: تتبع قواعد User-agent: * عندك، وإن أضفت لها قسماً باسمها فيه Allow: / وحده فستتجاهل تلك القواعد. وإن كان في ملفك قسم آخر لزاحف تحظره هنا فاحذفه، لأن Allow: / فيه يغلب هذا المنع.