بهینهسازی فایل robots.txt، در دنیای پیچیده و پویای بهینهسازی موتورهای جستجو (SEO)، عوامل متعددی دست به دست هم میدهند تا وبسایت شما در نتایج جستجو دیده شود. یکی از این عوامل کلیدی، نحوه تعامل موتورهای جستجو با محتوای سایت شماست. خزندهها (Crawlers) یا رباتهای موتورهای جستجو (مانند Googlebot، Bingbot و غیره) به طور مداوم در حال پیمایش وب هستند تا صفحات جدید را کشف، محتوای آنها را تحلیل و اطلاعات لازم را برای ساخت فهرست (Index) خود جمعآوری کنند.
اما آیا میخواهید همه صفحات سایت شما توسط این خزندهها پیمایش و فهرست شوند؟ پاسخ اغلب “خیر” است. صفحاتی مانند صفحات ورود به سیستم، پنلهای مدیریت، نتایج جستجوی داخلی سایت، نسخههای آزمایشی (staging) یا محتوای تکراری، معمولاً نیازی به حضور در فهرست موتورهای جستجو ندارند و حتی ممکن است حضور آنها مضر باشد. اینجاست که فایل robots.txt وارد عمل میشود.
در این مقاله جامع، به طور عمیق به بررسی فایل robots.txt، نحوه عملکرد آن، دستورالعملهای اصلی و پیشرفته، بهترین شیوهها برای بهینهسازی، اشتباهات رایج و نحوه تست این فایل خواهیم پرداخت. هدف این است که شما بتوانید با درک کامل این ابزار قدرتمند، کنترل بیشتری بر نحوه تعامل موتورهای جستجو با وبسایت خود داشته باشید و در نتیجه، عملکرد سئوی سایت خود را بهبود بخشید.
فایل robots.txt چیست و چرا اهمیت دارد؟
فایل robots.txt یک فایل متنی ساده است که در ریشه دامنه وبسایت شما قرار میگیرد و به عنوان اولین نقطه تماس خزندههای موتورهای جستجو با سایت شما عمل میکند. این فایل دستورالعملهایی را برای خزندهها مشخص میکند که کدام بخشها یا فایلهای سایت را میتوانند پیمایش کنند و کدام بخشها را نباید پیمایش کنند. به عبارت دیگر، robots.txt یک راهنما برای رباتهاست، نه یک مکانیسم امنیتی.
بهینهسازی صحیح فایل robots.txt نه تنها به مدیریت بهتر نحوه تعامل خزندهها با سایت شما کمک میکند، بلکه میتواند تأثیر مستقیمی بر سئو سایت شما داشته باشد. یک فایل robots.txt بهینه میتواند به بهبود “بودجه خزش” (Crawl Budget) کمک کند، از فهرست شدن محتوای غیرضروری یا تکراری جلوگیری کند و حتی به طور غیرمستقیم بر سرعت بارگذاری سایت تأثیر بگذارد.
تعریف و مکان فایل robots.txt
فایل robots.txt یک فایل متنی ساده (plain text) است که از پروتکل Robots Exclusion Standard (یا Robots Exclusion Protocol) پیروی میکند. این پروتکل مجموعهای از دستورالعملها را تعریف میکند که به وبسایتها اجازه میدهد به خزندههای وب اعلام کنند که کدام بخشهای سایت را نباید پیمایش کنند.
مکان این فایل بسیار مهم است: باید در ریشه اصلی (root directory) وبسایت شما قرار گیرد. به عنوان مثال، اگر آدرس وبسایت شما https://www.example.com باشد، فایل robots.txt باید در آدرس https://www.example.com/robots.txt قابل دسترسی باشد. خزندههای موتورهای جستجو قبل از شروع به پیمایش هر صفحهای در سایت شما، ابتدا به دنبال این فایل در این آدرس مشخص میگردند. اگر فایل را پیدا کنند، دستورالعملهای آن را میخوانند و سعی میکنند از آنها پیروی کنند. اگر فایل پیدا نشود (مثلاً خطای ۴۰۴ برگرداند)، خزنده معمولاً فرض میکند که محدودیتی برای پیمایش وجود ندارد و تمام بخشهای سایت را پیمایش خواهد کرد (مگر اینکه توسط روشهای دیگری مانند متا تگهای robots محدود شده باشد).

هدف اصلی: راهنمایی خزندهها
هدف اصلی robots.txt این است که به خزندههای وب بگوید به کدام بخشهای سایت شما سر نزنند. این پروتکل بر اساس “همکاری” است؛ یعنی فرض بر این است که خزندهها از این دستورالعملها پیروی میکنند. خزندههای اصلی موتورهای جستجو (مانند Googlebot، Bingbot، DuckDuckBot و غیره) معمولاً به این دستورالعملها احترام میگذارند، اما خزندههای مخرب یا اسپم ممکن است آنها را نادیده بگیرند. بنابراین، robots.txt یک مکانیسم امنیتی نیست و نباید برای محافظت از اطلاعات حساس یا محرمانه استفاده شود.
اهمیت robots.txt در سئو
بهینهسازی فایل robots.txt برای سئو به چند دلیل اهمیت دارد:
- مدیریت بودجه خزش (Crawl Budget Management): موتورهای جستجو برای هر وبسایت، به خصوص سایتهای بزرگ، یک “بودجه خزش” اختصاص میدهند. این بودجه تعیین میکند که خزنده موتور جستجو در یک بازه زمانی مشخص (مثلاً ۲۴ ساعت) چه تعداد صفحه از سایت شما را پیمایش کند. اگر خزندهها وقت خود را صرف پیمایش صفحاتی کنند که نیازی به فهرست شدن ندارند (مانند صفحات لاگین، پارامترهای URL بینهایت، نتایج جستجوی داخلی)، بودجه خزش شما هدر میرود و ممکن است صفحات مهم و جدید سایت شما دیرتر یا کمتر پیمایش و فهرست شوند. با استفاده صحیح از
Disallowدرrobots.txt، میتوانید خزندهها را از پیمایش صفحات غیرضروری منع کرده و بودجه خزش را به سمت صفحات مهم هدایت کنید. - جلوگیری از فهرست شدن محتوای غیرضروری یا تکراری: صفحاتی مانند پنلهای مدیریت، صفحات سبد خرید، یا فیلترهای جستجو که URLهای متعددی با محتوای مشابه ایجاد میکنند، نباید در نتایج جستجو ظاهر شوند. فهرست شدن این صفحات میتواند تجربه کاربری را برای جستجوکنندگان کاهش دهد و همچنین باعث مشکل “محتوای تکراری” (Duplicate Content) شود که میتواند به رتبه سایت شما آسیب بزند.
robots.txtبا جلوگیری از پیمایش این صفحات، به موتورهای جستجو کمک میکند تا آنها را فهرست نکنند. - کاهش بار سرور (غیرمستقیم): هر بار که یک خزنده صفحهای از سایت شما را درخواست میکند، سرور شما باید به آن پاسخ دهد. اگر تعداد زیادی خزنده به طور همزمان یا مکرر صفحات بیاهمیت را درخواست کنند، میتواند بار غیرضروری بر سرور شما تحمیل کند. با مسدود کردن پیمایش بخشهای غیرضروری، میتوانید تعداد درخواستها به سرور را کاهش دهید.
- کنترل دسترسی خزندههای مختلف: میتوانید دستورالعملهای متفاوتی برای خزندههای مختلف (مانند Googlebot، Bingbot) تعیین کنید، اگرچه معمولاً نیازی به این کار نیست و دستورالعملهای عمومی برای همه خزندهها (
User-agent: *) کافی است.

ساختار و دستورالعملهای اصلی فایل robots.txt
فایل robots.txt از مجموعهای از “بلاکها” تشکیل شده است که هر بلاک با دستور User-agent شروع میشود و دستورالعملهای مربوط به آن خزنده خاص را در بر میگیرد.
دستور User-agent
این دستور مشخص میکند که دستورالعملهای بعدی برای کدام خزنده موتور جستجو اعمال میشود.
User-agent: *: این دستورالعملها برای همه خزندههای وب اعمال میشود که نام خاصی برای آنها مشخص نشده است. این رایجترین و معمولاً تنهاUser-agentمورد نیاز در فایلrobots.txtاست.User-agent: Googlebot: دستورالعملهای بعدی فقط برای خزنده اصلی گوگل (Googlebot) اعمال میشود.User-agent: Bingbot: دستورالعملهای بعدی فقط برای خزنده بینگ (Bingbot) اعمال میشود.- میتوانید چندین بلاک
User-agentداشته باشید. اگر یک خزنده خاص (مانند Googlebot) یک بلاک اختصاصی داشته باشد، از دستورالعملهای آن بلاک پیروی میکند و دستورالعملهای بلاکUser-agent: *را نادیده میگیرد. اگر بلاک اختصاصی نداشته باشد، از دستورالعملهای بلاکUser-agent: *پیروی میکند.

دستور Disallow
این دستور به خزنده مشخص شده در User-agent میگوید که نباید مسیر (path) مشخص شده را پیمایش کند.
Disallow: /: این دستورالعمل به خزنده میگوید که نباید هیچ صفحهای از سایت را پیمایش کند. این برای مسدود کردن کامل دسترسی خزندهها به سایت استفاده میشود (مثلاً در حین توسعه).Disallow: /private/: به خزنده میگوید که نباید هیچ فایلی یا زیرپوشهای در مسیر/private/را پیمایش کند.Disallow: /images/: به خزنده میگوید که نباید هیچ فایلی در مسیر/images/را پیمایش کند.Disallow: /page.html: به خزنده میگوید که نباید فقط فایل/page.htmlرا پیمایش کند.Disallow: /?: این دستورالعمل میتواند برای مسدود کردن URLهایی که شامل پارامترهای کوئری (query parameters) هستند استفاده شود، اما استفاده از کاراکترهای وایلدکارد (*) معمولاً دقیقتر است.

دستور Allow
این دستور برای ایجاد استثنا در یک دستور Disallow استفاده میشود. این دستورالعمل به خزنده میگوید که میتواند مسیر مشخص شده را پیمایش کند، حتی اگر توسط یک دستور Disallow گستردهتر مسدود شده باشد. دستور Allow معمولاً اولویت بالاتری نسبت به Disallow دارد، به خصوص در گوگل.
- مثال: فرض کنید میخواهید تمام محتوای پوشه
/private/را مسدود کنید، اما یک فایل خاص در آن پوشه (/private/public-page.html) باید قابل پیمایش باشد.typescript
CopyUser-agent: *
Disallow: /private/
Allow: /private/public-page.html
در این مثال، خزنده تمام محتوای
/private/را نادیده میگیرد، به جز/private/public-page.htmlکه اجازه پیمایش آن را دارد. - مثال دیگر: فرض کنید میخواهید تمام فایلهای با پسوند
.pdfرا مسدود کنید، اما یک فایل PDF خاص باید قابل پیمایش باشد.makefile
CopyUser-agent: *
Disallow: /*.pdf$
Allow: /public/report.pdf
(استفاده از
*و$در بخش بعدی توضیح داده میشود).
چگونه محتوای سئو فرندلی بنویسیم ؟
دستور Sitemap
این دستور به موتورهای جستجو میگوید که فایلهای نقشهسایت XML (XML Sitemaps) شما در کجا قرار دارند. این کار به خزندهها کمک میکند تا صفحات مهم سایت شما را راحتتر پیدا کنند، به خصوص صفحات جدید یا صفحاتی که لینک داخلی کمی دارند.
Sitemap: https://www.example.com/sitemap.xml- میتوانید چندین خط
Sitemapداشته باشید اگر چندین نقشه سایت دارید. - دستور
Sitemapمستقل از بلاکهایUser-agentعمل میکند و معمولاً در ابتدای یا انتهای فایلrobots.txtقرار داده میشود.
۲.۵. کاراکترهای وایلدکارد ( و $)*
برای ایجاد قوانین انعطافپذیرتر در دستورات Disallow و Allow، میتوانید از کاراکترهای وایلدکارد استفاده کنید:
*: با هر دنبالهای از کاراکترها مطابقت دارد.Disallow: /private/*/: مسدود کردن تمام زیرپوشهها در/private/.Disallow: /*?: مسدود کردن تمام URLهایی که شامل علامت سوال (?) هستند (معمولاً برای مسدود کردن پارامترهای URL استفاده میشود).Disallow: /*.pdf: مسدود کردن تمام URLهایی که به.pdfختم میشوند.
$: با انتهای URL مطابقت دارد.Disallow: /*.pdf$: مسدود کردن فقط URLهایی که دقیقاً به.pdfختم میشوند (نه URLهایی که.pdfدر میانه آنهاست).Allow: /folder/*.html$: اجازه پیمایش فقط فایلهای HTML در پوشه/folder/.

دستورالعملهای پیشرفته و ملاحظات خاص
برخی دستورالعملها یا ملاحظات دیگر نیز وجود دارند که ممکن است در بهینهسازی robots.txt مطرح شوند، اما استفاده از آنها کمتر رایج است یا نیاز به دقت بیشتری دارد.
دستور Crawl-delay (محدودیت خزش)
این دستور به خزنده میگوید که قبل از درخواست صفحه بعدی، چند ثانیه صبر کند. هدف از این دستور کاهش بار بر سرور است.
Crawl-delay: 10: از خزنده میخواهد ۱۰ ثانیه بین هر درخواست صبر کند.
ملاحظه مهم: گوگل به طور رسمی اعلام کرده است که دستور Crawl-delay را در robots.txt نادیده میگیرد. برای کنترل سرعت خزش Googlebot، باید از طریق تنظیمات در Google Search Console اقدام کنید. با این حال، برخی دیگر از خزندههای موتورهای جستجو ممکن است همچنان به این دستورالعمل احترام بگذارند. استفاده از این دستورالعمل باید با احتیاط انجام شود، زیرا تنظیم تأخیر بیش از حد میتواند باعث شود خزندهها نتوانند تمام صفحات مهم سایت شما را در زمان مناسب پیمایش کنند.

Noindex در robots.txt (منسوخ شده!)
نکته بسیار مهم: در گذشته، گوگل از دستور Noindex در فایل robots.txt پشتیبانی میکرد، اما این دستورالعمل اکنون منسوخ شده و توسط گوگل نادیده گرفته میشود. استفاده از Noindex در robots.txt هیچ تأثیری بر فهرست شدن صفحات توسط گوگل ندارد.
اگر میخواهید صفحهای را از فهرست موتورهای جستجو خارج کنید، باید از روشهای صحیح استفاده کنید:
- متا تگ robots: اضافه کردن
<meta name="robots" content="noindex, follow">یا<meta name="robots" content="noindex, nofollow">در بخش<head>صفحه HTML. این روش به خزنده میگوید که صفحه را فهرست نکند. - هدر HTTP X-Robots-Tag: استفاده از هدر
X-Robots-Tag: noindexدر پاسخ HTTP سرور برای منابع غیر HTML (مانند فایلهای PDF یا تصاویر) یا برای کنترل فهرست شدن صفحات به صورت برنامهنویسی.
هرگز برای جلوگیری از فهرست شدن صفحات به دستور Noindex در robots.txt تکیه نکنید.
دستور Host (منسوخ شده توسط گوگل)
دستور Host زمانی برای مشخص کردن دامنه ترجیحی (Preferred Domain) استفاده میشد (مثلاً www.example.com یا example.com). اما گوگل این دستورالعمل را نیز منسوخ کرده است. برای مشخص کردن دامنه ترجیحی، باید از تنظیمات در Google Search Console و استفاده صحیح از ریدایرکتهای ۳۰۱ استفاده کنید.
نظرات (Comments)
میتوانید از علامت # برای افزودن نظرات در فایل robots.txt استفاده کنید. هر چیزی بعد از # در یک خط توسط خزندهها نادیده گرفته میشود. استفاده از نظرات برای توضیح هدف هر بلاک Disallow یا Allow میتواند فایل شما را خواناتر کند.
yaml
User-agent: *
Disallow: /admin/ # Block access to admin panel
Disallow: /wp-admin/ # Block WordPress admin
Allow: /wp-admin/admin-ajax.php # Allow specific file needed by theme/plugin

بهترین شیوهها برای بهینهسازی فایل robots.txt
برای اطمینان از اینکه فایل robots.txt شما به طور مؤثر عمل میکند و به سئوی سایت شما آسیب نمیزند، از بهترین شیوههای زیر پیروی کنید:
فایل را در مکان صحیح قرار دهید: مطمئن شوید که فایل دقیقاً در ریشه دامنه و با نام robots.txt قرار دارد و از طریق
https://www.yourdomain.com/robots.txt قابل دسترسی است.
- از فرمت متنی ساده استفاده کنید: فایل باید یک فایل متنی ساده باشد و از فرمتهای دیگر مانند HTML یا Word استفاده نکنید. از ویرایشگرهای متنی ساده مانند Notepad (ویندوز) یا TextEdit (مک) استفاده کنید.
- هر بلاک User-agent را با یک خط User-agent شروع کنید: هر مجموعه دستورالعمل برای یک خزنده خاص باید با خط
User-agent:آغاز شود. - هر دستورالعمل را در یک خط جداگانه بنویسید: هر
Disallow،AllowیاSitemapباید در خط خودش باشد. - از
User-agent: *به عنوان پیشفرض استفاده کنید: مگر اینکه نیاز خاصی برای کنترل خزندههای متفاوت داشته باشید، استفاده از یک بلاکUser-agent: *برای همه خزندهها کافی است. - فقط بخشهایی را مسدود کنید که واقعاً نیازی به پیمایش آنها ندارید: مسدود کردن بیش از حد میتواند به سئوی سایت شما آسیب بزند. فقط صفحاتی را مسدود کنید که میدانید نباید در نتایج جستجو ظاهر شوند (مانند صفحات مدیریت، نتایج جستجوی داخلی، URLهای با پارامترهای زیاد، صفحات لاگین/ثبتنام).
CSS، JavaScript و فایلهای تصویری مهم برای رندرینگ را مسدود نکنید
موتورهای جستجو، به خصوص گوگل، برای درک و رندر کردن صحیح صفحات وب به این منابع نیاز دارند. مسدود کردن آنها میتواند باعث شود گوگل نتواند صفحه شما را به درستی ببیند و در نتیجه رتبه آن کاهش یابد. مطمئن شوید که مسیرهای مربوط به فایلهای CSS، JS و تصاویر مورد نیاز برای نمایش صفحه مسدود نشدهاند.
- از
Allowبرای ایجاد استثنا استفاده کنید: اگر بخش بزرگی را باDisallowمسدود کردهاید اما چند صفحه در آن بخش باید قابل دسترسی باشند، از دستورAllowاستفاده کنید. دستورAllowبا مسیر طولانیتر معمولاً برDisallowبا مسیر کوتاهتر اولویت دارد. - مکان فایلهای نقشهسایت (Sitemap) را مشخص کنید: با استفاده از دستور
Sitemap، به موتورهای جستجو در کشف صفحات مهم سایتتان کمک کنید. - فایل را مختصر و خوانا نگه دارید: از دستورالعملهای تکراری یا غیرضروری پرهیز کنید. از نظرات برای توضیح بخشهای پیچیده استفاده کنید.
- به حروف کوچک و بزرگ حساس باشید: مسیرها در
robots.txtبه حروف کوچک و بزرگ حساس هستند. مطمئن شوید که مسیرهای مسدود شده دقیقاً با URLهای سایت شما مطابقت دارند. - فایل را تست کنید: قبل و بعد از اعمال تغییرات، فایل
robots.txtخود را تست کنید تا مطمئن شوید که دستورالعملها به درستی عمل میکنند. ابزارهای تست در بخش بعدی توضیح داده خواهند شد. - به طور منظم فایل را مرور و بهروزرسانی کنید: با اضافه شدن بخشهای جدید به سایت یا حذف بخشهای قدیمی، فایل
robots.txtشما نیز ممکن است نیاز به بهروزرسانی داشته باشد.

اشتباهات رایج در استفاده از فایل robots.txt و نحوه اجتناب از آنها
اشتباه در پیکربندی فایل robots.txt میتواند عواقب جدی برای سئوی سایت شما داشته باشد. در اینجا برخی از رایجترین اشتباهات آورده شده است:
- مسدود کردن منابع حیاتی (CSS، JS، تصاویر): همانطور که قبلاً ذکر شد، این یکی از بزرگترین اشتباهات است. گوگل برای رندر کردن صفحه و درک محتوای آن به این فایلها نیاز دارد. مسدود کردن آنها باعث میشود گوگل سایت شما را “کور” ببیند.
- مسدود کردن صفحاتی که میخواهید فهرست شوند: به اشتباه صفحاتی را که برای کسب و کار شما مهم هستند و میخواهید در نتایج جستجو ظاهر شوند، مسدود کردن. همیشه قبل از استفاده از
Disallowمطمئن شوید که آن صفحه نباید در نتایج جستجو باشد. - استفاده از robots.txt برای پنهان کردن اطلاعات حساس:
robots.txtیک فایل عمومی است و هر کسی میتواند آن را بخواند. هرگز اطلاعات محرمانه، مسیرهای حساس یا فایلهایی که نباید عمومی باشند را در این فایل مسدود نکنید و فکر کنید که امن هستند. برای محافظت از اطلاعات حساس باید از روشهای امنیتی واقعی مانند احراز هویت (Authentication) یا محدودیت دسترسی سرور استفاده کنید. - خطاهای نحوی (Syntax Errors): یک غلط املایی ساده یا فرمتبندی نادرست میتواند باعث شود کل فایل
robots.txtتوسط خزندهها نادیده گرفته شود یا به اشتباه تفسیر شود. همیشه از ابزارهای تست استفاده کنید. - قرار دادن فایل در مکان اشتباه یا نامگذاری نادرست: فایل باید دقیقاً
/robots.txtنام داشته باشد و در ریشه دامنه قرار گیرد. - استفاده از دستور
Noindexدر robots.txt: این دستور توسط گوگل نادیده گرفته میشود و برای جلوگیری از فهرست شدن باید از متا تگ robots یا هدر X-Robots-Tag استفاده کنید. - عدم تست فایل پس از تغییرات: همیشه بعد از اعمال هرگونه تغییر در فایل
robots.txt، آن را با ابزارهای تست بررسی کنید. - مسدود کردن دسترسی به فایلهای نقشهسایت: مطمئن شوید که مسیر فایلهای
sitemap.xmlدرrobots.txtمسدود نشده است.
تست و اعتبارسنجی فایل robots.txt
تست فایل robots.txt برای اطمینان از عملکرد صحیح آن بسیار مهم است.
بررسی دستی در مرورگر: سادهترین راه این است که آدرس
https://www.yourdomain.com/robots.txt
را در مرورگر خود باز کنید و مطمئن شوید که فایل قابل دسترسی است و محتوای آن همان چیزی است که انتظار دارید.
- ابزار تست robots.txt در Google Search Console: این ابزار قویترین راه برای تست فایل
robots.txtبرای Googlebot است.- وارد حساب Google Search Console خود شوید.
- سایت مورد نظر را انتخاب کنید.
- به بخش “Legacy tools and reports” یا “Settings” (بسته به نسخه جدید یا قدیمی کنسول) بروید و ابزار “robots.txt Tester” را پیدا کنید.
- این ابزار فایل
robots.txtفعلی سایت شما را نمایش میدهد. میتوانید تغییرات را مستقیماً در ویرایشگر آن اعمال کرده و تست کنید. - میتوانید URLهای خاصی از سایت خود را وارد کنید و ابزار به شما خواهد گفت که آیا Googlebot اجازه پیمایش آن URL را بر اساس دستورالعملهای فعلی
robots.txtدارد یا خیر و کدام خط از فایل باعث این تصمیم شده است. - پس از اعمال تغییرات و اطمینان از صحت آنها، میتوانید فایل جدید را دانلود کرده و آن را در سرور خود آپلود کنید.
- ابزارهای تست آنلاین دیگر: وبسایتهای مختلفی ابزارهای رایگان برای تست سینتکس فایل
robots.txtارائه میدهند. این ابزارها میتوانند خطاهای نحوی را قبل از آپلود فایل شناسایی کنند.

رابطه robots.txt با متا تگ robots و هدر X-Robots-Tag
درک تفاوت و تعامل بین robots.txt، متا تگ robots (در HTML) و هدر X-Robots-Tag (در پاسخ HTTP) برای کنترل کامل نحوه تعامل موتورهای جستجو با سایت شما ضروری است.
- robots.txt: وظیفه اصلی آن کنترل پیمایش (Crawling) است. این فایل به خزندهها میگوید که کدام صفحات را نباید درخواست کنند. اگر صفحهای در
robots.txtمسدود شده باشد، خزنده آن را پیمایش نمیکند و در نتیجه نمیتواند محتوای آن را بخواند یا لینکهای موجود در آن را دنبال کند. - متا تگ robots و هدر X-Robots-Tag: وظیفه اصلی آنها کنترل فهرست شدن (Indexing) و دنبال کردن لینکها (Following) است. این دستورالعملها در داخل خود صفحه (در HTML یا هدر HTTP) قرار دارند. برای اینکه موتور جستجو این دستورالعملها را ببیند، صفحه باید ابتدا پیمایش شود.
noindex: به موتور جستجو میگوید که این صفحه را در فهرست خود قرار نده.

نتیجه گیری بهینهسازی فایل robots.txt
در مجموع، بهینهسازی فایل robots.txt یک جنبه مهم از مدیریت فنی سئو است که نباید نادیده گرفته شود. با استفاده صحیح از دستورالعملهایی مانند User-agent، Disallow، Allow و Sitemap، میتوانید کنترل دقیقی بر نحوه پیمایش سایت خود توسط خزندههای موتورهای جستجو داشته باشید. این امر به شما کمک میکند تا بودجه خزش خود را به سمت صفحات مهم هدایت کنید، از فهرست شدن محتوای غیرضروری جلوگیری کنید و در نهایت تجربه بهتری را هم برای کاربران و هم برای موتورهای جستجو فراهم آورید.
تست منظم فایل robots.txt با ابزارهای موجود و بهروزرسانی آن متناسب با تغییرات سایت، اطمینان از عملکرد صحیح آن را تضمین میکند و به حفظ و بهبود رتبه سایت شما در نتایج جستجو کمک شایانی مینماید.