llms.txt چیست و آیا واقعاً کسی آن را می‌خواند؟

نکات کلیدی

_
  • llms.txt یک استاندارد رسمی نیست؛ پیشنهادی است که یک توسعه‌دهنده مطرح کرده و هنوز به تأیید مرجع استانداردی نرسیده.
  • این فایل ابزار بلاک‌کردن نیست؛ اگر می‌خواهید رباتی وارد نشود، ابزار شما همچنان robots.txt است.
  • ساختارش پنج جزء ساده دارد و در نیم‌ساعت می‌توانید نسخه‌ی اولش را منتشر کنید.
  • شواهد ۲۰۲۶ نشان می‌دهد بیشتر این فایل‌ها خوانده نمی‌شوند؛ پس انتظار جهش در دیده‌شدن نداشته باشید.
  • با این حال ساختش هزینه‌ی کمی دارد و برای سایت‌های مستندات و پروژه‌هایی که با ابزارهای هوشمند کار می‌کنند منطقی‌تر است.
۱

llms.txt چیست و چه کاری انجام می‌دهد؟

_

llms.txt یک فایل متنی با پسوند مارک‌داون است که در ریشه‌ی دامنه‌ی شما قرار می‌گیرد؛ جایی مثل example.com/llms.txt. داخلش فهرست مرتبی از مهم‌ترین صفحات سایت شما هست: هر خط یک لینک، همراه با یک جمله توضیح.

پیشنهادش از شهریور ۱۴۰۳ (سپتامبر ۲۰۲۴) از سوی جرمی هاوارد مطرح شد و روی سایت llmstxt.org منتشر شد. ایده‌ی اصلی ساده بود: مدل‌های زبانی وقتی می‌خواهند سایتی را بفهمند، مجبورند کدهای HTML را بخوانند و بین منوها و تبلیغ‌ها دنبال محتوای اصلی بگردند. اگر یک فایل تمیز مارک‌داون دم در بگذارید، در چند توکن می‌فهمند شما که هستید و مهم‌ترین حرف‌تان کجاست.

تمثیل ماجرا این است: سایت شما یک موزه است. robots.txt نگهبان دم در است که می‌گوید کدام سالن‌ها تعطیل‌اند. sitemap.xml فهرست کامل انبار است؛ همه‌ی قلم‌ها، بدون اولویت. llms.txt اما راهنمای موزه است که می‌گوید: «وقت کم داری؟ از این سه سالن شروع کن، بقیه در بخش اختیاری است.»

نکته‌ی مهم این است که llms.txt یک پیشنهاد است، نه استاندارد. هیچ نهاد رسمی آن را تصویب نکرده و هیچ اجباری برای ربات‌ها وجود ندارد. مثل دعوت‌نامه‌ای است که دست طرف مقابل است که بازش کند یا نه.

۲

تفاوت llms.txt با robots.txt و sitemap؛ سه فایل، سه مأموریت

_

این سه فایل را خیلی‌ها با هم قاطی می‌کنند. جدول زیر تفاوت را روشن می‌کند.

ویژگیrobots.txtsitemap.xmlllms.txt
مأموریتکنترل دسترسی ربات‌هامعرفی همه‌ی آدرس‌های سایتمعرفی مهم‌ترین محتوا به هوش مصنوعی
زباندستوری (Allow / Disallow)XMLمارک‌داون
مخاطبهمه‌ی خزنده‌هاموتورهای جستجومدل‌ها و عامل‌های هوشمند
جایگاهریشه‌ی دامنهمعمولاً ریشه‌ی دامنهریشه‌ی دامنه
استاندارد رسمیبلهبلهخیر، پیشنهاد جامعه
قدرت اجراعملاً اجباری برای ربات‌های معتبرراهنمای کشف صفحاتکاملاً داوطلبانه

یک هشدار عملی: بعضی‌ها تصور می‌کنند با llms.txt می‌توانند جلوی خواندن محتوایشان را بگیرند. این تصور غلط است. llms.txt کنترل دسترسی نیست و هیچ رباتی خودش را ملزم به رعایتش نمی‌داند.

اگر هدفتان تعیین مرزهای دسترسی است، ابزار شما همان robots.txt است. اگر هدفتان معرفی محتوای مهم است، llms.txt روی میز است.

۳

داخل فایل چه می‌نویسند؟ ساختار کامل

_

ساختار پیشنهادی پنج جزء دارد و به‌طرز دلپذیری ساده است:

1. یک تیتر H1 با نام سایت یا پروژه.

2. یک پاراگراف نقل‌قول که در یک دو جمله توضیح می‌دهد این سایت چیست و چه کاری انجام می‌دهد.

3. بخش‌های H2 مثل «مقالات»، «دوره‌ها»، «مستندات».

4. در هر بخش، لیستی از لینک‌ها با توضیح کوتاه. توصیه‌ی رایج این است که توضیح‌ها زیر ۱۲۰ کاراکتر بمانند.

5. یک بخش اختیاری با عنوان Optional برای صفحاتی که اگر وقت ماشین کم بود، مهم نیستند.

دو نکته‌ی جزئی اما مهم: توضیح‌ها را با فعل یا ارزش صفحه شروع کنید، نه با نام برند. و از زبان فروشنده پرهیز کنید؛ مدل زبانی دنبال توصیف دقیق است، نه شعار.

نکته‌ی سوم که کمتر گفته می‌شود: این فایل هم مثل هر محتوای دیگری به‌روزرسانی می‌خواهد. فایلی که آدرس‌های حذف‌شده و دوره‌های تمام‌شده را معرفی کند، بدتر از نداشتن فایل است.

۴

llms-full.txt چیست و چه زمانی به آن نیاز دارید؟

_

نسخه‌ی کامل این فایل، llms-full.txt نام دارد. تفاوتشان شبیه نقشه و قلمرو است: یکی فهرست راهنماست، دیگری کل محتوا در یک فایل.

ویژگیllms.txtllms-full.txt
محتوالینک + توضیح یک‌خطیمتن کامل صفحات، یک‌جا
حجمکوچک و سبکمی‌تواند سنگین شود
کاربرد اصلیهر سایتی که بخواهد نسخه‌ی مرتب داشته باشدسایت‌های مستندات و مرجع دانش
نگهداریدستی، راحتنیاز به تولید خودکار دارد
برای کسب‌وکار خدماتیگزینه‌ی منطقیمعمولاً لازم نیست

اگر سایت شما روزانه ده‌ها صفحه‌ی آموزشی یا مستندات فنی دارد و مخاطب اصلی‌تان برنامه‌نویس و تیم‌های فنی است، llms-full.txt معنا دارد.

برای یک کسب‌وکار خدماتی، فروشگاه یا سایت شرکتی، همان فایل اول کافی است. ساختن نسخه‌ی کامل بدون مخاطب واقعی، فقط یک فایل سنگین‌تر است که کسی نمی‌خواند.

  • پیشنهاد ما به شما:
۵

آیا واقعاً کسی این فایل را می‌خواند؟ داده‌های ۲۰۲۶

_

اینجا جایی است که باید بی‌تعارف باشیم؛ خیلی از مقاله‌های این حوزه این بخش را حذف می‌کنند.

افزایش تولید، بدون افزایش خواننده. بر اساس پایش نزدیک سه میلیون سایت، تعداد سایت‌هایی که این فایل را منتشر کرده‌اند در یک سال نزدیک ۹ برابر شده؛ از حدود چهار هزار به بیش از ۳۶ هزار سایت. اما تحلیل ایهرفس روی بیش از ۱۳۷٬۰۰۰ دامنه نشان می‌دهد در بازه‌ی بررسی، نزدیک ۹۷٪ این فایل‌ها حتی یک درخواست هم نگرفتند.

هیچ غول بزرگی تأیید نکرده است. گوگل در سال ۲۰۲۵ صریحاً گفت این فایل را پشتیبانی نمی‌کند و برنامه‌ای هم برای حمایت ندارد؛ جان مولر آن را با متاتگ کلمات کلیدی مقایسه کرد، همان چیزی که همه پر می‌کنند و هیچ‌کس نمی‌خواند. مستندات خزنده‌های OpenAI هم اسمی از این فایل نمی‌آورد و به همان robots.txt ارجاع می‌دهد.

اما چند استثنا وجود دارد. شرکت‌هایی مثل Anthropic، Stripe، Cloudflare، Vercel و چند پلتفرم مستندات، خودشان فایل دارند؛ هرچند انتشار فایل به معنی استفاده از فایل دیگران نیست. Perplexity از جمله سیستم‌هایی است که گزارش شده برای اولویت‌بندی صفحات سراغ این فایل می‌رود. ابزارهای کدنویسی هوشمند هم وقتی فایل را ببینند، از آن استفاده می‌کنند — این امروز تنها کاربرد اثبات‌شده‌ی آن است. نکته‌ی جالب دیگر: ابزار بررسی خود کروم هم یک بررسی برای عامل‌های هوشمند اضافه کرده که وجود این فایل را پیشنهاد می‌دهد.

و یک واقعیت تکان‌دهنده: در مطالعه‌ای روی صدها هزار دامنه، میان داشتن این فایل و بیشتر استناد‌شدن در پاسخ‌های هوش مصنوعی، رابطه‌ی معنی‌داری پیدا نشد.

جمع‌بندی صادقانه: llms.txt امروز یک شانس کوچک کم‌هزینه است، نه اهرم رشد.

۶

بسازیم یا نسازیم؟ راهنمای تصمیم

_

با توجه به داده‌های بخش قبل، تصمیم را اینطور ساده می‌کنم:

وضعیت شماپیشنهاد
سایت مستندات، API یا پایگاه دانش فنیبسازید؛ بیشترین سود واقعی اینجاست
محصول نرم‌افزاری با مخاطب برنامه‌نویسبسازید و llms-full.txt را هم در نظر بگیرید
کسب‌وکار خدماتی با سایت چندصفحه‌ایاختیاری؛ اگر وقت دارید، نیم‌ساعتش را بگذارید
فروشگاه اینترنتی با هزاران محصولفایل دستی معنا ندارد؛ اول ساختار و داده‌ی ساختاریافته
سایتی که هنوز پایه‌ی سئویش درست نیستفعلاً نه؛ اول پایه را درست کنید

یک قاعده‌ی ساده برای تصمیم: اگر نمی‌توانید ده صفحه‌ی «واقعاً مهم» سایتتان را بدون فکر کردن نام ببرید، هنوز وقت ساختن این فایل نیست. مشکل شما جای دیگری است.

۷

هفت قاعده برای نوشتن فایلی که به کار بیاید

_
  • کیفیت را به کمیت ترجیح دهید. ده تا بیست لینک دقیق، بهتر از دویست لینک تکراری است. این فایل، نقشه‌ی سردبیری است، نه نمای کامل سایت.
  • به هر لینک توضیح بدهید. لینک بی‌توضیح، بار اطلاعاتی صفر دارد.
  • زبان توصیفی انتخاب کنید. «دوره‌ی مکالمه ۱۲ جلسه‌ای برای بزرگسالان» به مدل کمک می‌کند؛ «بهترین آموزشگاه شهر» نه.
  • صفحاتی را معرفی کنید که به‌روز و بی‌نقص‌اند. این فایل، ویترین شماست.
  • موضوعی دسته‌بندی کنید. بخش‌های روشن مثل «دوره‌ها»، «راهنماها»، «پرسش‌های متداول» فهم ماشین را ساده‌تر می‌کنند.
  • مسیرها را کوتاه و پایدار نگه دارید. اگر آدرس صفحات زیاد عوض می‌شود، فایل شما خیلی زود کهنه می‌شود.
  • یک تاریخ بازبینی برای خودتان بگذارید. هر سه ماه کافی است.
۸

قدم‌به‌قدم: افزودن llms.txt به سایت وردپرسی

_

این کار چند مسیر دارد. مسیر درست بسته به سطح دسترسی شما به هاست تفاوت می‌کند.

روش اول، ساده‌ترین حالت:

1. یک فایل متنی بسازید و نامش را دقیقاً llms.txt بگذارید.

2. با مدیریت فایل هاست یا FTP، آن را در پوشه‌ی ریشه‌ی دامنه آپلود کنید؛ همان پوشه‌ای که robots.txt و sitemap آنجاست.

3. آدرس yourdomain.com/llms.txt را باز کنید. باید متن ساده ببینید، نه یک صفحه‌ی HTML.

روش دوم، وقتی دسترسی به فایل‌های هاست ندارید:

1. محتوای فایل را در یک بخش دلخواه سایت منتشر کنید.

2. با یک افزونه‌ی مدیریت ریدایرکت، مسیر /llms.txt را به همان صفحه هدایت کنید.

3. حتماً بررسی کنید نوع پاسخ متن ساده باشد، نه HTML.

روش سوم، وقتی تیم فنی دارید: فایل را در پوشه‌ی عمومی پروژه بگذارید تا همراه هر انتشار به‌روز شود. برای سایت‌های بزرگ، خودکار‌سازی این کار بهترین گزینه است.

سه چیز را تست کنید: آدرس درست باز می‌شود، نوع پاسخ متن ساده است، و فایل در نقشه‌ی سایت سایت‌تان نباشد. وجود درباره‌ی محتوای این فایل در نتایج جستجو فایده‌ای ندارد.

  • پیشنهاد ما به شما:
۹

یک نمونه‌ی فارسی کامل

_

فرض کنید یک آموزشگاه زبان دارید. نمونه‌ی زیر همان ساختار پیشنهادی را رعایت می‌کند و توضیح‌ها فارسی و توصیفی‌اند:

۱۰

دوره‌های اصلی

_
۱۱

اطلاعات عملی

_
۱۲

Optional

_
- [دوره مکالمه بزرگسالان](https://example.com/conversation/): دوازده جلسه
با تمرکز بر گفت‌وگوی روزمره و تلفظ.
- [دوره آمادگی آزمون](https://example.com/exam-prep/): شش هفته آماده‌سازی
برای آزمون‌های بین‌المللی، همراه با آزمون آزمایشی.
- [دوره کودکان](https://example.com/kids/): آموزش با بازی و داستان
برای گروه سنی ۷ تا ۱۲ سال.
سطوح و پیش‌نیاز هر کدام.
- [تعیین سطح آنلاین](https://example.com/placement/): آزمون کوتاه برای
پیشنهاد سطح مناسب.
- [پرسش‌های متداول](https://example.com/faq/): پاسخ به پرسش‌های رایج
درباره شهریه، غیبت و جبرانی.
- [وبلاگ آموزشی](https://example.com/blog/): یادداشت‌های کوتاه آموزشی.
- [درباره ما](https://example.com/about/): سابقه‌ی مجموعه و تیم مدرسان.

سه نکته درباره‌ی این نمونه: توضیح‌ها به ارزش صفحه اشاره می‌کنند نه به برند؛ بخش Optional برای کم‌اهمیت‌ترها رزرو شده؛ و کل فایل زیر سی خط است. همین کافی است.

  • پیشنهاد ما به شما:
۱۳

پنج اشتباهی که فایل شما را بی‌اثر می‌کند

_
  • ریختن همه‌ی آدرس‌های سایت در فایل. نتیجه، یک نقشه‌ی بی‌اولویت است که ارزشی به مخاطب اضافه نمی‌کند.
  • جایگزین‌کردنش با robots.txt. این فایل هیچ کنترلی روی دسترسی ندارد؛ انتظار اشتباهی است.
  • سرو کردن فایل با نوع HTML. اگر سرور شما فایل را به‌عنوان صفحه‌ی وب تحویل دهد، محتوایش خوانده نمی‌شود.
  • نوشتن متن تبلیغاتی. مدل دنبال توصیف است؛ شعار و صفت‌های اغراق‌آمیز فقط نویز است.
  • رهاکردن فایل بدون به‌روزرسانی. لینک شکسته به مدل می‌گوید سایت شما نگهداری نمی‌شود.
۱۴

اگر فقط llms.txt بسازید، هیچ اتفاقی نمی‌افتد

_

این مهم‌ترین پیام این مقاله است. llms.txt یک لایه‌ی اضافه روی یک پایه است؛ نه جایگزین آن.

سه لایه‌ی زیرین را باید درست کنید:

و اگر می‌خواهید بدانید کدام ربات‌ها به سایت شما می‌آیند و چطور تصمیم بگیرید به کدام‌شان اجازه بدهید، مقاله‌ی «ربات‌های هوش مصنوعی و robots.txt نسل جدید» را بخوانید.

۱۵

نقشه‌ی ۳۰ روزه‌ی شما

_

این مسیر برای کسی است که می‌خواهد کار را درست و بدون هدر دادن وقت انجام دهد:

هفته‌ی اول: فهرست ده تا بیست صفحه‌ی «واقعاً مهم» سایتتان را بنویسید. هنوز چیزی نسازید.

هفته‌ی دوم: فایل را بنویسید، توضیح‌ها را توصیفی نگه دارید و روی سایت منتشر کنید.

هفته‌ی سوم: لاگ سرور را نگاه کنید که آیا ربات‌ها درخواستی به این فایل می‌فرستند. نتیجه‌ی احتمالی: تقریباً هیچ. ناامید نشوید؛ این طبیعی است.

هفته‌ی چهارم: به‌جای صرف وقت بیشتر روی این فایل، بروید سراغ کاری که امروز واقعاً اثر دارد: تقویت محتوای پاسخ‌محور و اصلاح پایه‌ی فنی.

جمع‌بندی

llms.txt یک ایده‌ی منطقی است که فعلاً از شواهد عقب مانده. ساختنش ارزان است، اما محصول معجزه‌آوری نیست و هیچ تضمینی برای دیده‌شدن نمی‌دهد. اگر سایت مستندات یا محصول فنی دارید، همین امروز بسازیدش. اگر کسب‌وکار خدماتی یا فروشگاهی دارید، اولویت‌تان چیز دیگری است.

قدم بعدی پیشنهادی: ده صفحه‌ی مهم سایتتان را در یک فایل یادداشت کنید و کنار هر کدام بنویسید چرا مهم است. همان فایل، هم آماده‌ی llms.txt است و هم نقشه‌ی محتوایی نیم‌سال آینده‌ی شما.

اگر می‌خواهید کل این مسیر را منظم ببینید، دانش‌نامه‌ی سئو تنا مدیا از مبانی تا لایه‌های تازه‌تر همین‌طور گام‌به‌گام چیده شده است و اگر ترجیح می‌دهید این کار همراه با اصلاح پایه‌ی فنی سایت انجام شود، خدمات سئو تنا مدیا از همین‌جا شروع می‌شود.

آماده‌ای قدم بعدی را برداری؟ برای مشاوره رایگان با کارشناسان تنا مدیا در اپلیکیشن بله (@tana_pr) پیام بده یا از صفحه تماس با ما اقدام کن.

پرسش‌های متداول

_
  • پیشنهاد ما به شما:

امکان درج دیدگاه بسته شده است