تنظیم Disallow AI Training محصولی است که کلودفلر در ۱۵ سپتامبر ۲۰۲۶ برای مدیریت خزنده‌های ترکیبی اعلام کرده‌است. هدف اعلام‌شده این است که مالکان سایت بتوانند ایندکس جستجو را حفظ کنند و هم‌زمان از آموزش مدل روی همان محتوا خودداری نمایند؛ بدون آنکه ناچار به مسدودسازی کامل خزنده‌های بزرگ شوند.

به نوشتهٔ وبلاگ رسمی کلودفلر، بسیاری از سازمان‌های بزرگ اینترنت از خزنده‌های «ترکیبی» (mixed-use) استفاده می‌کنند؛ یعنی یک خزنده هم برای ایندکس جستجو و هم برای آموزش یا تنظیم مدل به‌کار می‌رود. در نبود کنترل جداگانه، رد کردن آموزش به‌معنای قطع شدن مسیر کشف در جستجو نیز بوده‌است. تنظیم تازه دقیقاً برای شکستن همین بده‌بستان معرفی شده‌است.

Disallow AI Training کلودفلر چیست؟

طبق اعلام شرکت، رفتار خزنده‌ها در سه دستهٔ جستجو (Search)، آموزش (Training) و عامل (Agent) طبقه‌بندی می‌شود. برای آموزش، گزینه‌های دامنه به این شکل است: Allow؛ Disallow AI Training؛ Block on pages with ads؛ و Block. گزینهٔ Disallow AI Training از طریق Bot Preference Sync ترجیح «بدون آموزش» را در robots.txt منتشر می‌کند، خزنده‌های ترکیبیِ واجد شرایط را برای جستجو باز نگه می‌دارد و سایر خزنده‌های آموزش‌محور را مسدود می‌کند.

کلودفلر می‌نویسد کمتر از یک درصد سایت‌های تحت پوشش این شبکه جستجو را مسدود می‌کنند، در حالی که حدود ۱۷ درصد دست‌کم سازوکاری برای محدود کردن آموزش فعال کرده‌اند. به همین دلیل، به‌جای یک دکمهٔ کلی «Block AI»، کنترل‌های ریزدانه‌تر جایگزین شده‌اند.

از ۱۵ سپتامبر، گزینه‌های Block و Block on pages with ads روی خزنده‌های ترکیبی نیز اعمال می‌شوند؛ از جمله Applebot، Bingbot و Googlebot. در نتیجه اگر مالک سایت این گزینه‌ها را انتخاب کند، هم آموزش و هم جستجو قطع می‌شود. برای قطع آموزش و حفظ جستجو باید از Disallow AI Training استفاده شود. همچنین «Block AI Bots» و Managed Robots.txt در مسیر کنارگذاری اعلام شده‌اند و ترجیحات مشتریان موجود به کنترل‌های جدید منتقل می‌شوند.

اگر تجربه یا پرسشی دربارهٔ تنظیم خزنده‌ها در پنل کلودفلر دارید، در بخش دیدگاه‌ها بنویسید.

نام‌گذاری Accountable و رفتار اپل، گوگل و مایکروسافت

کلودفلر برای اپراتورهایی که کنترل و شفافیت را ارائه می‌دهند یا تعهد زمانی مشخص دارند، عنوان Accountable را به‌کار برده‌است. شرایط اعلام‌شده شامل امکان انصراف از آموزش (مثلاً از طریق robots.txt)، امکان انصراف از خلاصه‌های تولیدشده با هوش مصنوعی، شفافیت در سطح نشانی صفحه دربارهٔ محتوای در دسترس برای آموزش، و تضمین آنکه انصراف از آموزش رتبهٔ جستجوی سنتی را تغییر ندهد، است.

  • برای Applebot، انصراف از آموزش با قاعدهٔ Disallow برای «Applebot-Extended» در robots.txt انجام می‌شود؛ شرکت اعلام کرده‌است که این کار روی رتبه‌بندی جستجو اثر ندارد.
  • برای Googlebot، انصراف با Disallow برای «Google-Extended» و ابزارهای پورتال وب‌مستر ممکن است؛ گوگل نیز اعلام کرده‌است انصراف از Google-Extended روی رتبه‌بندی جستجو اثر ندارد.
  • برای Bingbot، فعلاً ترجیح از طریق متاتگ NOARCHIVE و ابزارهای حذف محتوا بیان می‌شود و مایکروسافت ساخت پشتیبانی robots.txt در سطح دامنه را برای اوایل ۲۰۲۷ هدف‌گذاری کرده‌است.

خزنده‌های مرتبط آمازون، Anthropic، متا و OpenAI نیز به‌عنوان Accountable طبقه‌بندی شده‌اند؛ چون جستجو و آموزش را جدا می‌کنند و می‌توان خزندهٔ آموزش را بدون آسیب به جستجو مسدود کرد.

مهاجرت تنظیمات و گام بعدی خلاصه‌های هوش مصنوعی

برای دامنه‌هایی که هرگز کنترل‌های Search/Training/Agent را پیکربندی نکرده بودند، مهاجرت بر اساس تنظیم قدیمی «Block AI» انجام می‌شود: اگر Block یا Block on pages with ads فعال بوده، Training به Disallow AI Training و Agent به Block on pages with ads نگاشته می‌شود و Search روی Allow می‌ماند. دامنه‌های جدید نیز بر اساس اینکه از تبلیغات درآمد دارند یا نه، پیکربندی پیشنهادی متفاوتی هنگام اتصال دریافت می‌کنند.

کلودفلر گام بعدی را کنترل روی خلاصه‌های هوش مصنوعی (AI Summaries) اعلام کرده‌است. به استناد ارقام منتشرشده در همان مطلب، بیش از نیمی از مصرف‌کنندگان خلاصه‌ها را در جستجو می‌خوانند و این گروه بیش از ۴۰ درصد بیشتر احتمال دارد پس از خواندن خلاصه جستجو را تمام کنند؛ در مقابل، ارجاع از جستجوی مبتنی بر هوش مصنوعی بین سه تا بیش از پنج برابر نرخ تبدیل بالاتری نسبت به جستجوی سنتی دارد. شرکت تأکید کرده‌است نقش آن انتخاب کسب‌وکار برای مالک نیست، بلکه فراهم‌کردن کنترل و دیده‌پذیری است.

این کنترل‌ها طبق اعلام کلودفلر برای همهٔ طرح‌ها، از جمله طرح رایگان، در تنظیمات امنیتی دامنه در دسترس‌اند. جزئیات فنی و جدول مهاجرت در وبلاگ رسمی کلودفلر آمده‌است.

از دید شما، برای سایت‌های فارسی‌زبان اولویت باید حفظ ترافیک جستجو باشد یا محدود کردن آموزش مدل؟