وبسایت شرکتها زمانی یک بروشور بود که اتفاقی روی اینترنت قرار گرفته بود. در ۲۰۲۶ بیشتر نقش «سند رسمی» کسبوکار را دارد: همان صفحهای که خریدار در یک دقیقه با سه رقیبتان مقایسه میکند، و همان صفحهای که یک دستیار هوش مصنوعی میخواند تا شما را برای کسی توصیف کند که هیچوقت صفحهٔ اصلیتان را نمیبیند. هر دو یک فایل را باز میکنند؛ اما فقط یکیشان با صفحهٔ کند و گیجکننده کنار میآید.
چیزی که روی سایت شما نباشد، مدلها نمیتوانند بخوانند
گرانترین فرض در بازاریابی امروز این است که «پیج فعال یعنی دیدهشدن». مدلهای زبانی بزرگ عمدتاً از وبِ باز و قابلخزش ساخته میشوند. Common Crawl، آرشیو عمومیای که بخش زیادی از این آموزش بر آن استوار است، خودش را «بیش از ۳۰۰ میلیارد صفحه در ۱۵ سال» معرفی میکند و ماهانه سه تا پنج میلیارد صفحه به آن اضافه میشود. صفحههای وبسایت شما میتوانند در چنین آرشیوی باشند؛ پستها، استوریها و کامنتهای شبکههای اجتماعی معمولاً نه.
متا در این مورد صریح است. در گزارش فنی Llama 2 آمده است که مجموعهٔ آموزشی «ترکیب تازهای از دادههای منابع در دسترس عموم است و شامل دادههای محصولات یا خدمات متا نمیشود». یعنی شرکتی که مالک فیسبوک و اینستاگرام است، مدلش را با وبِ عمومی آموزش داده، نه با آنچه کاربران داخل اپلیکیشنهای خودش منتشر میکنند.
پلتفرمهای بزرگ دسترسی خودکار را با ورود اجباری و قواعد خزش هم محدود میکنند. این حق خودشان است و مسئله دقیقاً همینجاست: توصیفی که از کسبوکار شما به پاسخ هوش مصنوعی میرسد، از صفحههای عمومی ساخته میشود. اگر تنها شرح دقیق کارتان زیر یک عکس نوشته شده باشد، مدل چیزی برای خواندن، نقلکردن یا درستگفتن ندارد.
زمین اجارهای یا داراییای که مال خودتان است
ساختن حضور فقط روی شبکههای اجتماعی یعنی ساختن روی زمین اجارهای. میزان دیدهشدن را قواعدی تعیین میکند که شما ننوشتهاید و نمیتوانید به آنها اعتراض کنید، و بدون اطلاع قبلی عوض میشوند. وبسایت داراییای از جنس مقابل است: ساختش کندتر است، اما مال شماست و روایت، ساختار و مسیر کاربر را خودتان تعیین میکنید.
| معیار | وبسایت شما | شبکههای اجتماعی |
|---|---|---|
| مالکیت | محتوا، داده و دامنه مال شماست | دسترسی، تابع شرایط پلتفرم |
| دیدهشدن در جستوجو و پاسخهای هوش مصنوعی | قابل خزش و قابل استناد | اغلب محدود به کاربران واردشده |
| تبدیل | ساختار حول یک قدم بعدی مشخص | ساختهشده برای تعامل، نه برای درخواست |
| ماندگاری | اثرش سالبهسال جمع میشود | دیدهشدن در چند روز تمام میشود |
| اعتبار | مستندات، پروژهها و سوابق خودتان | فقط اعتبار اجتماعی |
سرعت، بخشی از خواندهشدن است
دربارهٔ سرعت، مهلتهای ساختگی زیاد گفته میشود؛ بهتر است به عددی تکیه کنیم که خود گوگل منتشر کرده. در Core Web Vitals، Largest Contentful Paint برابر یا کمتر از ۲٫۵ ثانیه «خوب» و بیش از ۴ ثانیه «ضعیف» شمرده میشود؛ این آستانهها در کتابخانهٔ اندازهگیری خود گوگل نوشته شدهاند. صفحهای که از این خط عقب بماند، هم برای کاربر خستهکننده است و هم برای هر خزندهای کندتر.
سرعت نیمی از ماجراست. بعد از بارگذاری، چیزی که تعیین میکند کاربر بماند یا نه، مقدار زحمتی است که صفحه از او میخواهد؛ موضوع مقالهٔ تلهٔ بار شناختی. صفحهای که سریع باز میشود ولی کاربر ده ثانیه دنبال دکمهٔ درست میگردد، برتریاش را از دست داده است.
از یک وبسایت شرکتی امروز چه انتظاری میرود:
- هماهنگشدن با مخاطب: زبان، واحد پول و محتوای متناسب با بازاری که کاربر از آن آمده است.
- پاسخدادن پیش از فروختن: همان سؤال مشخصی که کاربر با آن آمده، در اولین صفحه پاسخ بگیرد، نه سه کلیک بعد.
- غربال درخواستها: فرم و پرسشنامهای که اطلاعات لازم برای قیمتدادن را جمع کند، نه یک «سلام» بینام دیگر.
ورود به بازارهای تازه، بدون باز کردن دفتر
همین مقاله یک نمونهٔ عملی است. شما یکی از نُه نسخهٔ زبانی آن را میخوانید؛ هر نسخه نشانی، متادیتا و جایگاه خودش را در مجموعهٔ hreflang دارد و همه از یک نصب واحد سرو میشوند. گسترش بینالمللی در عمل همین شکل است: نه افزونهٔ ترجمهای که آخر کار اضافه شود، بلکه ساختاری که در آن هر زبان یک صفحهٔ واقعی و قابل ایندکس است و میتواند مستقل رتبه بگیرد و مورد استناد قرار بگیرد.
این موضوع رقبای ممکن شما را هم عوض میکند. یک تیم تخصصی ششنفره میتواند دربارهٔ حوزهٔ کاریاش شفافتر و منظمتر از شرکتی چندملیتی بنویسد که سایتش دست یک کمیته است؛ و در پاسخ هوش مصنوعی، منبع روشنتر نقل میشود.
چه چیزی یک صفحه را قابل استناد میکند
وسوسهانگیز است که دیدهشدن در هوش مصنوعی را رشتهای تازه با ترفندها، فایلها و نشانهگذاریهای جدید بدانیم. راهنمای خود گوگل خلافش را میگوید: «optimizing for generative AI search is optimizing for the search experience, and thus still SEO»؛ یعنی چیز اضافهای برای ماشینها منتشر نمیشود.
آنچه اندازهگیری شده، این است که موتورهای مولد به چه صفحههایی تکیه میکنند. در پژوهشی که در KDD 2024 ارائه شد، آگاروال و همکارانش تغییرهایی را روی صفحههای مرجع آزمودند: افزودن نقلقول مرتبط از منابع معتبر سهم یک صفحه در پاسخ تولیدشده را ۴۳٫۸٪ بالا برد و جایگزینی ادعاهای کلی با آمار مشخص، ۳۴٫۲٪. انباشتن کلمهٔ کلیدی آن را ۷٫۸٪ پایین آورد. یعنی همان کاری که یک سردبیر خوب تأیید میکند، روی پاسخهای هوش مصنوعی هم جواب میدهد.
بیشترِ این اثر را سه چیز میسازد:
- دادهٔ ساختاریافتهٔ منطبق با صفحه. خدمات، نشانیها و اطلاعات تماسی را نشانهگذاری کنید که واقعاً روی صفحه نشان میدهید، تا ماشین همان چیزی را بخواند که کاربر میبیند.
- نشانهٔ روشن تجربه. چه کسی، در کدام پروژه و با چه نتیجهای کار کرده است. یک نویسندهٔ نامدار و یک نمونهکار صادقانه از یک صفحه صفت پرطمطراق ارزشمندتر است.
- قابلیت خزش. هیچ محتوای مهمی پشت اسکریپت پنهان نماند؛ برای هر زبان یک نشانی روشن، نقشهٔ سایت تمیز و canonical که به خودش اشاره کند.
وبسایت، نسخهٔ مرجع کسبوکار شما
وبسایت دیگر پروژهای یکباره نیست که هر چند سال از نو ساخته شود. نسخهٔ مرجع کسبوکار شماست: همان که مردم مقایسهاش میکنند، موتورهای جستوجو ایندکسش میکنند و سامانههای هوش مصنوعی وقتی کسی دربارهٔ حوزهٔ شما میپرسد، از رویش نقل میکنند. هر چیز دیگری که منتشر میکنید، اعتبارش را از همینجا قرض میگیرد.
اگر میخواهید بدانید سایت خودتان برای این دو مخاطب چطور خوانده میشود، صفحهٔ خدمات روش کار ما را توضیح میدهد، نمونهکارها کارهای انجامشده را نشان میدهد و میتوانید صفحههایی را که دربارهٔ آنها تردید دارید برای ما بفرستید. اولین پرسشی که باید جواب بگیرد ساده است: اگر یک دستیار هوش مصنوعی فقط با تکیه بر وبسایت شما بخواهد کارتان را توضیح دهد، درست توضیح میدهد؟