منابع استناد در Perplexity و Gemini: روش تحلیل دستی
چطور بدون مجموعهداده تجمیعی و با یک مجموعه prompt تکرارپذیر بفهمید Perplexity و Gemini برای پرسشهای ترکی کدام منابع را نشان میدهند.
نوشته Roozbeh Nazari · CEO
پاسخ دادن به این پرسش که «Perplexity و Gemini وقتی درباره برندهای ترک حرف میزنند از کدام منابع استناد میکنند» در سطح صنعت، به یک مجموعهداده استناد نیاز دارد: ابزاری که دامنههای منبع پشت هزاران پاسخ را جمع کند و بر اساس برند و رقیب تفکیک کند. در محیطی که این مقاله در آن آماده شد به چنین مجموعهدادهای دسترسی نداشتیم و فهرست «پراستنادترین دامنهها» یا درصد سهمی را که نتوانیم راستیآزمایی کنیم منتشر نمیکنیم. به جای آن، شیوه نمایش منابع در دو موتور را از صفحههای راهنمای رسمی خواندهایم و یک روش تحلیل دستی تکرارپذیر را شرح میدهیم که میتوانید برای برند خودتان و رقبایتان اجرا کنید. وقتی به ابزار دسترسی داشته باشید روش تغییری نمیکند؛ ابزار فقط نمونه را بزرگتر و زمان را کوتاهتر میکند.
دو موتور، دو شیوه متفاوت نمایش منابع
Perplexity در مرکز راهنمای خود میگوید هر پاسخ شامل استنادهای شمارهدار به منابع اصلی است. این مناسبترین وضعیت برای تحلیل است: اینکه هر جمله بر کدام صفحه تکیه دارد داخل پاسخ با شماره مشخص شده و فهرست منابع بخشی از خود پاسخ است. در Gemini وضعیت فرق میکند. طبق صفحه راهنمای Google، منابع به شکل «پیوندهای مرتبط» در یک پنل کناری نمایش داده میشوند که با دکمه «Sources» در پایین یا داخل پاسخ باز میشود، و این دکمه «در صورت موجود بودن» ظاهر میشود، نه در هر پاسخ. یعنی نبودن پنل منابع در یک پاسخ Gemini به این معنا نیست که آن پاسخ منبع نداشته؛ فقط یعنی نمایش داده نشده است. AI Overviews و AI Mode داخل جستجوی Google هم سطح سومی هستند؛ Google مستند کرده که این قابلیتها بر سیستمهای رتبهبندی اصلی تکیه دارند و به بهینهسازی اضافه نیاز ندارند. این مقاله به Perplexity و اپلیکیشن Gemini محدود است؛ قابلیتهای هوش مصنوعی داخل جستجو موضوع سنجش جداگانهای است.
گام ۱: مجموعه prompt را بسازید
سنجش با مجموعه پرسشها شروع میشود. راهاندازی بنچمارک ۱۰۰ پرامپتی که برای ChatGPT شرح دادیم اینجا هم معتبر است: پرسشهایی را که برندتان میخواهد به آنها پاسخ دهد، به زبان بیمار یا مشتری، در چهار نوع بنویسید. پرسشهای اطلاعاتی («بعد از کاشت مو کی میشود سر را شست»)، پرسشهای مقایسهای («برای ایمپلنت دندان در استانبول کدام کلینیکها توصیه میشوند»)، پرسشهای محلی و لجستیکی («هزینه لیزیک در آنتالیا چقدر است») و پرسشهای برند («آیا کلینیک X قابل اعتماد است»). دستکم بیست و پنج prompt برای هر نوع، در مجموع حدود صد؛ کمتر از این، نوسان تصادفی را از الگو جدا نمیکند. اگر promptها را به ترکی بنویسید بازار هدف ترکیه است؛ برای بیمار بینالمللی همان مجموعه را به عربی، انگلیسی و فارسی هم باید بسازید، چون هر دو موتور بسته به زبان و مکان منابع متفاوتی انتخاب میکنند.
گام ۲: پروتکل اجرا
رایجترین خطا در تحلیل دستی، ثابت نکردن شرایط است. در هر اجرا اینها را ثبت کنید: تاریخ و ساعت، موتور و در صورت وجود انتخاب مدل، ورود یا عدم ورود به حساب، زبان مرورگر و مکان. برای کاهش اثر سابقه شخصی از نشست بدون ورود یا پروفایل تمیز استفاده کنید. هر prompt را در همان روز سه بار اجرا کنید؛ پاسخها هر بار تغییر میکنند و یک اجرا گمراهکننده است. فیلدهای ثبت ثابتاند: prompt، موتور، شماره اجرا، دامنههای منبع نمایشدادهشده به ترتیب، اینکه برند شما در متن پاسخ آمده یا نه، رقبا آمدهاند یا نه، و سایت خودتان بین منابع هست یا نه. ثبت را در یک جدول نگه دارید و به هر ردیف اسکرینشات یا پیوند اشتراک پاسخ را ضمیمه کنید؛ ماهها بعد این تنها راه پاسخ به «آیا آن روز واقعاً همینطور بود» است. تکرار همان پروتکل در همان هفته از هر ماه، تغییر انتخاب منابع موتورها را برایتان آشکار میکند. اگر Gemini پنل منابع را باز نکرد، آن را جداگانه به عنوان «منبعی نمایش داده نشد» علامت بزنید؛ خالی نگذارید، چون نسبت این ردیفها برای Gemini خودش یک یافته است.
گام ۳: منابع را دستهبندی کنید
پس از جمعآوری دامنهها، هر یک را به یک نوع منبع نسبت دهید. دستههایی که در عمل به کار میبریم: سایت خود برند، سایت کلینیک یا برند رقیب، دایرکتوریها و بازارگاهها (پلتفرمهای مقایسه کلینیک)، خبر و رسانه، نهادهای رسمی (وزارتخانه، انجمن حرفهای، دانشگاه)، منابع دانشنامهای، انجمنها و محتوای کاربران، و پلتفرمهای ویدئو. دستهبندی پاسخ «چرا ما آنجا نیستیم» را آشکار میکند: اگر موتوری برای پرسشهای درمانی ترکی عمدتاً دایرکتوری و انجمن نشان میدهد، بهتر نوشتن سایت خودتان بهتنهایی کافی نیست؛ باید در آن دایرکتوریها درست و بهروز دیده شوید. برعکس، اگر نهادهای رسمی و رسانه غالباند، ذکر شدن در منابع نهادی اولویت پیدا میکند. این دستهبندی را برای هر نوع prompt جداگانه انجام دهید؛ در پرسشهای اطلاعاتی ممکن است منابع دانشنامهای و در پرسشهای مقایسهای دایرکتوریها غالب باشند و برنامه کار برای این دو نوع متفاوت است.
گام ۴: مقایسه رقبا و جدول شکاف
همان مجموعه prompt را برای رقبایتان تفسیر کنید: در کدام promptها رقیب ذکر شده و منابع آن پاسخ از کدام دستهاند. این در همان جدولی مینشیند که در روش شکاف استناد برای کلینیکهای رقیب شرح دادیم: دامنههای منبع در ردیفها، شما و رقبا در ستونها، و در خانهها تعداد پاسخهایی که از طریق آن منبع ذکر شدهاید. خانههای خالی جدول فهرست کار میشوند. خود صفحههای منبع را هم بررسی کنید: صفحههای استنادشده بیشتر شامل پاراگرافهای کوتاه و خودبسندهای هستند که مستقیم به پرسش پاسخ میدهند؛ اصولی که در مقاله ما درباره قالب محتوا برای جستجوی هوش مصنوعی آمده در این صفحهها دیده میشود.
چه چیزی را منتشر نمیکنیم و چرا
در این مقاله فهرست دامنه، درصد سهم یا یافتهای از نوع «اینقدر از برندهای ترک از آنجا استناد میشوند» وجود ندارد. تنها دلیلش این است که مجموعهداده راستیآزماییپذیری در مقیاس لازم برای حمل چنین ادعایی نداریم. با پروتکل بالا، مجموعهای صد پرامپتی، سه تکرار و دو موتور ششصد مشاهده تولید میکند؛ این برای تصمیمگیری درباره برند خودتان کافی است، اما برای ترسیم چشمانداز صنعت کافی نیست. ابزارهای تجاری که در مقیاس صنعت میسنجند وجود دارند؛ وقتی به آنها دسترسی پیدا کنیم یافتهها را با ذکر منبع و تاریخ در مقالهای جداگانه منتشر میکنیم. تا آن روز، اعداد جدول خودتان تنها اعداد واقعی هستند.
نتیجه
Perplexity در هر پاسخ منابع شمارهدار نشان میدهد و Gemini منابع را در صورت موجود بودن در پنل کناری باز میکند؛ در هر دو موتور برای دیدن اینکه کدام سایتها استناد میشوند به مجموعهداده تجمیعی نیاز ندارید. یک مجموعه prompt ثابت، یک پروتکل اجرای ثبتشده، دستهبندی منابع و جدول مقایسه رقبا، به شکل راستیآزماییپذیر نشان میدهد برندتان در کدام انواع منبع غایب است. تکرار ماهانه این سنجش و اولویتبندی کار محتوا و منابع بر اساس جدول، ستون فقرات خدمت مرئی بودن در جستجوی هوش مصنوعی ما است؛ این روش را با تیم خودتان هم میتوانید اجرا کنید.