پرش به محتوا
SEO Evaluate
مطالب مرتبط
سئو5 دقیقه مطالعه

تحقیق کلمات کلیدی گردشگری سلامت در 4 زبان

دام‌هایی که هنگام گردآوری پرس‌وجوهای بیماران به ترکی، انگلیسی، عربی و فارسی از خود زبان می‌آیند: پسوندها، گونه‌های حروف، ZWNJ و نویسه‌گردانی.

نوشته Roozbeh Nazari · CEO

تحقیق کلمات کلیدی گردشگری سلامت در 4 زبان

بخش دشوار تحقیق کلمات کلیدی در گردشگری سلامت این نیست که کدام کلمه بیشتر جست‌وجو می‌شود. بخش دشوار این است که همان بیمار همان چیز را در چهار زبان به شکل‌هایی می‌نویسد که هیچ شباهتی به هم ندارند و بیشتر این شکل‌ها هرگز در یک فهرست استاندارد نمی‌افتند. این نوشته دام‌هایی را که هنگام گردآوری پرس‌وجو برای ترکی، انگلیسی، عربی و فارسی از خود زبان می‌آیند و روش نرمال‌سازی آن‌ها را شرح می‌دهد.

سمت خوشه‌بندی و معماری صفحه را پیش‌تر در نوشتهٔ ترسیم نقشهٔ تقاضا در 4 زبان بررسی کرده بودیم؛ آنجا در سطح سبد بود. اینجا یک سطح پایین‌تر است: حالت‌های دستوری تک‌تک پرس‌وجوها. برای چارچوب اجرایی در سمت کلینیک می‌توانید به صفحهٔ کلینیک‌های ما نگاه کنید.

از همان ابتدا یک چیز را روشن بگوییم: در این نوشته هیچ رقمی از حجم جست‌وجو منتشر نمی‌شود. دادهٔ حجم بسته به ابزار، کشور و تاریخ سنجش تغییر می‌کند؛ نوشتن عددی که نتوانیم راستی‌آزمایی کنیم کاری جز ماندگار کردن یک عدد غلط نمی‌کند. آنچه شرح داده می‌شود روش گردآوری و نرمال‌سازی‌ای است که می‌توانید با ابزار خودتان تکرار کنید.

ترکی: پسوندها و افتادن حروف

چون ترکی زبانی پیوندی است، یک ریشهٔ واحد در کادر جست‌وجو به ده‌ها سطح پخش می‌شود. «saç ekimi»، «saç ekimi fiyatları»، «saç ekimi yaptıranlar» و «saç ektirmek» سطح‌های مختلف یک نیت واحدند و ابزار آن‌ها را به‌صورت ردیف‌های جداگانه می‌دهد. بدون گروه‌بندی بر پایهٔ ریشه، فهرست باد می‌کند و اولویت گم می‌شود.

دام دوم موذی‌تر است: بخش مهمی از کاربران بدون حروف ویژهٔ ترکی می‌نویسند. «sac ekimi»، «dis implant» و «goz ameliyati» پرس‌وجوهای واقعی‌اند. در مرحلهٔ گردآوری باید شکل با علامت و بی‌علامت را جداگانه پرسید و سپس به یک شکل استاندارد واحد فروکاست. حذف شکل بی‌علامت از فهرست، حذف بخشی از بیماران از فهرست است.

انگلیسی: زبان بیمار و زبان پزشک

در سمت انگلیسی دشواری دستوری نیست، واژگانی است. برای یک عمل واحد، اصطلاح پزشکی و زبان عامه کنار هم زندگی می‌کنند: «rhinoplasty» و «nose job»، «blepharoplasty» و «eyelid surgery»، «bariatric surgery» و «weight loss surgery». بیمار معمولاً زبان عامه را در کادر جست‌وجو می‌نویسد و کلینیک صفحه را با اصطلاح پزشکی می‌نویسد؛ این دو به هم نمی‌رسند.

به این، تفاوت املای منطقه‌ای هم اضافه می‌شود. تفاوت‌های املای بریتانیایی و آمریکایی در واژگان سلامت هم وجود دارد. ثابت کردن فهرست بر پایهٔ بازار هدف، هر کدام که باشد، بهتر از استفادهٔ درهم از هر دو است.

عربی: گونه‌های حروف و لهجه

در گردآوری عربی سه منبع جداگانه وجود دارد. اول حرکت‌ها: در متن ممکن است باشند یا نباشند و در پرس‌وجوها معمولاً نیستند. دوم نگارش‌های مختلف یک حرف: الف با همزه و بی‌همزه، یای پایانی در برابر الف مقصوره، تای گرد پایانی در برابر ه. این‌ها در سمت کاربر آزادانه عوض می‌شوند و ابزار آن‌ها را پرس‌وجوی جداگانه می‌شمارد.

سوم لهجه. بیماری که از خلیج می‌آید و بیماری که از مصر می‌آید ممکن است همان عمل را با کلمهٔ متفاوتی جست‌وجو کنند؛ یک فهرست واحد که به عربی معیار مدرن نوشته شده هیچ‌کدام را کامل پوشش نمی‌دهد. این موضوع را از سمت رفتار بیمار در نوشتهٔ سئوی عربی و رفتار جست‌وجوی خلیج بررسی کرده بودیم.

قاعدهٔ نرمال‌سازی ساده است: گردآوری گسترده، گروه‌بندی تنگ. گونه‌ها را جداگانه گرد آورید، به یک شکل استاندارد واحد پیوند بزنید و صفحه را بر پایهٔ شکل استاندارد بسازید. اعمال این قاعده از ابتدا بسیار ارزان‌تر از تمیز کردن فهرست در آینده است.

فارسی: همان الفبا، نقطه‌کدهای متفاوت

بیشترین چیزی که در فارسی از دست می‌رود از این می‌آید که به نظر می‌رسد همان الفبای عربی را به کار می‌برد. در واقع چنین نیست. حروف ی و ک در فارسی نقطه‌کدهایی متفاوت از معادل‌های عربی‌شان دارند؛ با چشم تشخیص داده نمی‌شوند، اما برای ماشین نویسه‌هایی کاملاً جداگانه‌اند. اگر در فهرست شما این دو قاطی شده باشند، یک کلمهٔ واحد به‌صورت دو ردیف جداگانه می‌ایستد و هیچ‌کدام دیگری را پیدا نمی‌کند.

موضوع دوم فاصلهٔ مجازی، یعنی ZWNJ است. در فارسی کلمات مرکب و برخی پسوندها با این نویسهٔ نامرئی جدا می‌شوند. بخشی از کاربران آن را می‌نویسند، بخشی فاصله می‌گذارند و بخشی هیچ چیز نمی‌گذارند. هر سه شکل پرس‌وجوی واقعی‌اند و هر سه ردیف جداگانه‌اند.

این دو موضوع فقط فهرست کلمات کلیدی را تحت تأثیر قرار نمی‌دهند، بلکه مستقیماً سمت اسلاگ و URL را هم تحت تأثیر قرار می‌دهند؛ معادل آن را در چک‌لیست سئوی فنی سایت‌های RTL بررسی می‌کنیم.

عربی و فارسی نوشته‌شده با حروف لاتین

این گروهی است که در فهرست‌های چهارزبانه بیش از همه از قلم می‌افتد. بخش مهمی از کاربران عرب‌زبان یا فارسی‌زبان، به‌ویژه روی صفحه‌کلید موبایل، پرس‌وجو را با حروف لاتین می‌نویسند. شکلی که پدید می‌آید نه انگلیسی است و نه نویسه‌گردانی استاندارد؛ نگارشی آزاد است که از کاربری به کاربر دیگر تغییر می‌کند و اعداد هم در آن با حروف قاطی می‌شوند.

این دو پیامد دارد. اول، این پرس‌وجوها در فهرست عربی دیده نمی‌شوند چون با حروف عربی نوشته نشده‌اند؛ در فهرست انگلیسی هم دیده نمی‌شوند چون کلمات انگلیسی نیستند. در یک جریان تحقیق استاندارد کاملاً گم می‌شوند. دوم، کاربری که با این پرس‌وجوها می‌آید دنبال محتوا به زبان هدف است؛ فرستادن او به صفحهٔ انگلیسی نیتش را برآورده نمی‌کند.

کاری که در سمت گردآوری می‌توان کرد این است که نگارش لاتین اصطلاح‌های اصلی زبان هدف را دستی تولید کنید، به‌صورت ردیف‌های جداگانه به فهرست اضافه کنید و آن‌ها را به شکل استاندارد در زبان هدف پیوند بزنید. این ردیف‌ها صفحهٔ جداگانه نمی‌خواهند؛ به هدف‌گیری صفحهٔ موجود اضافه می‌شوند.

وارونهٔ همین الگو در ترکی هم هست: کاربر عربی که با حروف لاتین می‌نویسد و کاربر ترکی که حروف ویژهٔ ترکی را به کار نمی‌برد، به دلایل متفاوت همان مشکل را تولید می‌کنند و هر دو با همان راه‌حل، یعنی پیوند زدن گونه به شکل استاندارد، حل می‌شوند.

جریان گردآوری و نرمال‌سازی

  • برای هر زبان نه ریشه‌ها، بلکه عبارت‌های کاملی را که بیمار می‌نویسد گرد آورید؛ گروه‌بندی ریشه‌ای گام بعدی است.
  • برای علامت، حرکت، گونهٔ حرف و ZWNJ جداگانه پرس‌وجو کنید؛ گونه را از فهرست پاک نکنید، به شکل استاندارد پیوند بزنید.
  • به هر ردیف برچسب نیت بدهید: جست‌وجوی اطلاعات، مقایسه، قیمت، نوبت. نوع صفحه از این برچسب بیرون می‌آید.
  • معادل یک نیت واحد را در چهار زبان در یک ردیف تطبیق دهید؛ ردیفی که تطبیق نمی‌شود، نیاز به صفحه‌ای جداگانه در آن زبان است.
  • فهرست چهار زبان را در یک جدول واحد نگه دارید؛ فایل‌های جداگانه با زمان از هم فاصله می‌گیرند.

تصمیم ساختار URL پیش از فهرست می‌آید

فهرست کلمات کلیدی تا معلوم نشود کدام زبان در کدام نشانی زندگی می‌کند به کار نمی‌آید. مستندات گوگل برای سایت‌های چندمنطقه‌ای و چندزبانه توصیه می‌کند برای هر نسخهٔ زبانی از URL جداگانه استفاده شود و رویکرد پارامتر URL را صریحاً توصیه نمی‌کند. همان سند می‌گوید از هدایت خودکار کاربر از یک نسخهٔ زبانی به نسخهٔ دیگر پرهیز کنید؛ اینکه چرا این مهم است را در نوشتهٔ ریدایرکت خودکار زبان به تفصیل آورده بودیم.

وقتی فهرست آماده شد، آخرین کار نوشتن این است که هر ردیف به کدام صفحه می‌رود. رها کردن ردیف تطبیق‌نشده به همان دری می‌رسد که انجام ندادن تحقیق. نگه داشتن این تطبیق در جدول، تنها راهی هم هست که شش ماه بعد بتوانید به پرسش «این صفحه چرا وجود دارد» پاسخ بدهید.

منابع

// تماس

بریف خود را بفرستید. بریف خود را برای ما بفرستید.

تماس آشنایی ما رایگان است. وقتی بریف شما به دستمان رسید، فرصت بازار و مهم‌ترین فرصت‌های رشد اولویت‌دار شما را نقشه‌برداری می‌کنیم.