تحلیل قصد جستجو با اسکرپینگ گوگل و هوش مصنوعی Gemini

تحلیل قصد جستجو با اسکرپینگ گوگل و هوش مصنوعی Gemini

11 دقیقه مطالعه · منتشر شده ۱۴۰۵/۴/۲۸

دانلود workflow

فایل JSON آماده import در n8n — credentialها باید در n8n شما تنظیم شوند.

  1. فایل JSON را دانلود کنید.
  2. در n8n: Workflows → Import from File.
  3. Credentialهای هر node را متصل کنید.
  4. workflow را فعال کنید.

شناسه workflow: 6043 · منبع: کاتالوگ Axeto

تحلیل قصد جستجو برای کلمات کلیدی با استفاده از Google Scraping، Bright Data و Gemini AI

این گردش کار، تحلیل قصد جستجو را برای لیستی از کلمات کلیدی خودکار می‌کند. این گردش کار، نتایج جستجوی گوگل را از طریق Bright Data با طبقه‌بندی قصد مبتنی بر هوش مصنوعی با استفاده از Google Gemini AI و Langchain ادغام می‌کند. این ابزار برای تحلیلگران SEO، بازاریابان دیجیتال و استراتژیست‌های محتوا که به دنبال درک قصد پشت نتایج برتر جستجو هستند، ایده‌آل است.

این گردش کار و موارد دیگر را در کاتالوگ Axeto کاوش کنید: https://axeto.ai/n8n

تشریح گردش کار

این گردش کار به مراحل منطقی زیر تقسیم می‌شود:

1. ورودی: گردش کار را به صورت دستی راه‌اندازی کرده و کلمات کلیدی و کدهای کشور را از یک Google Sheet دریافت کنید.

2. خراشیدن جستجو: نتایج جستجوی گوگل را برای هر کلمه کلیدی با استفاده از SERP API شرکت Bright Data بازیابی کنید.

3. آماده‌سازی داده: داده‌های نتایج جستجوی خراشیده شده را فرمت و ساختاربندی کنید.

4. طبقه‌بندی قصد مبتنی بر هوش مصنوعی: قصد جستجوی هر صفحه رتبه‌بندی شده را با استفاده از Google Gemini AI طبقه‌بندی کنید.

5. تجمیع خروجی: داده‌های طبقه‌بندی شده را ادغام کنید.

6. ذخیره‌سازی نتایج: داده‌های تحلیل شده، شامل برچسب‌های قصد، را به یک Google Sheet اضافه کنید.

---

تحلیل گره به گره (Node Analysis)

این بخش به بررسی دقیق هر گره (Node) در گردش کار (Workflow) می‌پردازد.

۱. ورودی و راه‌انداز (Input & Trigger)

این بخش مسئول شروع گردش کار و دریافت داده‌های اولیه است.

  • گره‌ها (Nodes):

* When clicking ‘Execute workflow’ (راه‌انداز دستی - Manual Trigger)

* Get Keywords (Google Sheets)

* Loop Over Items (Split In Batches)

* set keyword (Set)

  • جزئیات گره‌ها (Node Details):

* When clicking ‘Execute workflow’

* نوع (Type): راه‌انداز دستی (Manual Trigger)

* نقش (Role): اجرای گردش کار را آغاز می‌کند.

* پیکربندی (Configuration): پارامتر خاصی نیاز ندارد.

* ورودی/خروجی (Input/Output): ورودی ندارد؛ گره بعدی را راه‌اندازی می‌کند.

* Get Keywords

* نوع (Type): Google Sheets

* نقش (Role): کلمات کلیدی و کدهای کشور مربوطه را از یک صفحه گسترده Google Sheet می‌خواند.

* پیکربندی (Configuration): از سند (1QU9rwawCZLiYW8nlYYRMj-9OvAUNZoe2gP49KbozQqw) و صفحه (gid=0) مشخصی در Google Sheet می‌خواند. به اعتبارنامه‌های OAuth2 Google Sheets نیاز دارد.

* داده کلیدی (Key Data): ستون‌های "Keyword" و "country code" را می‌خواند.

* ورودی (Input): توسط گره راه‌انداز دستی آغاز می‌شود.

* خروجی (Output): لیستی از کلمات کلیدی و کدهای کشور.

* مشکلات احتمالی (Potential Issues): خطاهای احراز هویت، صفحه خالی، محدودیت‌های نرخ API.

* Loop Over Items

* نوع (Type): Split In Batches

* نقش (Role): هر کلمه کلیدی را به صورت جداگانه پردازش می‌کند تا محدودیت‌های API را مدیریت کرده و پردازش متوالی را تضمین کند.

* پیکربندی (Configuration): به طور پیش‌فرض اندازه دسته (batch size) را روی یک مورد تنظیم می‌کند.

* ورودی (Input): لیست کلمات کلیدی و کدهای کشور از Get Keywords.

* خروجی (Output): یک جفت کلمه کلیدی-کشور برای هر تکرار.

* مشکلات احتمالی (Potential Issues): خطا در پردازش دسته‌ای، لیست ورودی خالی.

* set keyword

* نوع (Type): Set

* نقش (Role): کلمه کلیدی و کد کشور را برای درخواست HTTP بعدی آماده می‌کند.

* پیکربندی (Configuration): دو فیلد را تنظیم می‌کند: search_term (از ستون "Keyword") و country code (از داده ورودی).

* ورودی (Input): یک جفت کلمه کلیدی-کشور از Loop Over Items.

* خروجی (Output): متغیرهایی را برای گره بعدی تنظیم می‌کند.

* مشکلات احتمالی (Potential Issues): فیلدهای "Keyword" یا "country code" در ورودی وجود ندارد.

---

۲. بازیابی نتایج جستجو (Search Results Retrieval)

این بخش داده‌های صفحه نتایج موتور جستجوی گوگل (SERP) را دریافت می‌کند.

  • گره‌ها (Nodes):

* Fetch Google Search Results JSON (HTTP Request)

* Split Out (Split Out)

  • جزئیات گره‌ها (Node Details):

* Fetch Google Search Results JSON

* نوع (Type): HTTP Request

* نقش (Role): API Bright Data را برای استخراج نتایج جستجوی گوگل فراخوانی می‌کند.

* پیکربندی (Configuration):

* متد (Method): POST

* آدرس URL (URL): https://api.brightdata.com/request

* پارامترهای بدنه (Body Parameters): شامل zone (مانند serp_api1)، URL جستجوی ساخته شده با کلمه کلیدی و کد کشور، و format: raw.

* هدرها (Headers): از احراز هویت هدر HTTP با اعتبارنامه‌های Bright Data استفاده می‌کند. Accept: application/json را تنظیم می‌کند.

* پارامترهای کوئری (Query Parameters): async=true برای استخراج ناهمزمان.

* ورودی (Input): search_term و country code از set keyword.

* خروجی (Output): پاسخ خام JSON از API Bright Data.

* مشکلات احتمالی (Potential Issues): خطاهای احراز هویت، محدودیت‌های نرخ API، مهلت‌های زمانی شبکه، کدهای کشور نامعتبر، پاسخ‌های API نامفهوم.

* Split Out

* نوع (Type): Split Out

* نقش (Role): آرایه نتایج جستجوی organic را به موارد جداگانه برای پردازش بیشتر تقسیم می‌کند.

* پیکربندی (Configuration): داده‌ها را بر اساس فیلد organic از پاسخ JSON تقسیم می‌کند.

* ورودی (Input): پاسخ JSON از Fetch Google Search Results JSON.

* خروجی (Output): ورودی‌های نتایج جستجوی ارگانیک (صفحات).

* مشکلات احتمالی (Potential Issues): فیلد organic ممکن است در پاسخ API وجود نداشته باشد یا خالی باشد.

---

۳. آماده‌سازی داده‌ها (Data Preparation)

این مرحله داده‌های استخراج شده را برای تحلیل هوش مصنوعی ساختاردهی می‌کند.

  • گره‌ها (Nodes):

* format fields (Set)

  • جزئیات گره‌ها (Node Details):

* format fields

* نوع (Type): Set

* نقش (Role): اطلاعات مرتبط را از هر نتیجه جستجو استخراج کرده و کلمه کلیدی اصلی را برای زمینه اضافه می‌کند.

* پیکربندی (Configuration): فیلدهای زیر را تنظیم می‌کند:

* Keyword: از متغیر کلمه کلیدی گردش کار.

* ranking page: از فیلد link نتیجه جستجو.

* title: از فیلد title.

* Meta description: از فیلد description.

* extensions: به عنوان یک رشته JSON از افزونه‌های اختیاری.

* position: از فیلد rank.

* ورودی (Input): یک مورد نتیجه جستجوی ارگانیک از Split Out.

* خروجی (Output): داده‌های ساختاریافته آماده برای طبقه‌بندی هوش مصنوعی.

* مشکلات احتمالی (Potential Issues): فیلدهای از دست رفته (مانند link, title, description)، مقادیر null.

---

۴. طبقه‌بندی قصد مبتنی بر هوش مصنوعی (AI-based Intent Classification)

این بخش اصلی گردش کار است که در آن هوش مصنوعی قصد جستجو را تعیین می‌کند.

  • گره‌ها (Nodes):

* Google Gemini Chat Model2 (Langchain Google Gemini Chat)

* Intent Classifier (Langchain Text Classifier)

* informational, Navigational, Commercial, Transactional, Mixed (گره‌های Set)

  • جزئیات گره‌ها (Node Details):

* Google Gemini Chat Model2

* نوع (Type): Langchain Google Gemini Chat

* نقش (Role): به عنوان رابط مدل هوش مصنوعی عمل کرده و متن را برای طبقه‌بندی پردازش می‌کند.

* پیکربندی (Configuration): به اعتبارنامه‌های API Google PaLM نیاز دارد.

* ورودی (Input): داده‌های متنی که از گره Intent Classifier عبور می‌کنند.

* خروجی (Output): پاسخ طبقه‌بندی تولید شده توسط هوش مصنوعی.

* مشکلات احتمالی (Potential Issues): محدودیت‌های نرخ API، اعتبارنامه‌های منقضی شده، خطاهای عمومی API.

* Intent Classifier

* نوع (Type): Langchain Text Classifier

* نقش (Role): دسته‌بندی‌های قصد را تعریف کرده و از مدل هوش مصنوعی برای طبقه‌بندی متن ورودی استفاده می‌کند.

* پیکربندی (Configuration):

* متن ورودی (Input Text): Keyword, title, و Meta description را ترکیب می‌کند.

* دسته‌بندی‌ها (Categories): پنج دسته قصد (اطلاعاتی، ناوبری، تجاری، تراکنشی، ترکیبی) را با توضیحات برای هوش مصنوعی تعریف می‌کند.

* ورودی (Input): داده‌های ساختاریافته از format fields.

* خروجی (Output): نتیجه طبقه‌بندی شده را بر اساس قصد تعیین شده به یکی از پنج گره Set بعدی هدایت می‌کند.

* مشکلات احتمالی (Potential Issues): طبقه‌بندی‌های مبهم توسط هوش مصنوعی، خطاهای پردازش هوش مصنوعی.

* informational, Navigational, Commercial, Transactional, Mixed

* نوع (Type): Set

* نقش (Role): یک برچسب رشته‌ای (intent) مطابق با دسته طبقه‌بندی شده اختصاص می‌دهد.

* پیکربندی (Configuration): هر گره فیلد intent را به نام دسته خاص خود (مانند "Informational") تنظیم می‌کند.

* ورودی (Input): از گره Intent Classifier بر اساس نتیجه طبقه‌بندی هدایت می‌شود.

* خروجی (Output): داده‌های برچسب‌گذاری شده به گره Merge ارسال می‌شوند.

* مشکلات احتمالی (Potential Issues): معمولاً در صورت صحیح بودن مسیریابی، مشکلی انتظار نمی‌رود.

---

۵. تجمیع خروجی (Output Consolidation)

این مرحله نتایج را از شاخه‌های مختلف قصد گرد هم می‌آورد.

  • گره‌ها (Nodes):

* Merge intents (Merge)

  • جزئیات گره‌ها (Node Details):

* Merge intents

* نوع (Type): Merge

* نقش (Role): پنج جریان داده جداگانه (یکی برای هر دسته قصد) را به یک جریان خروجی واحد و یکپارچه ترکیب می‌کند.

* پیکربندی (Configuration): برای پذیرش ورودی از پنج گره Set قبلی پیکربندی شده است.

* ورودی (Input): جریان‌های داده از گره‌های informational, Navigational, Commercial, Transactional, و Mixed.

* خروجی (Output): یک جریان داده واحد و تجمیع شده آماده برای ذخیره‌سازی.

* مشکلات احتمالی (Potential Issues): مشکلات همگام‌سازی جریان ورودی، اتصالات ورودی از دست رفته.

---

۶. ماندگاری نتایج (Results Persistence)

آخرین مرحله داده‌های تحلیل شده را ذخیره می‌کند.

  • گره‌ها (Nodes):

* append ranking result (Google Sheets)

  • جزئیات گره‌ها (Node Details):

* append ranking result

* نوع (Type): Google Sheets

* نقش (Role): ردیف‌ها را در یک تب مشخص Google Sheet با داده‌های نتایج جستجوی تحلیل شده و قصد طبقه‌بندی شده آن، اضافه یا به‌روزرسانی می‌کند.

* پیکربندی (Configuration):

* شناسه سند (Document ID): همانند برگه ورودی (1QU9rwawCZLiYW8nlYYRMj-9OvAUNZoe2gP49KbozQqw).

* نام برگه (Sheet Name): Sheet2 (GID 1031244896).

* عملیات (Operation): appendOrUpdate، با استفاده از ranking page به عنوان ستون کلید برای تطبیق.

* نگاشت ستون (Column Mapping): فیلدهای گردش کار (title, position, ranking page, Meta description, Keyword, extensions, intent) را به ستون‌های Google Sheet نگاشت می‌کند.

* اعتبارنامه‌ها (Credentials): از اعتبارنامه‌های OAuth2 Google Sheets استفاده می‌کند.

* ورودی (Input): جریان داده یکپارچه و برچسب‌گذاری شده از قصد از Merge intents.

* خروجی (Output): داده‌ها در Google Sheet مشخص شده اضافه یا به‌روزرسانی می‌شوند.

* مشکلات احتمالی (Potential Issues): خطاهای احراز هویت، محدودیت‌های نرخ API، تداخل در طول عملیات به‌روزرسانی.

---

جدول خلاصه

نام نود (Node Name)نوع نود (Node Type)نقش عملکردی (Functional Role)نود(های) ورودی (Input Node(s))نود(های) خروجی (Output Node(s))یادداشت (Sticky Note)
When clicking ‘Execute workflow’Manual Triggerشروع دستی گردش کار-Get Keywords
Get KeywordsGoogle Sheetsخواندن کلمات کلیدی و کدهای کشورWhen clicking ‘Execute workflow’Loop Over Items- یک کپی از این G Sheet تهیه کنید - کلمات کلیدی مورد نظر خود را اضافه کنید
Loop Over ItemsSplit In Batchesپردازش کلمات کلیدی یکی یکیGet Keywordsset keyword- ما هر آیتم را یکی یکی حلقه می‌کنیم
set keywordSetنگاشت کلمه کلیدی و کد کشورLoop Over ItemsFetch Google Search Results JSON- کلمه کلیدی و کد کشور را نگاشت کنید - نام Zone را مطابق با Zone خود در Bright Data به‌روز کنید - اسکرپر را اجرا کنید
Fetch Google Search Results JSONHTTP Requestاسکرپ کردن نتایج جستجوی گوگل از طریق Bright Dataset keywordSplit Out
Split OutSplit Outتقسیم نتایج جستجوی ارگانیکFetch Google Search Results JSONformat fields
format fieldsSetاستخراج و قالب‌بندی داده‌های نتایج جستجوSplit OutIntent Classifier
Google Gemini Chat Model2Langchain Google Gemini Chatپردازش هوش مصنوعی برای طبقه‌بندی متنIntent ClassifierIntent Classifier
Intent ClassifierLangchain Text Classifierطبقه‌بندی قصد جستجوformat fields, Google Gemini Chat Model2informational, Navigational, Commercial, Transactional, Mixed
informationalSetاختصاص برچسب قصد 'Informational'Intent ClassifierMerge intents
NavigationalSetاختصاص برچسب قصد 'Navigational'Intent ClassifierMerge intents
CommercialSetاختصاص برچسب قصد 'Commercial'Intent ClassifierMerge intents
TransactionalSetاختصاص برچسب قصد 'Transactional'Intent ClassifierMerge intents
MixedSetاختصاص برچسب قصد 'Mixed'Intent ClassifierMerge intents
Merge intentsMergeادغام جریان‌های قصدinformational, Navigational, Commercial, Transactional, Mixedappend ranking result
append ranking resultGoogle Sheetsافزودن نتایج به Google SheetMerge intents-- در صورت نیاز Sheet ID و GID را به‌روز کنید

Nodeهای استفاده‌شده

سوالات متداول

این گردش کار n8n چگونه قصد جستجو را تحلیل می‌کند؟

این گردش کار با استفاده از Bright Data نتایج جستجوی گوگل را برای کلمات کلیدی شما اسکرپ می‌کند و سپس با استفاده از هوش مصنوعی Google Gemini و Langchain، قصد هر صفحه رتبه‌بندی شده را طبقه‌بندی می‌کند.

چه ابزارهایی در این گردش کار استفاده شده‌اند؟

ابزارهای اصلی شامل n8n، Bright Data (برای اسکرپینگ SERP)، Google Gemini AI و Langchain (برای طبقه‌بندی قصد) و Google Sheets (برای ورودی و خروجی داده‌ها) هستند.

این گردش کار برای چه کسانی مفید است؟

این گردش کار برای تحلیلگران سئو، بازاریابان دیجیتال، استراتژیست‌های محتوا و هر کسی که نیاز به درک عمیق‌تر قصد کاربران پشت کلمات کلیدی دارد، بسیار مفید است.

workflowهای مرتبط

این workflow در کاتالوگ Axeto.ai بایگانی شده است. لایسنس اصلی متعلق به سازنده workflow است.