
تحلیل قصد جستجو با اسکرپینگ گوگل و هوش مصنوعی Gemini
11 دقیقه مطالعه · منتشر شده ۱۴۰۵/۴/۲۸
دانلود workflow
فایل JSON آماده import در n8n — credentialها باید در n8n شما تنظیم شوند.
- فایل JSON را دانلود کنید.
- در n8n: Workflows → Import from File.
- Credentialهای هر node را متصل کنید.
- workflow را فعال کنید.
شناسه workflow: 6043 · منبع: کاتالوگ Axeto
تحلیل قصد جستجو برای کلمات کلیدی با استفاده از Google Scraping، Bright Data و Gemini AI
این گردش کار، تحلیل قصد جستجو را برای لیستی از کلمات کلیدی خودکار میکند. این گردش کار، نتایج جستجوی گوگل را از طریق Bright Data با طبقهبندی قصد مبتنی بر هوش مصنوعی با استفاده از Google Gemini AI و Langchain ادغام میکند. این ابزار برای تحلیلگران SEO، بازاریابان دیجیتال و استراتژیستهای محتوا که به دنبال درک قصد پشت نتایج برتر جستجو هستند، ایدهآل است.
این گردش کار و موارد دیگر را در کاتالوگ Axeto کاوش کنید: https://axeto.ai/n8n
تشریح گردش کار
این گردش کار به مراحل منطقی زیر تقسیم میشود:
1. ورودی: گردش کار را به صورت دستی راهاندازی کرده و کلمات کلیدی و کدهای کشور را از یک Google Sheet دریافت کنید.
2. خراشیدن جستجو: نتایج جستجوی گوگل را برای هر کلمه کلیدی با استفاده از SERP API شرکت Bright Data بازیابی کنید.
3. آمادهسازی داده: دادههای نتایج جستجوی خراشیده شده را فرمت و ساختاربندی کنید.
4. طبقهبندی قصد مبتنی بر هوش مصنوعی: قصد جستجوی هر صفحه رتبهبندی شده را با استفاده از Google Gemini AI طبقهبندی کنید.
5. تجمیع خروجی: دادههای طبقهبندی شده را ادغام کنید.
6. ذخیرهسازی نتایج: دادههای تحلیل شده، شامل برچسبهای قصد، را به یک Google Sheet اضافه کنید.
---
تحلیل گره به گره (Node Analysis)
این بخش به بررسی دقیق هر گره (Node) در گردش کار (Workflow) میپردازد.
۱. ورودی و راهانداز (Input & Trigger)
این بخش مسئول شروع گردش کار و دریافت دادههای اولیه است.
- گرهها (Nodes):
* When clicking ‘Execute workflow’ (راهانداز دستی - Manual Trigger)
* Get Keywords (Google Sheets)
* Loop Over Items (Split In Batches)
* set keyword (Set)
- جزئیات گرهها (Node Details):
* When clicking ‘Execute workflow’
* نوع (Type): راهانداز دستی (Manual Trigger)
* نقش (Role): اجرای گردش کار را آغاز میکند.
* پیکربندی (Configuration): پارامتر خاصی نیاز ندارد.
* ورودی/خروجی (Input/Output): ورودی ندارد؛ گره بعدی را راهاندازی میکند.
* Get Keywords
* نوع (Type): Google Sheets
* نقش (Role): کلمات کلیدی و کدهای کشور مربوطه را از یک صفحه گسترده Google Sheet میخواند.
* پیکربندی (Configuration): از سند (1QU9rwawCZLiYW8nlYYRMj-9OvAUNZoe2gP49KbozQqw) و صفحه (gid=0) مشخصی در Google Sheet میخواند. به اعتبارنامههای OAuth2 Google Sheets نیاز دارد.
* داده کلیدی (Key Data): ستونهای "Keyword" و "country code" را میخواند.
* ورودی (Input): توسط گره راهانداز دستی آغاز میشود.
* خروجی (Output): لیستی از کلمات کلیدی و کدهای کشور.
* مشکلات احتمالی (Potential Issues): خطاهای احراز هویت، صفحه خالی، محدودیتهای نرخ API.
* Loop Over Items
* نوع (Type): Split In Batches
* نقش (Role): هر کلمه کلیدی را به صورت جداگانه پردازش میکند تا محدودیتهای API را مدیریت کرده و پردازش متوالی را تضمین کند.
* پیکربندی (Configuration): به طور پیشفرض اندازه دسته (batch size) را روی یک مورد تنظیم میکند.
* ورودی (Input): لیست کلمات کلیدی و کدهای کشور از Get Keywords.
* خروجی (Output): یک جفت کلمه کلیدی-کشور برای هر تکرار.
* مشکلات احتمالی (Potential Issues): خطا در پردازش دستهای، لیست ورودی خالی.
* set keyword
* نوع (Type): Set
* نقش (Role): کلمه کلیدی و کد کشور را برای درخواست HTTP بعدی آماده میکند.
* پیکربندی (Configuration): دو فیلد را تنظیم میکند: search_term (از ستون "Keyword") و country code (از داده ورودی).
* ورودی (Input): یک جفت کلمه کلیدی-کشور از Loop Over Items.
* خروجی (Output): متغیرهایی را برای گره بعدی تنظیم میکند.
* مشکلات احتمالی (Potential Issues): فیلدهای "Keyword" یا "country code" در ورودی وجود ندارد.
---
۲. بازیابی نتایج جستجو (Search Results Retrieval)
این بخش دادههای صفحه نتایج موتور جستجوی گوگل (SERP) را دریافت میکند.
- گرهها (Nodes):
* Fetch Google Search Results JSON (HTTP Request)
* Split Out (Split Out)
- جزئیات گرهها (Node Details):
* Fetch Google Search Results JSON
* نوع (Type): HTTP Request
* نقش (Role): API Bright Data را برای استخراج نتایج جستجوی گوگل فراخوانی میکند.
* پیکربندی (Configuration):
* متد (Method): POST
* آدرس URL (URL): https://api.brightdata.com/request
* پارامترهای بدنه (Body Parameters): شامل zone (مانند serp_api1)، URL جستجوی ساخته شده با کلمه کلیدی و کد کشور، و format: raw.
* هدرها (Headers): از احراز هویت هدر HTTP با اعتبارنامههای Bright Data استفاده میکند. Accept: application/json را تنظیم میکند.
* پارامترهای کوئری (Query Parameters): async=true برای استخراج ناهمزمان.
* ورودی (Input): search_term و country code از set keyword.
* خروجی (Output): پاسخ خام JSON از API Bright Data.
* مشکلات احتمالی (Potential Issues): خطاهای احراز هویت، محدودیتهای نرخ API، مهلتهای زمانی شبکه، کدهای کشور نامعتبر، پاسخهای API نامفهوم.
* Split Out
* نوع (Type): Split Out
* نقش (Role): آرایه نتایج جستجوی organic را به موارد جداگانه برای پردازش بیشتر تقسیم میکند.
* پیکربندی (Configuration): دادهها را بر اساس فیلد organic از پاسخ JSON تقسیم میکند.
* ورودی (Input): پاسخ JSON از Fetch Google Search Results JSON.
* خروجی (Output): ورودیهای نتایج جستجوی ارگانیک (صفحات).
* مشکلات احتمالی (Potential Issues): فیلد organic ممکن است در پاسخ API وجود نداشته باشد یا خالی باشد.
---
۳. آمادهسازی دادهها (Data Preparation)
این مرحله دادههای استخراج شده را برای تحلیل هوش مصنوعی ساختاردهی میکند.
- گرهها (Nodes):
* format fields (Set)
- جزئیات گرهها (Node Details):
* format fields
* نوع (Type): Set
* نقش (Role): اطلاعات مرتبط را از هر نتیجه جستجو استخراج کرده و کلمه کلیدی اصلی را برای زمینه اضافه میکند.
* پیکربندی (Configuration): فیلدهای زیر را تنظیم میکند:
* Keyword: از متغیر کلمه کلیدی گردش کار.
* ranking page: از فیلد link نتیجه جستجو.
* title: از فیلد title.
* Meta description: از فیلد description.
* extensions: به عنوان یک رشته JSON از افزونههای اختیاری.
* position: از فیلد rank.
* ورودی (Input): یک مورد نتیجه جستجوی ارگانیک از Split Out.
* خروجی (Output): دادههای ساختاریافته آماده برای طبقهبندی هوش مصنوعی.
* مشکلات احتمالی (Potential Issues): فیلدهای از دست رفته (مانند link, title, description)، مقادیر null.
---
۴. طبقهبندی قصد مبتنی بر هوش مصنوعی (AI-based Intent Classification)
این بخش اصلی گردش کار است که در آن هوش مصنوعی قصد جستجو را تعیین میکند.
- گرهها (Nodes):
* Google Gemini Chat Model2 (Langchain Google Gemini Chat)
* Intent Classifier (Langchain Text Classifier)
* informational, Navigational, Commercial, Transactional, Mixed (گرههای Set)
- جزئیات گرهها (Node Details):
* Google Gemini Chat Model2
* نوع (Type): Langchain Google Gemini Chat
* نقش (Role): به عنوان رابط مدل هوش مصنوعی عمل کرده و متن را برای طبقهبندی پردازش میکند.
* پیکربندی (Configuration): به اعتبارنامههای API Google PaLM نیاز دارد.
* ورودی (Input): دادههای متنی که از گره Intent Classifier عبور میکنند.
* خروجی (Output): پاسخ طبقهبندی تولید شده توسط هوش مصنوعی.
* مشکلات احتمالی (Potential Issues): محدودیتهای نرخ API، اعتبارنامههای منقضی شده، خطاهای عمومی API.
* Intent Classifier
* نوع (Type): Langchain Text Classifier
* نقش (Role): دستهبندیهای قصد را تعریف کرده و از مدل هوش مصنوعی برای طبقهبندی متن ورودی استفاده میکند.
* پیکربندی (Configuration):
* متن ورودی (Input Text): Keyword, title, و Meta description را ترکیب میکند.
* دستهبندیها (Categories): پنج دسته قصد (اطلاعاتی، ناوبری، تجاری، تراکنشی، ترکیبی) را با توضیحات برای هوش مصنوعی تعریف میکند.
* ورودی (Input): دادههای ساختاریافته از format fields.
* خروجی (Output): نتیجه طبقهبندی شده را بر اساس قصد تعیین شده به یکی از پنج گره Set بعدی هدایت میکند.
* مشکلات احتمالی (Potential Issues): طبقهبندیهای مبهم توسط هوش مصنوعی، خطاهای پردازش هوش مصنوعی.
* informational, Navigational, Commercial, Transactional, Mixed
* نوع (Type): Set
* نقش (Role): یک برچسب رشتهای (intent) مطابق با دسته طبقهبندی شده اختصاص میدهد.
* پیکربندی (Configuration): هر گره فیلد intent را به نام دسته خاص خود (مانند "Informational") تنظیم میکند.
* ورودی (Input): از گره Intent Classifier بر اساس نتیجه طبقهبندی هدایت میشود.
* خروجی (Output): دادههای برچسبگذاری شده به گره Merge ارسال میشوند.
* مشکلات احتمالی (Potential Issues): معمولاً در صورت صحیح بودن مسیریابی، مشکلی انتظار نمیرود.
---
۵. تجمیع خروجی (Output Consolidation)
این مرحله نتایج را از شاخههای مختلف قصد گرد هم میآورد.
- گرهها (Nodes):
* Merge intents (Merge)
- جزئیات گرهها (Node Details):
* Merge intents
* نوع (Type): Merge
* نقش (Role): پنج جریان داده جداگانه (یکی برای هر دسته قصد) را به یک جریان خروجی واحد و یکپارچه ترکیب میکند.
* پیکربندی (Configuration): برای پذیرش ورودی از پنج گره Set قبلی پیکربندی شده است.
* ورودی (Input): جریانهای داده از گرههای informational, Navigational, Commercial, Transactional, و Mixed.
* خروجی (Output): یک جریان داده واحد و تجمیع شده آماده برای ذخیرهسازی.
* مشکلات احتمالی (Potential Issues): مشکلات همگامسازی جریان ورودی، اتصالات ورودی از دست رفته.
---
۶. ماندگاری نتایج (Results Persistence)
آخرین مرحله دادههای تحلیل شده را ذخیره میکند.
- گرهها (Nodes):
* append ranking result (Google Sheets)
- جزئیات گرهها (Node Details):
* append ranking result
* نوع (Type): Google Sheets
* نقش (Role): ردیفها را در یک تب مشخص Google Sheet با دادههای نتایج جستجوی تحلیل شده و قصد طبقهبندی شده آن، اضافه یا بهروزرسانی میکند.
* پیکربندی (Configuration):
* شناسه سند (Document ID): همانند برگه ورودی (1QU9rwawCZLiYW8nlYYRMj-9OvAUNZoe2gP49KbozQqw).
* نام برگه (Sheet Name): Sheet2 (GID 1031244896).
* عملیات (Operation): appendOrUpdate، با استفاده از ranking page به عنوان ستون کلید برای تطبیق.
* نگاشت ستون (Column Mapping): فیلدهای گردش کار (title, position, ranking page, Meta description, Keyword, extensions, intent) را به ستونهای Google Sheet نگاشت میکند.
* اعتبارنامهها (Credentials): از اعتبارنامههای OAuth2 Google Sheets استفاده میکند.
* ورودی (Input): جریان داده یکپارچه و برچسبگذاری شده از قصد از Merge intents.
* خروجی (Output): دادهها در Google Sheet مشخص شده اضافه یا بهروزرسانی میشوند.
* مشکلات احتمالی (Potential Issues): خطاهای احراز هویت، محدودیتهای نرخ API، تداخل در طول عملیات بهروزرسانی.
---
جدول خلاصه
| نام نود (Node Name) | نوع نود (Node Type) | نقش عملکردی (Functional Role) | نود(های) ورودی (Input Node(s)) | نود(های) خروجی (Output Node(s)) | یادداشت (Sticky Note) |
|---|---|---|---|---|---|
When clicking ‘Execute workflow’ | Manual Trigger | شروع دستی گردش کار | - | Get Keywords | |
Get Keywords | Google Sheets | خواندن کلمات کلیدی و کدهای کشور | When clicking ‘Execute workflow’ | Loop Over Items | - یک کپی از این G Sheet تهیه کنید - کلمات کلیدی مورد نظر خود را اضافه کنید |
Loop Over Items | Split In Batches | پردازش کلمات کلیدی یکی یکی | Get Keywords | set keyword | - ما هر آیتم را یکی یکی حلقه میکنیم |
set keyword | Set | نگاشت کلمه کلیدی و کد کشور | Loop Over Items | Fetch Google Search Results JSON | - کلمه کلیدی و کد کشور را نگاشت کنید - نام Zone را مطابق با Zone خود در Bright Data بهروز کنید - اسکرپر را اجرا کنید |
Fetch Google Search Results JSON | HTTP Request | اسکرپ کردن نتایج جستجوی گوگل از طریق Bright Data | set keyword | Split Out | |
Split Out | Split Out | تقسیم نتایج جستجوی ارگانیک | Fetch Google Search Results JSON | format fields | |
format fields | Set | استخراج و قالببندی دادههای نتایج جستجو | Split Out | Intent Classifier | |
Google Gemini Chat Model2 | Langchain Google Gemini Chat | پردازش هوش مصنوعی برای طبقهبندی متن | Intent Classifier | Intent Classifier | |
Intent Classifier | Langchain Text Classifier | طبقهبندی قصد جستجو | format fields, Google Gemini Chat Model2 | informational, Navigational, Commercial, Transactional, Mixed | |
informational | Set | اختصاص برچسب قصد 'Informational' | Intent Classifier | Merge intents | |
Navigational | Set | اختصاص برچسب قصد 'Navigational' | Intent Classifier | Merge intents | |
Commercial | Set | اختصاص برچسب قصد 'Commercial' | Intent Classifier | Merge intents | |
Transactional | Set | اختصاص برچسب قصد 'Transactional' | Intent Classifier | Merge intents | |
Mixed | Set | اختصاص برچسب قصد 'Mixed' | Intent Classifier | Merge intents | |
Merge intents | Merge | ادغام جریانهای قصد | informational, Navigational, Commercial, Transactional, Mixed | append ranking result | |
append ranking result | Google Sheets | افزودن نتایج به Google Sheet | Merge intents | - | - در صورت نیاز Sheet ID و GID را بهروز کنید |
Nodeهای استفادهشده
سوالات متداول
این گردش کار n8n چگونه قصد جستجو را تحلیل میکند؟▾
این گردش کار با استفاده از Bright Data نتایج جستجوی گوگل را برای کلمات کلیدی شما اسکرپ میکند و سپس با استفاده از هوش مصنوعی Google Gemini و Langchain، قصد هر صفحه رتبهبندی شده را طبقهبندی میکند.
چه ابزارهایی در این گردش کار استفاده شدهاند؟▾
ابزارهای اصلی شامل n8n، Bright Data (برای اسکرپینگ SERP)، Google Gemini AI و Langchain (برای طبقهبندی قصد) و Google Sheets (برای ورودی و خروجی دادهها) هستند.
این گردش کار برای چه کسانی مفید است؟▾
این گردش کار برای تحلیلگران سئو، بازاریابان دیجیتال، استراتژیستهای محتوا و هر کسی که نیاز به درک عمیقتر قصد کاربران پشت کلمات کلیدی دارد، بسیار مفید است.
workflowهای مرتبط
- طبقهبندی خودکار حوادث امنیتی با GPT-4 و Google SheetsSecOps
- دستهبندی خودکار ایمیل جیمیل با GPT-4o و هشدار SlackAI Summarization
- دستهبندی خودکار پستهای وبلاگ با هوش مصنوعی و گیتهابContent Creation
- تحلیل خودکار Google Analytics با هوش مصنوعی Gemini و اعلانه…Market Research
- خودکارسازی اصلاح نقطه پایانی با Wazuh، ClamAV و GPT-4SecOps
- تغییر نام خودکار گرههای n8n با هوش مصنوعیEngineering
