تحلیل استارتاپ‌های Crunchbase با Bright Data و Gemini AI

تحلیل استارتاپ‌های Crunchbase با Bright Data و Gemini AI

11 دقیقه مطالعه · منتشر شده ۱۴۰۵/۴/۲۹

دانلود workflow

فایل JSON آماده import در n8n — credentialها باید در n8n شما تنظیم شوند.

  1. فایل JSON را دانلود کنید.
  2. در n8n: Workflows → Import from File.
  3. Credentialهای هر node را متصل کنید.
  4. workflow را فعال کنید.

شناسه workflow: 4565 · منبع: کاتالوگ Axeto

تحلیل استارتاپ‌های Crunchbase بر اساس کلمه کلیدی با Bright Data، Gemini AI و Google Sheets

این گردش کار، تحلیل داده‌های استارتاپ‌های Crunchbase را بر اساس کلمه کلیدی ارائه شده توسط کاربر، خودکار می‌کند. این گردش کار از Bright Data برای بازیابی داده‌ها، Google Gemini AI برای تحلیل بینش‌گر و Google Sheets برای خروجی سازمان‌یافته استفاده می‌کند.

این گردش کار و موارد دیگر را در کاتالوگ Axeto کاوش کنید: https://axeto.ai/n8n

نمای کلی گردش کار

این گردش کار n8n فرآیند تحلیل داده‌های استارتاپ‌های Crunchbase را بر اساس کلمه کلیدی ارائه شده توسط کاربر، خودکار می‌کند. این گردش کار با API Bright Data ادغام می‌شود تا استارتاپ‌های مرتبط با کلمه کلیدی را کشف کند، وضعیت آماده بودن داده‌ها را بررسی می‌کند، داده‌های JSON بازیابی شده را پردازش و پاکسازی می‌کند، تحلیل مقایسه‌ای مبتنی بر هوش مصنوعی را با استفاده از Google Gemini انجام می‌دهد و در نهایت نتایج را به Google Sheets صادر می‌کند.

گردش کار به بلوک‌های منطقی زیر ساختار یافته است:

1. دریافت ورودی: کلمه کلیدی ورودی کاربر را از طریق یک فرم دریافت می‌کند.

2. بازیابی داده: شروع به دریافت داده از Bright Data می‌کند، تکمیل آن را بررسی می‌کند و داده‌های استارتاپ را بازیابی می‌کند.

3. پردازش داده: داده‌های استارتاپ بازیابی شده را تجزیه، پاکسازی و ساختاردهی می‌کند.

4. تجزیه و تحلیل هوش مصنوعی: تحلیل مقایسه‌ای را بر روی داده‌های استارتاپ با استفاده از Google Gemini AI انجام می‌دهد.

5. تجمیع و خروجی نتایج: داده‌های شرکت را با تحلیل هوش مصنوعی ادغام کرده و نتایج را به Google Sheets صادر می‌کند.

6. ابزار کمکی: شامل یک یادداشت چسبان برای راهنمایی در مورد سفارشی‌سازی کلیدهای JSON است.

---

تشریح گره‌ها (Node) به تفصیل

۱. دریافت ورودی

هدف: دریافت کلمه کلیدی جستجو از کاربر برای شروع گردش کار.

  • گره (Node): When User Completes Form

* نوع (Type): Form Trigger

* نقش (Role): به عنوان نقطه ورود عمل می‌کند و کلمه کلیدی مورد نظر کاربر را جمع‌آوری می‌کند.

* پیکربندی (Configuration):

* فرم با عنوان "جستجو از Crunchbase بر اساس کلمه کلیدی" با فیلد اجباری "کلمه کلیدی" (مثلاً "هوش مصنوعی در مراقبت‌های بهداشتی").

* شامل تشخیص ربات (bot detection).

* یک شناسه وب‌هوک (webhook ID) برای ارسال فرم خارجی اختصاص داده شده است.

* ورودی (Input): ارسال فرم توسط کاربر از طریق وب‌هوک.

* خروجی (Output): شیء JSON حاوی کلمه کلیدی وارد شده در $json["Keyword"].

* الزام نسخه (Version Requirement): v2.2

۲. بازیابی داده‌ها

هدف: واکشی داده‌های مرتبط استارتاپ از Bright Data بر اساس کلمه کلیدی ارائه شده.

  • گره (Node): HTTP Request - Post API call to Bright Data

* نوع (Type): HTTP Request (POST)

* نقش (Role): ارسال درخواست به API Bright Data برای شروع فرآیند کشف داده‌های استارتاپ‌های مطابق با کلمه کلیدی.

* پیکربندی (Configuration):

* URL: https://api.brightdata.com/datasets/v3/trigger

* متد (Method): POST

* هدرها (Headers): نیاز به توکن احراز هویت Bearer با کلید API Bright Data شما دارد (کلید YOUR_API_KEY را جایگزین کنید).

* پارامترهای کوئری (Query Parameters): gd_l1vijqt9jfj7olije (شناسه مجموعه داده)، discover_new (نوع درخواست)، keyword (روش کشف)، و گنجاندن خطا.

* بدنه (Body): به صورت پویا کلمه کلیدی را از ورودی فرم شامل می‌شود: ={{ $json["Keyword"] }}.

* ورودی (Input): کلمه کلیدی از تریگر فرم.

* خروجی (Output): JSON حاوی snapshot_id مورد نیاز برای نظرسنجی بعدی.

* نسخه (Version): 4.2

  • گره (Node): Wait - Polling Bright Data

* نوع (Type): Wait

* نقش (Role): توقف گردش کار برای ۱۵ ثانیه بین تلاش‌های نظرسنجی برای جلوگیری از بارگذاری بیش از حد API Bright Data.

* پیکربندی (Configuration): ۱۵ ثانیه صبر می‌کند. این گره برای اجرای چندین بار تا آماده شدن داده‌ها پیکربندی شده است.

* ورودی (Input): پس از درخواست API اولیه یا پس از شکست نظرسنجی فعال می‌شود.

* خروجی (Output): گره Snapshot Progress را فعال می‌کند.

* نسخه (Version): 1.1

  • گره (Node): Snapshot Progress

* نوع (Type): HTTP Request (GET)

* نقش (Role): بررسی وضعیت اسنپ‌شات جمع‌آوری داده با استفاده از API Bright Data.

* پیکربندی (Configuration):

* URL: به صورت پویا با استفاده از snapshot_id که قبلاً به دست آمده است، ساخته می‌شود.

* هدرها (Headers): شامل توکن احراز هویت Bearer است.

* ورودی (Input): snapshot_id از گره قبلی.

* خروجی (Output): پاسخ JSON حاوی status اسنپ‌شات (مثلاً "running"، "completed").

* نسخه (Version): 4.2

  • گره (Node): If - Checking status of Snapshot

* نوع (Type): If

* نقش (Role): به طور شرطی تعیین می‌کند که آیا برای ادامه نظرسنجی یا ادامه بازیابی داده بر اساس وضعیت اسنپ‌شات، باید ادامه داد یا خیر.

* پیکربندی (Configuration): بررسی می‌کند که آیا فیلد $json.status برابر با "running" است.

* ورودی (Input): خروجی از گره Snapshot Progress.

* خروجی (Output):

* شاخه True: به گره Wait - Polling Bright Data برای ادامه نظرسنجی بازمی‌گردد.

* شاخه False: به گره HTTP Request - Getting data from Bright Data ادامه می‌دهد.

* نسخه (Version): 2.2

  • گره (Node): HTTP Request - Getting data from Bright Data

* نوع (Type): HTTP Request (GET)

* نقش (Role): بازیابی داده‌های واقعی استارتاپ پس از اتمام جمع‌آوری اسنپ‌شات.

* پیکربندی (Configuration):

* URL: به صورت پویا snapshot_id را شامل می‌شود.

* پارامترهای کوئری (Query Parameters): فرمت داده را به JSON تنظیم می‌کند.

* هدرها (Headers): شامل توکن احراز هویت Bearer است.

* ورودی (Input): snapshot_id از گره‌های قبلی.

* خروجی (Output): داده‌های خام JSON استارتاپ‌های مطابق با کلمه کلیدی.

* نسخه (Version): 4.2

۳. پردازش داده‌ها

هدف: پاکسازی، ساختاردهی و آماده‌سازی داده‌های خام استارتاپ برای تجزیه و تحلیل.

  • گره (Node): Code - Parse and Clean JSON Data

* نوع (Type): Code (Python)

* نقش (Role): فیلتر کردن استارتاپ‌ها با تاریخ تأسیس معتبر، مرتب‌سازی آن‌ها بر اساس تاریخ به ترتیب نزولی، استخراج فیلدهای ضروری و آماده‌سازی ۱۰ شرکت برتر برای تجزیه و تحلیل هوش مصنوعی.

* پیکربندی (Configuration):

* از datetime پایتون برای اعتبارسنجی و مرتب‌سازی ورودی‌ها استفاده می‌کند.

* فیلدهایی مانند نام، تاریخ تأسیس، توضیحات، تعداد کارمندان، نوع شرکت، وضعیت IPO، وب‌سایت، کل بودجه، سرمایه‌گذاران، بنیان‌گذاران و یک جای‌نگهدار برای تجزیه و تحلیل هوش مصنوعی را استخراج می‌کند.

* یک آرایه از اشیاء JSON شرکت پاکسازی شده را برمی‌گرداند.

* ورودی (Input): داده‌های خام JSON از اسنپ‌شات Bright Data.

* خروجی (Output): یک آرایه JSON پاکسازی شده و ساختاریافته از داده‌های استارتاپ.

* نسخه (Version): 2

* یادداشت چسبان (Sticky Note): یادداشتی به این گره چسبانده شده است: "کلیدهای JSON را در کد تغییر دهید تا فقط فیلدهایی را که می‌خواهید شامل شوند، اضافه کنید. ساختار فعلی یک قالب نمونه است."

۴. تجزیه و تحلیل هوش مصنوعی

هدف: انجام تحلیل مقایسه‌ای داده‌های استارتاپ بازیابی شده با استفاده از Google Gemini AI.

  • گره (Node): Google Gemini Chat Model

* نوع (Type): Google Gemini AI Chat Model

* نقش (Role): ارائه رابطی به مدل هوش مصنوعی مکالمه‌ای Google Gemini.

* پیکربندی (Configuration): از مدل models/gemini-2.0-flash استفاده می‌کند.

* ورودی (Input): توسط داده‌های شرکت پردازش شده فعال می‌شود.

* خروجی (Output): خروجی از مدل چت، که به گره زنجیره بعدی منتقل می‌شود.

* نسخه (Version): 1

  • گره (Node): Google Gemini - Comparative Analysis

* نوع (Type): Chain LLM (Language Model Chain)

* نقش (Role): اجرای تحلیل هوش مصنوعی مبتنی بر پرامپت بر روی داده‌های شرکت پردازش شده.

* پیکربندی (Configuration):

* داده‌های JSON پاکسازی شده را به عنوان ورودی متنی دریافت می‌کند.

* پرامپت به هوش مصنوعی دستور می‌دهد تا تحلیل مقایسه‌ای را ارائه دهد و شباهت‌ها، تفاوت‌ها، دیدگاه‌ها و داده‌های پرت مرتبط با کلمه کلیدی کاربر را برجسته کند.

* شامل دستورالعمل‌هایی برای جلوگیری از شروع پاسخ با "Okay" است.

* ورودی (Input): داده‌های JSON پردازش شده از گره کد قبلی.

* خروجی (Output): تحلیل تولید شده توسط هوش مصنوعی به صورت متنی.

* نسخه (Version): 1.6

۵. تجمیع و خروجی نتایج

هدف: ترکیب داده‌های شرکت پردازش شده با تحلیل هوش مصنوعی و خروجی آن به Google Sheets.

  • گره (Node): Merge

* نوع (Type): Merge

* نقش (Role): ترکیب جریان داده‌های شرکت پاکسازی شده با نتایج تحلیل هوش مصنوعی.

* ورودی (Input):

* ورودی ۰: داده‌های شرکت پاکسازی شده.

* ورودی ۱: خروجی تحلیل هوش مصنوعی.

* خروجی (Output): یک جریان داده ترکیبی که به گره کد بعدی منتقل می‌شود.

* نسخه (Version): 3.1

  • گره (Node): Code - Combining JSON and AI outputs

* نوع (Type): Code (Python)

* نقش (Role): درج متن تحلیل هوش مصنوعی در فیلد ai_analysis اولین رکورد شرکت و برگرداندن آرایه غنی شده.

* پیکربندی (Configuration):

* حضور هر دو جریان ورودی را تأیید می‌کند؛ در صورت مفقود بودن هر کدام، خطا ایجاد می‌کند.

* متن تحلیل هوش مصنوعی را به اولین شیء شرکت در آرایه اضافه می‌کند.

* آرایه کامل اشیاء شرکت غنی شده را برای خروجی برمی‌گرداند.

* ورودی (Input):

* ورودی ۰: آرایه JSON شرکت‌های پاکسازی شده.

* ورودی ۱: متن تحلیل هوش مصنوعی.

* خروجی (Output): آرایه‌ای از اشیاء JSON شرکت، که اکنون شامل تحلیل هوش مصنوعی است.

* نسخه (Version): 2

  • گره (Node): Google Sheets - Export Results

* نوع (Type): Google Sheets

* نقش (Role): افزودن داده‌های استارتاپ غنی شده به یک سند Google Sheets مشخص شده.

* پیکربندی (Configuration):

* شناسه سند (Document ID) و نام برگه (Sheet Name) (مثلاً gid=0) مشخص شده‌اند.

* چندین فیلد شرکت (مانند name, founded, about, num_employees, type, ipo_status, full_description, social_media_links, website, funding_total, num_investors, lead_investors, founders, products_and_services, crunchbase_link) را به همراه متن ai_analysis نگاشت می‌کند.

* از حالت عملیات "Append" با نگاشت خودکار فعال استفاده می‌کند.

* ورودی (Input): آرایه غنی شده داده‌های شرکت.

* خروجی (Output): ندارد (اقدام خروجی نهایی).

* نسخه (Version): 4.3

۶. ابزار کمکی

هدف: ارائه راهنمایی مفید در ویرایشگر گردش کار.

  • گره (Node): Sticky Note

* نوع (Type): Sticky Note

* نقش (Role): به عنوان یک ابزار کمکی مستندسازی در ویرایشگر عمل می‌کند.

* محتوا (Content): "کلیدهای JSON را در کد تغییر دهید تا فقط فیلدهایی را که می‌خواهید شامل شوند، اضافه کنید. ساختار فعلی یک قالب نمونه است."

* موقعیت (Placement): نزدیک گره Code - Parse and Clean JSON Data قرار گرفته تا نقطه سفارشی‌سازی فیلدهای داده را برجسته کند.

---

جدول خلاصه

نام نود (Node Name)نوع نود (Node Type)نقش عملکردی (Functional Role)نود(های) ورودی (Input Node(s))نود(های) خروجی (Output Node(s))یادداشت چسبان (Sticky Note)
When User Completes FormForm Triggerدریافت ورودی کلیدواژه کاربر-HTTP Request - Post API call to Bright Data
HTTP Request - Post API call to Bright DataHTTP Request (POST)راه‌اندازی مجموعه داده Bright DataWhen User Completes FormWait - Polling Bright Data
Wait - Polling Bright DataWaitمکث و نظرسنجی برای آماده بودن اسنپ‌شاتHTTP Request - Post API call to Bright Data, If - Checking status of SnapshotSnapshot Progress
Snapshot ProgressHTTP Request (GET)بررسی وضعیت اسنپ‌شاتWait - Polling Bright DataIf - Checking status of Snapshot
If - Checking status of SnapshotIfبررسی شرطی وضعیت اسنپ‌شاتSnapshot ProgressWait - Polling Bright Data (True), HTTP Request - Getting data from Bright Data (False)
HTTP Request - Getting data from Bright DataHTTP Request (GET)دریافت داده‌های اسنپ‌شاتIf - Checking status of SnapshotCode - Parse and Clean JSON Data
Code - Parse and Clean JSON DataCode (Python)تجزیه، پاک‌سازی، مرتب‌سازی و ساختاردهی داده‌های استارتاپHTTP Request - Getting data from Bright DataMerge"کلیدهای JSON را در کد برای شامل کردن فقط فیلدهای مورد نظر خود تغییر دهید. ساختار فعلی یک قالب نمونه است"
Google Gemini Chat ModelGoogle Gemini AI Chat Modelرابط برای مدل Gemini AICode - Parse and Clean JSON DataGoogle Gemini - Comparative Analysis
Google Gemini - Comparative AnalysisChain LLMانجام تحلیل مقایسه‌ای مبتنی بر هوش مصنوعیGoogle Gemini Chat ModelMerge
MergeMergeترکیب داده‌های شرکت و تحلیل هوش مصنوعیCode - Parse and Clean JSON Data, Google Gemini - Comparative AnalysisCode - Combining JSON and AI outputs
Code - Combining JSON and AI outputsCode (Python)غنی‌سازی داده‌های شرکت با تحلیل هوش مصنوعیMergeGoogle Sheets - Export Results
Google Sheets - Export ResultsGoogle Sheetsخروجی دادن داده‌های غنی‌شده به Google SheetsCode - Combining JSON and AI outputs-

Nodeهای استفاده‌شده

سوالات متداول

این گردش کار چگونه داده‌های استارتاپ را جمع‌آوری می‌کند؟

این گردش کار از API Bright Data برای جستجو و جمع‌آوری داده‌های استارتاپ‌های مرتبط با کلمه کلیدی شما استفاده می‌کند.

نقش Gemini AI در این گردش کار چیست؟

Google Gemini AI برای انجام تحلیل‌های مقایسه‌ای و استخراج بینش‌های کلیدی از داده‌های استارتاپ جمع‌آوری شده به کار می‌رود.

نتایج تحلیل چگونه ارائه می‌شوند؟

نتایج تحلیل، شامل داده‌های استارتاپ و بینش‌های هوش مصنوعی، به صورت سازمان‌یافته در یک صفحه Google Sheets خروجی داده می‌شوند.

آیا می‌توان کلمات کلیدی جستجو را سفارشی کرد؟

بله، این گردش کار با یک فرم ورودی شروع می‌شود که به شما امکان می‌دهد کلمه کلیدی مورد نظر خود را برای جستجو در Crunchbase وارد کنید.

workflowهای مرتبط

این workflow در کاتالوگ Axeto.ai بایگانی شده است. لایسنس اصلی متعلق به سازنده workflow است.