دستیار پرسش و پاسخ اسناد و وب با GPT-4o در n8n

دستیار پرسش و پاسخ اسناد و وب با GPT-4o در n8n

7 دقیقه مطالعه · منتشر شده ۱۴۰۵/۴/۲۸

دانلود workflow

فایل JSON آماده import در n8n — credentialها باید در n8n شما تنظیم شوند.

  1. فایل JSON را دانلود کنید.
  2. در n8n: Workflows → Import from File.
  3. Credentialهای هر node را متصل کنید.
  4. workflow را فعال کنید.

شناسه workflow: 9651 · منبع: کاتالوگ Axeto

دستیار پرسش و پاسخ برای تحلیل اسناد و محتوای وب با GPT-4o

این گردش کار، "دستیار پرسش و پاسخ برای تحلیل اسناد و محتوای وب با GPT-4o"، به شما امکان می‌دهد تا با استفاده از زبان طبیعی، محتوای اسناد محلی یا صفحات وب را پرس و جو کنید. کافیست مسیر سند یا URL و سوال خود را ارائه دهید، و گردش کار اطلاعات مرتبط را استخراج کرده، پردازش می‌کند و از GPT-4o برای تولید پاسخی جامع فقط بر اساس محتوای ارائه شده استفاده می‌کند.

این روش برای استخراج سریع اطلاعات از PDF، اسناد Word، فایل‌های Markdown، JSON، YAML یا هر صفحه وب بدون نیاز به خواندن دستی ایده‌آل است.

نمای کلی گردش کار

گردش کار به چندین مرحله کلیدی ساختار یافته است:

1. دریافت و تجزیه ورودی: ورودی کاربر (مسیر سند/URL و سوال) را دریافت و فرمت آن را تأیید می‌کند.

2. تعیین نوع منبع: گردش کار را بر اساس اینکه ورودی یک فایل است یا URL، هدایت می‌کند.

3. بازیابی و استخراج محتوا: محتوا را از منبع مشخص شده دریافت می‌کند.

4. پردازش و پاکسازی محتوا: محتوا را برای تجزیه و تحلیل هوش مصنوعی با پاکسازی HTML، قالب‌بندی و کوتاه کردن در صورت لزوم آماده می‌کند.

5. تجزیه و تحلیل و پرسش و پاسخ مبتنی بر هوش مصنوعی: از GPT-4o برای پاسخ به سوال کاربر بر اساس محتوای پردازش شده استفاده می‌کند.

6. فراداده و یادداشت‌های زمینه: یادداشت‌های چسبان برای اطلاعات گردش کار و نمای کلی خط لوله را شامل می‌شود.

جزئیات تفکیک شده

۱. دریافت و تجزیه ورودی

این بلوک اولیه مسئول دریافت و تأیید ورودی کاربر است.

  • چت پرسش و پاسخ سند

* نوع: @n8n/n8n-nodes-langchain.chatTrigger

* نقش: به عنوان نقطه ورود وب‌هوک برای دریافت پیام‌های چت عمل می‌کند.

* پیکربندی: از شناسه وب‌هوک simple-doc-analyzer-chat استفاده می‌کند.

* خروجی: رشته ورودی خام کاربر را ارائه می‌دهد.

  • تجزیه سند و پرسش

* نوع: n8n-nodes-base.code (جاوا اسکریپت)

* نقش: رشته ورودی (فرمت مورد انتظار: مسیر_سند_یا_url|سوال_کاربر) را تجزیه می‌کند، مسیر سند/URL و سوال را تأیید می‌کند، نوع ورودی (url یا file) را تعیین می‌کند و نوع فایل را استنباط می‌کند.

* انواع فایل پشتیبانی شده: pdf, md, txt, doc, docx, json, yaml, yml.

* خروجی: شیء JSON حاوی documentPath, userQuestion, fileType, inputType, isUrl (بولین) و یک مُهر زمانی.

* مدیریت خطا: برای ورودی‌های با فرمت نادرست یا پشتیبانی نشده، خطا ایجاد می‌کند.

۲. تعیین نوع منبع

منطق شرطی، گردش کار را بر اساس منبع ورودی هدایت می‌کند.

  • بررسی مسیر فایل

* نوع: n8n-nodes-base.if

* نقش: بررسی می‌کند که آیا isUrl برابر با false است تا پردازش فایل محلی ادامه یابد.

  • بررسی URL

* نوع: n8n-nodes-base.if

* نقش: بررسی می‌کند که آیا isUrl برابر با true است تا دریافت محتوای وب ادامه یابد.

۳. بازیابی و استخراج محتوا

این بلوک محتوا را از یک فایل محلی یا یک URL وب دریافت می‌کند.

  • خواندن فایل سند

* نوع: n8n-nodes-base.readBinaryFile

* نقش: محتوای یک فایل محلی مشخص شده توسط documentPath را می‌خواند.

* ورودی: documentPath را از ورودی تجزیه شده دریافت می‌کند.

  • دریافت محتوای وب

* نوع: n8n-nodes-base.httpRequest

* نقش: محتوا را از یک URL داده شده دریافت می‌کند.

* پیکربندی: به طور پویا از documentPath به عنوان URL استفاده می‌کند، با تنظیماتی برای مهلت‌ها و تغییر مسیرها. هدرهای سفارشی برای شبیه‌سازی درخواست‌های مرورگر را شامل می‌شود.

* خروجی: محتوای خام HTML یا متنی صفحه وب.

  • استخراج محتوای سند

* نوع: n8n-nodes-base.extractFromFile

* نقش: متن ساده را از فرمت‌های فایل باینری (مانند PDF، DOCX) که توسط گره Read Document File خوانده شده است، استخراج می‌کند.

* ورودی: داده‌های فایل باینری را دریافت می‌کند.

* خروجی: محتوای متنی استخراج شده.

۴. پردازش و پاکسازی محتوا

این مرحله محتوای خام را برای مدل هوش مصنوعی آماده می‌کند.

  • پردازش محتوای سند

* نوع: n8n-nodes-base.code (جاوا اسکریپت)

* نقش: محتوا را پاکسازی و قالب‌بندی می‌کند. این شامل موارد زیر است:

* حذف تگ‌های HTML، اسکریپت‌ها و استایل‌ها از محتوای وب.

* جایگزینی مرزهای بلوک کد Markdown.

* قالب‌بندی زیبای JSON.

* نرمال‌سازی فضای خالی.

* کوتاه کردن محتوا به حداکثر ۱۵۰۰۰ کاراکتر برای مدیریت محدودیت‌های توکن هوش مصنوعی، با افزودن یک یادداشت در صورت کوتاه شدن.

* ورودی: محتوای متنی از Extract Document Content یا Fetch Web Content.

* خروجی: documentContent پاکسازی شده، contentLength و پرچم isContentTruncated.

* مدیریت خطا: در صورت خالی بودن یا کوتاه بودن محتوا پس از پردازش، خطا ایجاد می‌کند.

۵. تجزیه و تحلیل اسناد و پرسش و پاسخ مبتنی بر هوش مصنوعی

اینجاست که GPT-4o محتوا را تجزیه و تحلیل کرده و پاسخ را تولید می‌کند.

  • تحلیلگر سند OpenAI

* نوع: @n8n/n8n-nodes-langchain.lmChatOpenAi

* نقش: دسترسی به مدل زبان GPT-4o OpenAI را فراهم می‌کند.

* پیکربندی: مدل روی gpt-4o تنظیم شده است. به اعتبارنامه API معتبر OpenAI نیاز دارد.

  • تجزیه و تحلیل سند و پاسخ

* نوع: @n8n/n8n-nodes-langchain.agent

* نقش: تعامل هوش مصنوعی را هماهنگ می‌کند. از یک اعلان دقیق برای دستور دادن به GPT-4o استفاده می‌کند تا:

* خلاصه ای از محتوای ارائه شده را ارائه دهد.

به سوال خاص کاربر فقط* بر اساس محتوا پاسخ دهد.

* تجزیه و تحلیل و یادداشت‌های مرتبط را ارائه دهد.

* پاسخ را به وضوح با سرصفحه‌ها، لیست‌های گلوله‌ای و غیره قالب‌بندی کند.

* ورودی: documentContent پاکسازی شده و userQuestion را دریافت می‌کند.

* خروجی: پاسخ نهایی و ساختار یافته تولید شده توسط GPT-4o.

* ملاحظات: کیفیت پاسخ به ارتباط و وضوح محتوا بستگی دارد. محتوای کوتاه شده ممکن است منجر به پاسخ‌های ناقص شود.

۶. یادداشت‌های فراداده و زمینه

این گره‌ها اطلاعات مفیدی در مورد گردش کار ارائه می‌دهند.

  • اطلاعات گردش کار

* نوع: n8n-nodes-base.stickyNote

* محتوا: هدف گردش کار، فرمت ورودی و قابلیت‌ها را توصیف می‌کند.

  • اطلاعات خط لوله

* نوع: n8n-nodes-base.stickyNote

* محتوا: مراحل اصلی پردازش گردش کار را تشریح می‌کند.

جدول خلاصه

نام گرهنوع گرهنقش عملکردیگره(های) ورودیگره(های) خروجی
چت پرسش و پاسخ سند@n8n/n8n-nodes-langchain.chatTriggerورودی کاربر را از طریق وب‌هوک دریافت می‌کندهیچ کدامتجزیه سند و پرسش
تجزیه سند و پرسشn8n-nodes-base.codeورودی را تجزیه و تأیید می‌کند، نوع منبع را تعیین می‌کندچت پرسش و پاسخ سندبررسی مسیر فایل، بررسی URL
بررسی مسیر فایلn8n-nodes-base.ifجریان را برای پردازش فایل محلی هدایت می‌کندتجزیه سند و پرسشخواندن فایل سند
خواندن فایل سندn8n-nodes-base.readBinaryFileمحتوای فایل محلی را می‌خواندبررسی مسیر فایلاستخراج محتوای سند
استخراج محتوای سندn8n-nodes-base.extractFromFileمتن را از اسناد باینری استخراج می‌کندخواندن فایل سندپردازش محتوای سند
بررسی URLn8n-nodes-base.ifجریان را برای دریافت محتوای وب هدایت می‌کندتجزیه سند و پرسشدریافت محتوای وب
دریافت محتوای وبn8n-nodes-base.httpRequestمحتوای صفحه وب را دریافت می‌کندبررسی URLپردازش محتوای سند
پردازش محتوای سندn8n-nodes-base.codeمحتوا را پاکسازی، قالب‌بندی و کوتاه می‌کنداستخراج محتوای سند، دریافت محتوای وبتحلیلگر سند OpenAI، تجزیه و تحلیل سند و پاسخ
تحلیلگر سند OpenAI@n8n/n8n-nodes-langchain.lmChatOpenAiدسترسی به مدل GPT-4o را فراهم می‌کندپردازش محتوای سندتجزیه و تحلیل سند و پاسخ
تجزیه و تحلیل سند و پاسخ@n8n/n8n-nodes-langchain.agentاعلان هوش مصنوعی را برای پرسش و پاسخ و تجزیه و تحلیل هماهنگ می‌کندپردازش محتوای سند، تحلیلگر سند OpenAIپاسخ نهایی هوش مصنوعی
اطلاعات گردش کارn8n-nodes-base.stickyNoteفراداده و توضیحات گردش کارهیچ کدامهیچ کدام
اطلاعات خط لولهn8n-nodes-base.stickyNoteنمای کلی مراحل گردش کارهیچ کدامهیچ کدام

Nodeهای استفاده‌شده

سوالات متداول

این گردش کار n8n چه کاری انجام می‌دهد؟

این گردش کار به شما امکان می‌دهد تا با استفاده از زبان طبیعی، محتوای اسناد محلی (مانند PDF، DOCX) یا صفحات وب را پرس و جو کنید و پاسخ‌هایی را از GPT-4o دریافت کنید که فقط بر اساس محتوای ارائه شده است.

چه فرمت‌های فایلی پشتیبانی می‌شوند؟

این گردش کار از فرمت‌های فایل PDF، MD، TXT، DOC، DOCX، JSON، YAML و YML پشتیبانی می‌کند.

آیا پاسخ‌ها فقط بر اساس محتوای ارائه شده هستند؟

بله، یکی از ویژگی‌های کلیدی این گردش کار این است که GPT-4o پاسخ‌ها را *فقط* بر اساس محتوای اسناد یا وب‌سایت ارائه شده تولید می‌کند.

workflowهای مرتبط

این workflow در کاتالوگ Axeto.ai بایگانی شده است. لایسنس اصلی متعلق به سازنده workflow است.