
دستیار پرسش و پاسخ اسناد و وب با GPT-4o در n8n
7 دقیقه مطالعه · منتشر شده ۱۴۰۵/۴/۲۸
دانلود workflow
فایل JSON آماده import در n8n — credentialها باید در n8n شما تنظیم شوند.
- فایل JSON را دانلود کنید.
- در n8n: Workflows → Import from File.
- Credentialهای هر node را متصل کنید.
- workflow را فعال کنید.
شناسه workflow: 9651 · منبع: کاتالوگ Axeto
دستیار پرسش و پاسخ برای تحلیل اسناد و محتوای وب با GPT-4o
این گردش کار، "دستیار پرسش و پاسخ برای تحلیل اسناد و محتوای وب با GPT-4o"، به شما امکان میدهد تا با استفاده از زبان طبیعی، محتوای اسناد محلی یا صفحات وب را پرس و جو کنید. کافیست مسیر سند یا URL و سوال خود را ارائه دهید، و گردش کار اطلاعات مرتبط را استخراج کرده، پردازش میکند و از GPT-4o برای تولید پاسخی جامع فقط بر اساس محتوای ارائه شده استفاده میکند.
این روش برای استخراج سریع اطلاعات از PDF، اسناد Word، فایلهای Markdown، JSON، YAML یا هر صفحه وب بدون نیاز به خواندن دستی ایدهآل است.
نمای کلی گردش کار
گردش کار به چندین مرحله کلیدی ساختار یافته است:
1. دریافت و تجزیه ورودی: ورودی کاربر (مسیر سند/URL و سوال) را دریافت و فرمت آن را تأیید میکند.
2. تعیین نوع منبع: گردش کار را بر اساس اینکه ورودی یک فایل است یا URL، هدایت میکند.
3. بازیابی و استخراج محتوا: محتوا را از منبع مشخص شده دریافت میکند.
4. پردازش و پاکسازی محتوا: محتوا را برای تجزیه و تحلیل هوش مصنوعی با پاکسازی HTML، قالببندی و کوتاه کردن در صورت لزوم آماده میکند.
5. تجزیه و تحلیل و پرسش و پاسخ مبتنی بر هوش مصنوعی: از GPT-4o برای پاسخ به سوال کاربر بر اساس محتوای پردازش شده استفاده میکند.
6. فراداده و یادداشتهای زمینه: یادداشتهای چسبان برای اطلاعات گردش کار و نمای کلی خط لوله را شامل میشود.
جزئیات تفکیک شده
۱. دریافت و تجزیه ورودی
این بلوک اولیه مسئول دریافت و تأیید ورودی کاربر است.
- چت پرسش و پاسخ سند
* نوع: @n8n/n8n-nodes-langchain.chatTrigger
* نقش: به عنوان نقطه ورود وبهوک برای دریافت پیامهای چت عمل میکند.
* پیکربندی: از شناسه وبهوک simple-doc-analyzer-chat استفاده میکند.
* خروجی: رشته ورودی خام کاربر را ارائه میدهد.
- تجزیه سند و پرسش
* نوع: n8n-nodes-base.code (جاوا اسکریپت)
* نقش: رشته ورودی (فرمت مورد انتظار: مسیر_سند_یا_url|سوال_کاربر) را تجزیه میکند، مسیر سند/URL و سوال را تأیید میکند، نوع ورودی (url یا file) را تعیین میکند و نوع فایل را استنباط میکند.
* انواع فایل پشتیبانی شده: pdf, md, txt, doc, docx, json, yaml, yml.
* خروجی: شیء JSON حاوی documentPath, userQuestion, fileType, inputType, isUrl (بولین) و یک مُهر زمانی.
* مدیریت خطا: برای ورودیهای با فرمت نادرست یا پشتیبانی نشده، خطا ایجاد میکند.
۲. تعیین نوع منبع
منطق شرطی، گردش کار را بر اساس منبع ورودی هدایت میکند.
- بررسی مسیر فایل
* نوع: n8n-nodes-base.if
* نقش: بررسی میکند که آیا isUrl برابر با false است تا پردازش فایل محلی ادامه یابد.
- بررسی URL
* نوع: n8n-nodes-base.if
* نقش: بررسی میکند که آیا isUrl برابر با true است تا دریافت محتوای وب ادامه یابد.
۳. بازیابی و استخراج محتوا
این بلوک محتوا را از یک فایل محلی یا یک URL وب دریافت میکند.
- خواندن فایل سند
* نوع: n8n-nodes-base.readBinaryFile
* نقش: محتوای یک فایل محلی مشخص شده توسط documentPath را میخواند.
* ورودی: documentPath را از ورودی تجزیه شده دریافت میکند.
- دریافت محتوای وب
* نوع: n8n-nodes-base.httpRequest
* نقش: محتوا را از یک URL داده شده دریافت میکند.
* پیکربندی: به طور پویا از documentPath به عنوان URL استفاده میکند، با تنظیماتی برای مهلتها و تغییر مسیرها. هدرهای سفارشی برای شبیهسازی درخواستهای مرورگر را شامل میشود.
* خروجی: محتوای خام HTML یا متنی صفحه وب.
- استخراج محتوای سند
* نوع: n8n-nodes-base.extractFromFile
* نقش: متن ساده را از فرمتهای فایل باینری (مانند PDF، DOCX) که توسط گره Read Document File خوانده شده است، استخراج میکند.
* ورودی: دادههای فایل باینری را دریافت میکند.
* خروجی: محتوای متنی استخراج شده.
۴. پردازش و پاکسازی محتوا
این مرحله محتوای خام را برای مدل هوش مصنوعی آماده میکند.
- پردازش محتوای سند
* نوع: n8n-nodes-base.code (جاوا اسکریپت)
* نقش: محتوا را پاکسازی و قالببندی میکند. این شامل موارد زیر است:
* حذف تگهای HTML، اسکریپتها و استایلها از محتوای وب.
* جایگزینی مرزهای بلوک کد Markdown.
* قالببندی زیبای JSON.
* نرمالسازی فضای خالی.
* کوتاه کردن محتوا به حداکثر ۱۵۰۰۰ کاراکتر برای مدیریت محدودیتهای توکن هوش مصنوعی، با افزودن یک یادداشت در صورت کوتاه شدن.
* ورودی: محتوای متنی از Extract Document Content یا Fetch Web Content.
* خروجی: documentContent پاکسازی شده، contentLength و پرچم isContentTruncated.
* مدیریت خطا: در صورت خالی بودن یا کوتاه بودن محتوا پس از پردازش، خطا ایجاد میکند.
۵. تجزیه و تحلیل اسناد و پرسش و پاسخ مبتنی بر هوش مصنوعی
اینجاست که GPT-4o محتوا را تجزیه و تحلیل کرده و پاسخ را تولید میکند.
- تحلیلگر سند OpenAI
* نوع: @n8n/n8n-nodes-langchain.lmChatOpenAi
* نقش: دسترسی به مدل زبان GPT-4o OpenAI را فراهم میکند.
* پیکربندی: مدل روی gpt-4o تنظیم شده است. به اعتبارنامه API معتبر OpenAI نیاز دارد.
- تجزیه و تحلیل سند و پاسخ
* نوع: @n8n/n8n-nodes-langchain.agent
* نقش: تعامل هوش مصنوعی را هماهنگ میکند. از یک اعلان دقیق برای دستور دادن به GPT-4o استفاده میکند تا:
* خلاصه ای از محتوای ارائه شده را ارائه دهد.
به سوال خاص کاربر فقط* بر اساس محتوا پاسخ دهد.
* تجزیه و تحلیل و یادداشتهای مرتبط را ارائه دهد.
* پاسخ را به وضوح با سرصفحهها، لیستهای گلولهای و غیره قالببندی کند.
* ورودی: documentContent پاکسازی شده و userQuestion را دریافت میکند.
* خروجی: پاسخ نهایی و ساختار یافته تولید شده توسط GPT-4o.
* ملاحظات: کیفیت پاسخ به ارتباط و وضوح محتوا بستگی دارد. محتوای کوتاه شده ممکن است منجر به پاسخهای ناقص شود.
۶. یادداشتهای فراداده و زمینه
این گرهها اطلاعات مفیدی در مورد گردش کار ارائه میدهند.
- اطلاعات گردش کار
* نوع: n8n-nodes-base.stickyNote
* محتوا: هدف گردش کار، فرمت ورودی و قابلیتها را توصیف میکند.
- اطلاعات خط لوله
* نوع: n8n-nodes-base.stickyNote
* محتوا: مراحل اصلی پردازش گردش کار را تشریح میکند.
جدول خلاصه
| نام گره | نوع گره | نقش عملکردی | گره(های) ورودی | گره(های) خروجی |
|---|---|---|---|---|
| چت پرسش و پاسخ سند | @n8n/n8n-nodes-langchain.chatTrigger | ورودی کاربر را از طریق وبهوک دریافت میکند | هیچ کدام | تجزیه سند و پرسش |
| تجزیه سند و پرسش | n8n-nodes-base.code | ورودی را تجزیه و تأیید میکند، نوع منبع را تعیین میکند | چت پرسش و پاسخ سند | بررسی مسیر فایل، بررسی URL |
| بررسی مسیر فایل | n8n-nodes-base.if | جریان را برای پردازش فایل محلی هدایت میکند | تجزیه سند و پرسش | خواندن فایل سند |
| خواندن فایل سند | n8n-nodes-base.readBinaryFile | محتوای فایل محلی را میخواند | بررسی مسیر فایل | استخراج محتوای سند |
| استخراج محتوای سند | n8n-nodes-base.extractFromFile | متن را از اسناد باینری استخراج میکند | خواندن فایل سند | پردازش محتوای سند |
| بررسی URL | n8n-nodes-base.if | جریان را برای دریافت محتوای وب هدایت میکند | تجزیه سند و پرسش | دریافت محتوای وب |
| دریافت محتوای وب | n8n-nodes-base.httpRequest | محتوای صفحه وب را دریافت میکند | بررسی URL | پردازش محتوای سند |
| پردازش محتوای سند | n8n-nodes-base.code | محتوا را پاکسازی، قالببندی و کوتاه میکند | استخراج محتوای سند، دریافت محتوای وب | تحلیلگر سند OpenAI، تجزیه و تحلیل سند و پاسخ |
| تحلیلگر سند OpenAI | @n8n/n8n-nodes-langchain.lmChatOpenAi | دسترسی به مدل GPT-4o را فراهم میکند | پردازش محتوای سند | تجزیه و تحلیل سند و پاسخ |
| تجزیه و تحلیل سند و پاسخ | @n8n/n8n-nodes-langchain.agent | اعلان هوش مصنوعی را برای پرسش و پاسخ و تجزیه و تحلیل هماهنگ میکند | پردازش محتوای سند، تحلیلگر سند OpenAI | پاسخ نهایی هوش مصنوعی |
| اطلاعات گردش کار | n8n-nodes-base.stickyNote | فراداده و توضیحات گردش کار | هیچ کدام | هیچ کدام |
| اطلاعات خط لوله | n8n-nodes-base.stickyNote | نمای کلی مراحل گردش کار | هیچ کدام | هیچ کدام |
Nodeهای استفادهشده
سوالات متداول
این گردش کار n8n چه کاری انجام میدهد؟▾
این گردش کار به شما امکان میدهد تا با استفاده از زبان طبیعی، محتوای اسناد محلی (مانند PDF، DOCX) یا صفحات وب را پرس و جو کنید و پاسخهایی را از GPT-4o دریافت کنید که فقط بر اساس محتوای ارائه شده است.
چه فرمتهای فایلی پشتیبانی میشوند؟▾
این گردش کار از فرمتهای فایل PDF، MD، TXT، DOC، DOCX، JSON، YAML و YML پشتیبانی میکند.
آیا پاسخها فقط بر اساس محتوای ارائه شده هستند؟▾
بله، یکی از ویژگیهای کلیدی این گردش کار این است که GPT-4o پاسخها را *فقط* بر اساس محتوای اسناد یا وبسایت ارائه شده تولید میکند.
workflowهای مرتبط
- تحلیل خودکار مناقصهها با n8n، LlamaParse و GeminiDocument Extraction
- حذف خودکار اسپم جیمیل: گردش کار ماهانه n8nPersonal Productivity
- طبقهبندی خودکار حوادث امنیتی با GPT-4 و Google SheetsSecOps
- دستهبندی خودکار ایمیل جیمیل با GPT-4o و هشدار SlackAI Summarization
- دستهبندی خودکار پستهای وبلاگ با هوش مصنوعی و گیتهابContent Creation
- اتوماسیون زیرنویسگذاری ویدیو با n8n، Google Drive و SubmagicContent Creation
