تحلیل تصویر با OpenAI Vision و حفظ داده‌های باینری در n8n

تحلیل تصویر با OpenAI Vision و حفظ داده‌های باینری در n8n

7 دقیقه مطالعه · منتشر شده ۱۴۰۵/۴/۲۸

دانلود workflow

فایل JSON آماده import در n8n — credentialها باید در n8n شما تنظیم شوند.

  1. فایل JSON را دانلود کنید.
  2. در n8n: Workflows → Import from File.
  3. Credentialهای هر node را متصل کنید.
  4. workflow را فعال کنید.

شناسه workflow: 8867 · منبع: کاتالوگ Axeto

تحلیل تصاویر با OpenAI Vision و حفظ داده‌های باینری

این گردش کار نحوه آپلود یک تصویر از طریق فرم وب، تحلیل آن با استفاده از OpenAI Vision و مهم‌تر از همه، حفظ داده‌های باینری اصلی برای پردازش‌های بعدی را نشان می‌دهد. این اطمینان حاصل می‌کند که می‌توانید چندین تحلیل هوش مصنوعی یا عملیات دیگر را روی همان تصویر بدون نیاز به آپلود مجدد انجام دهید.

دسته‌بندی‌ها: تولید محتوا، هوش مصنوعی چندوجهی

کاتالوگ Axeto: گردش کارهای n8n

---

نمای کلی گردش کار

این گردش کار برای موارد زیر طراحی شده است:

1. دریافت آپلودهای تصویر: دریافت فایل‌های تصویری ارسال شده از طریق یک فرم وب کاربرپسند.

2. تحلیل تصویر با OpenAI Vision: پردازش تصویر آپلود شده با استفاده از قابلیت‌های پیشرفته بینایی OpenAI برای استخراج توضیحات متنی و بینش‌ها.

3. حفظ و ادغام داده‌ها: ترکیب داده‌های باینری اصلی تصویر با نتایج تحلیل هوش مصنوعی.

4. انجام تحلیل هوش مصنوعی بیشتر: استفاده از یک عامل هوش مصنوعی برای تحلیل مجدد تصویر با استفاده از داده‌های اصلی و تحلیل اولیه، که امکان اعتبارسنجی یا بینش‌های گسترده‌تر را فراهم می‌کند.

این تنظیم برای سناریوهایی که نیاز به درک دقیق تصویر دارند و در عین حال دسترسی به داده‌های خام تصویر را حفظ می‌کنند، ایده‌آل است، مانند پردازش خودکار اسناد، تعدیل محتوا، یا خطوط لوله اعتبارسنجی داده‌های بصری.

---

تشریح گام به گام

۱. ورودی و دریافت تصویر

این بخش تعامل اولیه کاربر را مدیریت می‌کند و به آن‌ها اجازه می‌دهد فایل تصویر را آپلود کنند.

  • Node: Form Trigger1

* Type: n8n-nodes-base.formTrigger

* نقش: به عنوان یک نقطه پایانی وب‌هوک عمل می‌کند و یک فرم وب برای ارسال داده‌ها توسط کاربران ارائه می‌دهد.

* پیکربندی:

* Path: یک مسیر URL منحصر به فرد برای دسترسی به فرم.

* Form Title: "Image Document Upload"

* Form Description: "Upload a image document for AI analysis"

* Form Fields: یک فیلد آپلود فایل واحد به نام data.

* خروجی: فایل تصویر آپلود شده در فرمت باینری، که از طریق فیلد data قابل دسترسی است.

* مشکلات احتمالی: خطاهای آپلود فایل، تجاوز از محدودیت‌های اندازه، انواع فایل‌های پشتیبانی نشده، مشکلات اتصال وب‌هوک.

۲. تحلیل تصویر با هوش مصنوعی

این بخش تصویر آپلود شده را برای تحلیل به OpenAI Vision ارسال می‌کند.

  • Node: Analyze image

* Type: @n8n/n8n-nodes-langchain.openAi (به طور خاص برای تحلیل تصویر پیکربندی شده است)

* نقش: از مدل Vision OpenAI برای تفسیر محتوای تصویر استفاده می‌کند.

* پیکربندی:

* Model: gpt-4o (یا یک نوع مشابه GPT-4O)

* Resource: image

* Operation: analyze

* Input Type: base64 (داده‌های تصویر در این فرمت انتظار می‌رود)

* Text parameter: روی =data تنظیم شده است تا به داده‌های تصویر کدگذاری شده base64 از گره Form Trigger1 ارجاع دهد.

* اعتبارنامه‌ها: نیاز به اعتبارنامه‌های API OpenAI (به عنوان مثال، "OpenAi account 4").

* خروجی: تحلیل متنی محتوای تصویر.

* مشکلات احتمالی: خرابی احراز هویت API، محدودیت نرخ، کدگذاری base64 نامعتبر، فرمت‌های تصویر پشتیبانی نشده، مهلت زمانی شبکه.

۳. ادغام داده‌ها و پردازش پیشرفته هوش مصنوعی

این بخش اصلی برای حفظ داده‌ها و فعال کردن تحلیل‌های بیشتر است.

  • Nodes: Merge1, AI Agent, OpenAI Chat Model

* Node: Merge1

* Type: n8n-nodes-base.merge

* نقش: خروجی تحلیل تصویر را با داده‌های باینری اصلی تصویر ترکیب می‌کند.

* پیکربندی:

* Mode: combine

* Combine By: combineByPosition - این تنظیم حیاتی تضمین می‌کند که نتیجه تحلیل و داده‌های باینری اصلی بر اساس ترتیب ورود آن‌ها به درستی جفت می‌شوند.

* ورودی‌ها:

1. خروجی از Analyze image (نتیجه تحلیل).

2. خروجی از Form Trigger1 (داده‌های باینری اصلی تصویر).

* خروجی: یک ساختار داده ادغام شده شامل فیلد data اصلی و فیلد content از تحلیل.

* مشکلات احتمالی: عدم تطابق داده‌های ورودی، ورودی‌های گمشده.

* Node: AI Agent

* Type: @n8n/n8n-nodes-langchain.agent

* نقش: به عنوان یک عامل هوشمند عمل می‌کند که می‌تواند دستورالعمل‌های پیچیده را با استفاده از یک مدل زبان پردازش کند.

* پیکربندی:

* Text parameter: =data\n {{ $json.content }} - این عبارت داده‌های اصلی تصویر (data) را با نتیجه تحلیل قبلی ({{ $json.content }}) ترکیب می‌کند و هر دو قطعه اطلاعات را در اختیار عامل قرار می‌دهد.

* System Message: "analyze the image again and see if you get the same result." - عامل را برای ارزیابی مجدد تصویر آموزش می‌دهد.

* Prompt Type: define

* ورودی: داده‌های ادغام شده را از Merge1 دریافت می‌کند.

* خروجی: تحلیل اصلاح شده یا پاسخ از عامل هوش مصنوعی.

* مشکلات احتمالی: خطا در عبارت اگر فیلدهای داده گمشده باشند، خطاهای API، تاخیر در پاسخ.

* Node: OpenAI Chat Model

* Type: @n8n/n8n-nodes-langchain.lmChatOpenAi

* نقش: به عنوان بک‌اند مدل زبان برای گره AI Agent عمل می‌کند.

* پیکربندی:

* Model: gpt-4.1-mini (یا یک مدل چت مناسب)

* اعتبارنامه‌ها: از همان اعتبارنامه‌های API OpenAI گره Analyze image استفاده می‌کند.

* اتصال: به گره AI Agent به عنوان مدل زبان آن متصل است.

* مشکلات احتمالی: مشکلات کلید API، محدودیت‌های نرخ، در دسترس بودن مدل.

  • یادداشت‌های چسبان:

* یک یادداشت اهمیت گره Merge1 و تنظیم combineByPosition را برای حفظ داده‌های باینری در کنار نتایج تحلیل توضیح می‌دهد.

* یادداشت دیگر اطلاعات تماس برای کمک به سفارشی‌سازی گردش کار را ارائه می‌دهد.

---

جدول خلاصه

نام Nodeنوع Nodeنقش عملکردیNode(s) ورودیNode(s) خروجیپیکربندی کلیدی / زمینه یادداشت چسبان
Form Trigger1n8n-nodes-base.formTriggerدریافت آپلودهای تصویر از طریق فرم وبNoneAnalyze image, Merge1فیلد آپلود فایل به نام data. یادداشت چسبان: برای سفارشی‌سازی تماس بگیرید.
Analyze image@n8n/n8n-nodes-langchain.openAiتحلیل محتوای تصویر با استفاده از OpenAI VisionForm Trigger1Merge1Model: gpt-4o, Resource: image, Operation: analyze, Input Type: base64, Text: =data. یادداشت چسبان: حفظ داده‌های باینری.
Merge1n8n-nodes-base.mergeترکیب داده‌های اصلی تصویر و تحلیلForm Trigger1, Analyze imageAI AgentMode: combine, Combine By: combineByPosition. یادداشت چسبان: استراتژی حفظ داده‌های باینری را توضیح می‌دهد.
AI Agent@n8n/n8n-nodes-langchain.agentتحلیل مجدد تصویر با داده‌های ترکیبیMerge1OpenAI Chat ModelText: =data\n {{ $json.content }}, System Message: "analyze the image again...". یادداشت چسبان: حفظ داده‌های باینری.
OpenAI Chat Model@n8n/n8n-nodes-langchain.lmChatOpenAiارائه تکمیل چت برای عامل هوش مصنوعیAI Agent (ai\_languageModel)NoneModel: gpt-4.1-mini.

---

بازتولید گردش کار

1. افزودن Form Trigger:

* یک گره Form Trigger ایجاد کنید.

* مسیر، عنوان ("Image Document Upload")، توضیحات آن را پیکربندی کنید و یک فیلد آپلود فایل به نام data اضافه کنید.

2. افزودن Node تحلیل تصویر OpenAI:

* یک گره LangChain OpenAI ایجاد کنید.

* Resource را روی image و Operation را روی analyze تنظیم کنید.

* یک Model مانند gpt-4o انتخاب کنید.

* Input Type را روی base64 تنظیم کنید.

* در فیلد Text، عبارت =data را وارد کنید.

* اعتبارنامه‌های API OpenAI خود را پیکربندی کنید.

* خروجی Form Trigger را به این گره متصل کنید.

3. افزودن Node Merge:

* یک گره Merge ایجاد کنید.

* Mode را روی combine و Combine By را روی combineByPosition تنظیم کنید.

* گره Analyze image را به ورودی اول Merge1 متصل کنید.

* گره Form Trigger را به ورودی دوم Merge1 متصل کنید.

4. افزودن Node AI Agent:

* یک گره LangChain AI Agent ایجاد کنید.

* Prompt Type را روی define تنظیم کنید.

* System Message را وارد کنید: "analyze the image again and see if you get the same result."

* در فیلد Text، عبارت =data\n {{ $json.content }} را وارد کنید.

* خروجی گره Merge1 را به این گره متصل کنید.

5. افزودن Node OpenAI Chat Model:

* یک گره LangChain OpenAI Chat Model ایجاد کنید.

* یک Model مانند gpt-4.1-mini انتخاب کنید.

* اعتبارنامه‌های API OpenAI خود را پیکربندی کنید.

* این گره را به ورودی ai_languageModel گره AI Agent متصل کنید.

6. اتصال Nodes: اطمینان حاصل کنید که اتصالات به شرح زیر است:

* Form Trigger1Analyze image

* Form Trigger1Merge1 (ورودی دوم)

* Analyze imageMerge1 (ورودی اول)

* Merge1AI Agent

* AI Agent (ai\_languageModel) → OpenAI Chat Model

7. فعال‌سازی گردش کار: گردش کار را ذخیره و فعال کنید تا عملیاتی شود.

---

منابع

  • گردش کارهای n8n Axeto: https://axeto.ai/n8n
  • کمک برای سفارشی‌سازی: با Robert Breen (rbreen@ynteractive.com) تماس بگیرید یا از ynteractive.com بازدید کنید.

Nodeهای استفاده‌شده

سوالات متداول

هدف اصلی این گردش کار n8n چیست؟

هدف اصلی این گردش کار، تحلیل تصاویر با استفاده از OpenAI Vision و در عین حال حفظ داده‌های باینری اصلی تصویر است. این امر امکان انجام تحلیل‌های بیشتر یا عملیات دیگر بر روی همان تصویر را بدون نیاز به آپلود مجدد فراهم می‌کند.

چگونه داده‌های باینری تصویر در این گردش کار حفظ می‌شوند؟

داده‌های باینری تصویر از طریق گره `Form Trigger` دریافت و حفظ می‌شوند. سپس با استفاده از گره `Merge`، این داده‌های باینری با نتایج تحلیل OpenAI Vision ترکیب می‌شوند تا در مراحل بعدی گردش کار قابل استفاده باشند.

چه نوع تحلیل‌هایی را می‌توان با استفاده از این گردش کار انجام داد؟

این گردش کار به طور خاص برای تحلیل تصاویر با استفاده از قابلیت‌های بینایی OpenAI طراحی شده است. نتایج اولیه شامل توضیحات متنی و بینش‌های استخراج شده از تصویر است. همچنین، با حفظ داده‌های باینری، می‌توان تحلیل‌های هوش مصنوعی بیشتری را با استفاده از عوامل هوش مصنوعی بر روی تصویر اصلی و نتایج اولیه انجام داد.

این گردش کار برای چه سناریوهایی مناسب است؟

این گردش کار برای سناریوهایی ایده‌آل است که نیاز به درک دقیق تصویر دارند و در عین حال دسترسی به داده‌های خام تصویر را حفظ می‌کنند. مثال‌ها شامل پردازش خودکار اسناد، تعدیل محتوا، خطوط لوله اعتبارسنجی داده‌های بصری، و هر فرآیندی است که نیاز به تحلیل چندمرحله‌ای یا اعتبارسنجی تصاویر دارد.

workflowهای مرتبط

این workflow در کاتالوگ Axeto.ai بایگانی شده است. لایسنس اصلی متعلق به سازنده workflow است.