
تحلیل تصویر با OpenAI Vision و حفظ دادههای باینری در n8n
7 دقیقه مطالعه · منتشر شده ۱۴۰۵/۴/۲۸
دانلود workflow
فایل JSON آماده import در n8n — credentialها باید در n8n شما تنظیم شوند.
- فایل JSON را دانلود کنید.
- در n8n: Workflows → Import from File.
- Credentialهای هر node را متصل کنید.
- workflow را فعال کنید.
شناسه workflow: 8867 · منبع: کاتالوگ Axeto
تحلیل تصاویر با OpenAI Vision و حفظ دادههای باینری
این گردش کار نحوه آپلود یک تصویر از طریق فرم وب، تحلیل آن با استفاده از OpenAI Vision و مهمتر از همه، حفظ دادههای باینری اصلی برای پردازشهای بعدی را نشان میدهد. این اطمینان حاصل میکند که میتوانید چندین تحلیل هوش مصنوعی یا عملیات دیگر را روی همان تصویر بدون نیاز به آپلود مجدد انجام دهید.
دستهبندیها: تولید محتوا، هوش مصنوعی چندوجهی
کاتالوگ Axeto: گردش کارهای n8n
---
نمای کلی گردش کار
این گردش کار برای موارد زیر طراحی شده است:
1. دریافت آپلودهای تصویر: دریافت فایلهای تصویری ارسال شده از طریق یک فرم وب کاربرپسند.
2. تحلیل تصویر با OpenAI Vision: پردازش تصویر آپلود شده با استفاده از قابلیتهای پیشرفته بینایی OpenAI برای استخراج توضیحات متنی و بینشها.
3. حفظ و ادغام دادهها: ترکیب دادههای باینری اصلی تصویر با نتایج تحلیل هوش مصنوعی.
4. انجام تحلیل هوش مصنوعی بیشتر: استفاده از یک عامل هوش مصنوعی برای تحلیل مجدد تصویر با استفاده از دادههای اصلی و تحلیل اولیه، که امکان اعتبارسنجی یا بینشهای گستردهتر را فراهم میکند.
این تنظیم برای سناریوهایی که نیاز به درک دقیق تصویر دارند و در عین حال دسترسی به دادههای خام تصویر را حفظ میکنند، ایدهآل است، مانند پردازش خودکار اسناد، تعدیل محتوا، یا خطوط لوله اعتبارسنجی دادههای بصری.
---
تشریح گام به گام
۱. ورودی و دریافت تصویر
این بخش تعامل اولیه کاربر را مدیریت میکند و به آنها اجازه میدهد فایل تصویر را آپلود کنند.
- Node:
Form Trigger1
* Type: n8n-nodes-base.formTrigger
* نقش: به عنوان یک نقطه پایانی وبهوک عمل میکند و یک فرم وب برای ارسال دادهها توسط کاربران ارائه میدهد.
* پیکربندی:
* Path: یک مسیر URL منحصر به فرد برای دسترسی به فرم.
* Form Title: "Image Document Upload"
* Form Description: "Upload a image document for AI analysis"
* Form Fields: یک فیلد آپلود فایل واحد به نام data.
* خروجی: فایل تصویر آپلود شده در فرمت باینری، که از طریق فیلد data قابل دسترسی است.
* مشکلات احتمالی: خطاهای آپلود فایل، تجاوز از محدودیتهای اندازه، انواع فایلهای پشتیبانی نشده، مشکلات اتصال وبهوک.
۲. تحلیل تصویر با هوش مصنوعی
این بخش تصویر آپلود شده را برای تحلیل به OpenAI Vision ارسال میکند.
- Node:
Analyze image
* Type: @n8n/n8n-nodes-langchain.openAi (به طور خاص برای تحلیل تصویر پیکربندی شده است)
* نقش: از مدل Vision OpenAI برای تفسیر محتوای تصویر استفاده میکند.
* پیکربندی:
* Model: gpt-4o (یا یک نوع مشابه GPT-4O)
* Resource: image
* Operation: analyze
* Input Type: base64 (دادههای تصویر در این فرمت انتظار میرود)
* Text parameter: روی =data تنظیم شده است تا به دادههای تصویر کدگذاری شده base64 از گره Form Trigger1 ارجاع دهد.
* اعتبارنامهها: نیاز به اعتبارنامههای API OpenAI (به عنوان مثال، "OpenAi account 4").
* خروجی: تحلیل متنی محتوای تصویر.
* مشکلات احتمالی: خرابی احراز هویت API، محدودیت نرخ، کدگذاری base64 نامعتبر، فرمتهای تصویر پشتیبانی نشده، مهلت زمانی شبکه.
۳. ادغام دادهها و پردازش پیشرفته هوش مصنوعی
این بخش اصلی برای حفظ دادهها و فعال کردن تحلیلهای بیشتر است.
- Nodes:
Merge1,AI Agent,OpenAI Chat Model
* Node: Merge1
* Type: n8n-nodes-base.merge
* نقش: خروجی تحلیل تصویر را با دادههای باینری اصلی تصویر ترکیب میکند.
* پیکربندی:
* Mode: combine
* Combine By: combineByPosition - این تنظیم حیاتی تضمین میکند که نتیجه تحلیل و دادههای باینری اصلی بر اساس ترتیب ورود آنها به درستی جفت میشوند.
* ورودیها:
1. خروجی از Analyze image (نتیجه تحلیل).
2. خروجی از Form Trigger1 (دادههای باینری اصلی تصویر).
* خروجی: یک ساختار داده ادغام شده شامل فیلد data اصلی و فیلد content از تحلیل.
* مشکلات احتمالی: عدم تطابق دادههای ورودی، ورودیهای گمشده.
* Node: AI Agent
* Type: @n8n/n8n-nodes-langchain.agent
* نقش: به عنوان یک عامل هوشمند عمل میکند که میتواند دستورالعملهای پیچیده را با استفاده از یک مدل زبان پردازش کند.
* پیکربندی:
* Text parameter: =data\n {{ $json.content }} - این عبارت دادههای اصلی تصویر (data) را با نتیجه تحلیل قبلی ({{ $json.content }}) ترکیب میکند و هر دو قطعه اطلاعات را در اختیار عامل قرار میدهد.
* System Message: "analyze the image again and see if you get the same result." - عامل را برای ارزیابی مجدد تصویر آموزش میدهد.
* Prompt Type: define
* ورودی: دادههای ادغام شده را از Merge1 دریافت میکند.
* خروجی: تحلیل اصلاح شده یا پاسخ از عامل هوش مصنوعی.
* مشکلات احتمالی: خطا در عبارت اگر فیلدهای داده گمشده باشند، خطاهای API، تاخیر در پاسخ.
* Node: OpenAI Chat Model
* Type: @n8n/n8n-nodes-langchain.lmChatOpenAi
* نقش: به عنوان بکاند مدل زبان برای گره AI Agent عمل میکند.
* پیکربندی:
* Model: gpt-4.1-mini (یا یک مدل چت مناسب)
* اعتبارنامهها: از همان اعتبارنامههای API OpenAI گره Analyze image استفاده میکند.
* اتصال: به گره AI Agent به عنوان مدل زبان آن متصل است.
* مشکلات احتمالی: مشکلات کلید API، محدودیتهای نرخ، در دسترس بودن مدل.
- یادداشتهای چسبان:
* یک یادداشت اهمیت گره Merge1 و تنظیم combineByPosition را برای حفظ دادههای باینری در کنار نتایج تحلیل توضیح میدهد.
* یادداشت دیگر اطلاعات تماس برای کمک به سفارشیسازی گردش کار را ارائه میدهد.
---
جدول خلاصه
| نام Node | نوع Node | نقش عملکردی | Node(s) ورودی | Node(s) خروجی | پیکربندی کلیدی / زمینه یادداشت چسبان |
|---|---|---|---|---|---|
Form Trigger1 | n8n-nodes-base.formTrigger | دریافت آپلودهای تصویر از طریق فرم وب | None | Analyze image, Merge1 | فیلد آپلود فایل به نام data. یادداشت چسبان: برای سفارشیسازی تماس بگیرید. |
Analyze image | @n8n/n8n-nodes-langchain.openAi | تحلیل محتوای تصویر با استفاده از OpenAI Vision | Form Trigger1 | Merge1 | Model: gpt-4o, Resource: image, Operation: analyze, Input Type: base64, Text: =data. یادداشت چسبان: حفظ دادههای باینری. |
Merge1 | n8n-nodes-base.merge | ترکیب دادههای اصلی تصویر و تحلیل | Form Trigger1, Analyze image | AI Agent | Mode: combine, Combine By: combineByPosition. یادداشت چسبان: استراتژی حفظ دادههای باینری را توضیح میدهد. |
AI Agent | @n8n/n8n-nodes-langchain.agent | تحلیل مجدد تصویر با دادههای ترکیبی | Merge1 | OpenAI Chat Model | Text: =data\n {{ $json.content }}, System Message: "analyze the image again...". یادداشت چسبان: حفظ دادههای باینری. |
OpenAI Chat Model | @n8n/n8n-nodes-langchain.lmChatOpenAi | ارائه تکمیل چت برای عامل هوش مصنوعی | AI Agent (ai\_languageModel) | None | Model: gpt-4.1-mini. |
---
بازتولید گردش کار
1. افزودن Form Trigger:
* یک گره Form Trigger ایجاد کنید.
* مسیر، عنوان ("Image Document Upload")، توضیحات آن را پیکربندی کنید و یک فیلد آپلود فایل به نام data اضافه کنید.
2. افزودن Node تحلیل تصویر OpenAI:
* یک گره LangChain OpenAI ایجاد کنید.
* Resource را روی image و Operation را روی analyze تنظیم کنید.
* یک Model مانند gpt-4o انتخاب کنید.
* Input Type را روی base64 تنظیم کنید.
* در فیلد Text، عبارت =data را وارد کنید.
* اعتبارنامههای API OpenAI خود را پیکربندی کنید.
* خروجی Form Trigger را به این گره متصل کنید.
3. افزودن Node Merge:
* یک گره Merge ایجاد کنید.
* Mode را روی combine و Combine By را روی combineByPosition تنظیم کنید.
* گره Analyze image را به ورودی اول Merge1 متصل کنید.
* گره Form Trigger را به ورودی دوم Merge1 متصل کنید.
4. افزودن Node AI Agent:
* یک گره LangChain AI Agent ایجاد کنید.
* Prompt Type را روی define تنظیم کنید.
* System Message را وارد کنید: "analyze the image again and see if you get the same result."
* در فیلد Text، عبارت =data\n {{ $json.content }} را وارد کنید.
* خروجی گره Merge1 را به این گره متصل کنید.
5. افزودن Node OpenAI Chat Model:
* یک گره LangChain OpenAI Chat Model ایجاد کنید.
* یک Model مانند gpt-4.1-mini انتخاب کنید.
* اعتبارنامههای API OpenAI خود را پیکربندی کنید.
* این گره را به ورودی ai_languageModel گره AI Agent متصل کنید.
6. اتصال Nodes: اطمینان حاصل کنید که اتصالات به شرح زیر است:
* Form Trigger1 → Analyze image
* Form Trigger1 → Merge1 (ورودی دوم)
* Analyze image → Merge1 (ورودی اول)
* Merge1 → AI Agent
* AI Agent (ai\_languageModel) → OpenAI Chat Model
7. فعالسازی گردش کار: گردش کار را ذخیره و فعال کنید تا عملیاتی شود.
---
منابع
- گردش کارهای n8n Axeto: https://axeto.ai/n8n
- کمک برای سفارشیسازی: با Robert Breen (rbreen@ynteractive.com) تماس بگیرید یا از ynteractive.com بازدید کنید.
Nodeهای استفادهشده
سوالات متداول
هدف اصلی این گردش کار n8n چیست؟▾
هدف اصلی این گردش کار، تحلیل تصاویر با استفاده از OpenAI Vision و در عین حال حفظ دادههای باینری اصلی تصویر است. این امر امکان انجام تحلیلهای بیشتر یا عملیات دیگر بر روی همان تصویر را بدون نیاز به آپلود مجدد فراهم میکند.
چگونه دادههای باینری تصویر در این گردش کار حفظ میشوند؟▾
دادههای باینری تصویر از طریق گره `Form Trigger` دریافت و حفظ میشوند. سپس با استفاده از گره `Merge`، این دادههای باینری با نتایج تحلیل OpenAI Vision ترکیب میشوند تا در مراحل بعدی گردش کار قابل استفاده باشند.
چه نوع تحلیلهایی را میتوان با استفاده از این گردش کار انجام داد؟▾
این گردش کار به طور خاص برای تحلیل تصاویر با استفاده از قابلیتهای بینایی OpenAI طراحی شده است. نتایج اولیه شامل توضیحات متنی و بینشهای استخراج شده از تصویر است. همچنین، با حفظ دادههای باینری، میتوان تحلیلهای هوش مصنوعی بیشتری را با استفاده از عوامل هوش مصنوعی بر روی تصویر اصلی و نتایج اولیه انجام داد.
این گردش کار برای چه سناریوهایی مناسب است؟▾
این گردش کار برای سناریوهایی ایدهآل است که نیاز به درک دقیق تصویر دارند و در عین حال دسترسی به دادههای خام تصویر را حفظ میکنند. مثالها شامل پردازش خودکار اسناد، تعدیل محتوا، خطوط لوله اعتبارسنجی دادههای بصری، و هر فرآیندی است که نیاز به تحلیل چندمرحلهای یا اعتبارسنجی تصاویر دارد.
workflowهای مرتبط
- دستهبندی خودکار ایمیل جیمیل با GPT-4o و هشدار SlackAI Summarization
- دستهبندی خودکار پستهای وبلاگ با هوش مصنوعی و گیتهابContent Creation
- اتوماسیون زیرنویسگذاری ویدیو با n8n، Google Drive و SubmagicContent Creation
- تحلیل خودکار Google Analytics با هوش مصنوعی Gemini و اعلانه…Market Research
- اتوماسیون ثبت رزروهای Calendly در Google Sheets با n8nCRM
- اتوماسیون پیامهای تشکر و کوپن واتساپ برای مشتریان ShopifyContent Creation
