رونویسی صدا تلگرام با Groq Whisper و n8n

رونویسی صدا تلگرام با Groq Whisper و n8n

4 دقیقه مطالعه · منتشر شده ۱۴۰۵/۵/۶

دانلود workflow

فایل JSON آماده import در n8n — credentialها باید در n8n شما تنظیم شوند.

  1. فایل JSON را دانلود کنید.
  2. در n8n: Workflows → Import from File.
  3. Credentialهای هر node را متصل کنید.
  4. workflow را فعال کنید.

شناسه workflow: 10037 · منبع: کاتالوگ Axeto

اتوماسیون رونویسی صدا با تلگرام و Groq Whisper

این گردش کار، رونویسی پیام‌های صوتی دریافتی از طریق یک ربات تلگرام را خودکار می‌کند و از API Groq Whisper برای تبدیل صدا به متن با کیفیت بالا استفاده می‌کند. این گردش کار برای کاربرانی طراحی شده است که نیاز به تبدیل پیام‌های صوتی یا صوتی تلگرام به متن دارند و می‌خواهند رونویسی را به صورت یک پیام متنی مستقیم تلگرام یا یک فایل .txt قابل دانلود دریافت کنند.

این گردش کار و موارد دیگر را در کاتالوگ n8n در Axeto.ai کاوش کنید.

---

نمای کلی گردش کار

این گردش کار مراحل زیر را هماهنگ می‌کند:

1. دریافت ورودی تلگرام: منتظر پیام‌های ورودی تلگرام می‌ماند، که به طور خاص برای یک شناسه چت تعیین شده فیلتر شده است.

2. اعتبارسنجی و مسیریابی نوع پیام: تشخیص می‌دهد که آیا پیام دریافتی حاوی داده‌های صوتی یا ویس است. اگر چنین است، به بازیابی صدا ادامه می‌دهد. برای انواع پیام‌های پشتیبانی نشده، به کاربر اطلاع می‌دهد و گردش کار را متوقف می‌کند.

3. بازیابی صدا: فایل صوتی را از تلگرام با استفاده از شناسه فایل استخراج شده دانلود می‌کند.

4. راه‌اندازی اعتبارنامه: کلیدها و توکن‌های API لازم برای Groq و تلگرام را به طور ایمن ذخیره و آماده می‌کند.

5. رونویسی صدا: فایل صوتی دانلود شده را برای رونویسی با استفاده از مدل Whisper به API Groq ارسال می‌کند.

6. انتخاب فرمت خروجی کاربر: از کاربر می‌خواهد فرمت خروجی دلخواه خود را انتخاب کند: یک پیام متنی ساده یا یک فایل .txt.

7. تحویل رونویسی: متن رونویسی شده را در فرمت انتخاب شده از طریق تلگرام به کاربر باز می‌گرداند.

---

تحلیل گره‌های دقیق

۱. دریافت ورودی تلگرام

  • هدف: این بلوک به عنوان نقطه ورود عمل می‌کند و هنگام دریافت پیام جدید توسط ربات تلگرام پیکربندی شده شما، گردش کار را فعال می‌کند. این شامل یک فیلتر برای پردازش فقط پیام‌های یک شناسه چت خاص است.
  • گره‌ها:

* Telegram: Receive Message (Trigger)

  • پیکربندی:

* Update Type: message

* Chat ID: 8464412504 (شناسه چت مورد نظر خود را جایگزین کنید)

* Telegram API Credentials: به ربات تلگرام شما پیوند داده شده است (به عنوان مثال، abhiman1bot).

  • ورودی/خروجی: داده‌های پیام ورودی تلگرام را دریافت می‌کند.
  • موارد لبه‌ای: توکن‌های ربات نامعتبر یا لغو شده مانع از عملکرد تریگر می‌شوند. وقفه‌های شبکه ممکن است منجر به از دست رفتن پیام‌ها شود.
  • یادداشت چسبان: راهنمایی‌های ضروری را برای راه‌اندازی ربات تلگرام و پیکربندی تریگر ارائه می‌دهد.

۲. اعتبارسنجی و مسیریابی نوع پیام

  • هدف: این بخش به طور هوشمندانه پیام ورودی تلگرام را بررسی می‌کند تا تشخیص دهد آیا حاوی داده‌های صوتی یا ویس است. در صورت لزوم file_id را استخراج می‌کند. اگر نوع پیام پشتیبانی نمی‌شود، پیام آموزنده‌ای را به کاربر باز می‌گرداند و گردش کار را خاتمه می‌دهد.
  • گره‌ها:

* Switch (Check Message Type) (Switch)

* Set Node (audio type) (Set)

* Set Node (voice type) (Set)

* Telegram: Unsupported Type Message (Telegram Send Message)

  • پیکربندی Switch (Check Message Type):

* شرط ۱: وجود message.audio.file_id را بررسی می‌کند. در صورت صحیح بودن، به خروجی audio مسیریابی می‌کند.

* شرط ۲: وجود message.voice.file_id را بررسی می‌کند. در صورت صحیح بودن، به خروجی voice مسیریابی می‌کند.

* پیش‌فرض: اگر نه صدا و نه ویس تشخیص داده نشد، به خروجی error مسیریابی می‌کند.

  • پیکربندی Set Node (audio type) / Set Node (voice type):

* file_id استخراج شده را به متغیری به نام fileid اختصاص می‌دهد.

  • پیکربندی Telegram: Unsupported Type Message:

* پیام "Yo! I only take audio😅, drop an audio message instead!" را به شناسه چت کاربر ارسال می‌کند.

  • ورودی/خروجی: داده‌های پیام را از تریگر دریافت می‌کند؛ بر اساس نوع پیام مسیریابی می‌کند.
  • موارد لبه‌ای: پیام‌هایی که فیلدهای مورد انتظار audio، voice یا text را ندارند ممکن است به درستی مسیریابی نشوند.
  • یادداشت چسبان: منطق مسیریابی و هدف این بلوک را توضیح می‌دهد.

۳. بازیابی صدا

  • هدف: این گره فایل صوتی یا ویس را از تلگرام با استفاده از fileid که قبلاً شناسایی شده است، دانلود می‌کند. سپس مسیر فایل را برای مرحله رونویسی بعدی در دسترس قرار می‌دهد.
  • گره‌ها:

* Telegram: Download Audio File (Telegram Download File)

  • پیکربندی:

* File ID: از متغیر fileid استفاده می‌کند.

* Download: روی false تنظیم شده است تا به جای دانلود مستقیم محتوای باینری، مسیر فایل به دست آید.

* Telegram API Credentials: از همان اعتبارنامه ربات تریگر استفاده می‌کند.

  • ورودی/خروجی: fileid را دریافت می‌کند؛ یک JSON حاوی file_path در سرورهای تلگرام را خروجی می‌دهد.
  • موارد لبه‌ای: شناسه‌های فایل نامعتبر یا منقضی شده، یا مشکلات شبکه، می‌توانند باعث شکست دانلود شوند.
  • یادداشت چسبان: عملکرد این گره را در بازیابی فایل صوتی توصیف می‌کند.

۴. راه‌اندازی اعتبارنامه

Nodeهای استفاده‌شده

سوالات متداول

این گردش کار n8n چگونه کار می‌کند؟

این گردش کار پیام‌های صوتی یا ویس را از تلگرام دریافت می‌کند، آن‌ها را با استفاده از API Groq Whisper به متن تبدیل کرده و سپس رونویسی را به عنوان یک پیام متنی یا فایل `.txt` به شما باز می‌گرداند.

چه چیزی برای استفاده از این گردش کار لازم است؟

شما به یک ربات تلگرام فعال، کلید API Groq و پیکربندی صحیح گره‌های n8n، از جمله شناسه چت مورد نظر، نیاز دارید.

آیا این گردش کار فقط برای پیام‌های صوتی کار می‌کند؟

خیر، این گردش کار هم برای پیام‌های صوتی (audio) و هم برای پیام‌های ویس (voice) در تلگرام طراحی شده است.

چگونه می‌توانم خروجی رونویسی را دریافت کنم؟

این گردش کار به شما امکان می‌دهد تا فرمت خروجی را انتخاب کنید: یا به صورت یک پیام متنی ساده در تلگرام یا به صورت یک فایل `.txt` قابل دانلود.

workflowهای مرتبط

این workflow در کاتالوگ Axeto.ai بایگانی شده است. لایسنس اصلی متعلق به سازنده workflow است.