تحليلات الصوت المدعومة بالذكاء الاصطناعي

تحويل الصوت إلى نص

وحدة زيوما الذكية للتعرف على الكلام

أيقونة وحدة تحويل الصوت إلى نص تستمع هذه الوحدة إلى التدفق الصوتي من الكاميرا أو ميكروفون منفصل، وتتعرف على الكلام، وتستجيب للكلمات الرئيسية، وتحفظ نصوص المحادثات في تقرير CSV أو تعرضها كنص فوق الفيديو المباشر/الأرشيف حسب تفضيلاتك. كما تدعم تحويل ملفات .mp3 إلى نصوص، مثل تسجيلات المحادثات ومقاطع الفيديو التدريبية وغيرها.

Voice-to-Text: وحدة زيوما الذكية للتعرف على الكلام
+90 لغة للتحويل النصي
CSV تقرير محفوظ على القرص
البث المباشر وملفات .mp3
الذكاء الاصطناعي وحدة إضافية
ملاحظة هامة: الوحدة في المرحلة التجريبية

هام: نسخة تجريبية

تتوفر هذه الوحدة بدءاً من إصدار زيوما 24.8.12 وهي في المرحلة التجريبية، لذا قد تُسقط بعض الكلمات أو تحتوي على تكرارات في حالات معينة. لا تتطلب معدات متخصصة؛ إذ يكفي تدفق صوتي من أي كاميرا أو ميكروفون وجهاز كمبيوتر عادي مزود بمعالج رسوميات (GPU).

حالات الاستخدام

سيناريوهات التطبيق

يساهم تحويل الصوت إلى نص في تعزيز الأمن على المستوى الشخصي وفي المدن والمجتمعات، وكذلك في القطاع التجاري، مع دعم تحسين العمليات التشغيلية للأعمال.

رعاية كبار السن

الاستجابة الفورية لنداءات الاستغاثة أو الحماية من المحتالين.

كافة الأعمال التجارية

الرقابة الآلية على جودة خدمة العملاء (مثل رصد الألفاظ النابية).

مراكز الاتصال

تحويل تسجيلات المكالمات إلى نصوص لمراقبة الامتثال لسياسات الشركة ونصوص المحادثات المعتمدة.

مراقبة المدن

الأمن ومكافحة الإرهاب والتعرف على العبارات التي تنذر بالخطر.

الرقابة الأبوية

المساعدة في حماية الأطفال من التنمر أو التواصل مع المحتالين.

الشرطة

بالإضافة إلى الكاميرات المحمولة على الجسم: تحويل المحادثات مع المشتبه بهم إلى نصوص ورصد التهديدات.

الأبحاث والتحليلات

جمع الإحصائيات في الخلفية لإجراء دراسات متعلقة بالكلام ووتيرة استخدام المفردات.

التسويق

تتبع مناقشات العملاء للحملات الترويجية وردود أفعالهم تجاه اللوحات الإعلانية وغيرها.

التصفية والأتمتة

رصد العبارات غير المرغوب فيها أو الكلمات الرئيسية للمراقبة الموجهة للمحادثات — دون الحاجة للاستماع إليها جميعاً.

المزايا

مزايا وحدة تحويل الصوت إلى نص

لا تتطلب معدات خاصة

تعمل على أجهزة الكمبيوتر العادية مع معظم الكاميرات وبطاقات الرسوميات.

مرونة تامة

استجابات متنوعة (بما في ذلك استجابات قابلة للبرمجة) وتكامل مع أنظمة الجهات الخارجية.

عمل في الوقت الفعلي

معالجة فورية للتدفقات دون أي تأخير. تعمل على أجهزتك الخاصة.

حل اقتصادي

يمكن شراء الوحدة كإضافة لترخيص Standard أو Pro.

سير العمل

آلية العمل

نموذج لسلسلة تتضمن وحدة Voice-to-Text الذكية
الخطوة 1

بناء السلسلة

نظراً لأن الوحدة تعالج التدفق الصوتي، يلزم وجود مصدر صوت في السلسلة.

  • مصدر الصوت: ميكروفون مدمج في الكاميرا، أو ميكروفون USB أو IP منفصل
  • نموذج للسلسلة: "Universal Camera" – "تحويل الصوت إلى نص" – "المعاينة والأرشيف"
  • ترخيص الوحدة متاح كإضافة لترخيص زيوما Pro أو Standard
تحميل موارد الذكاء الاصطناعي الإضافية
الخطوة 2

تحميل موارد الذكاء الاصطناعي

انقر على أيقونة "تحويل الصوت إلى نص" في السلسلة لفتح إعدادات الوحدة. يبدأ تحميل الموارد الإضافية تلقائياً عند فتح الإعدادات لأول مرة. بمجرد اختفاء رسالة "جاري التحميل"، يكون النظام جاهزاً.

  • تحتوي الموارد الإضافية على مجموعات بيانات الذكاء الاصطناعي ويتم تحميلها عند الطلب من خوادم فيليناسوفت
  • يتم تحميل الموارد فقط عند الحاجة — مما يحافظ على صغر حجم البرنامج
اختيار نموذج الذكاء الاصطناعي ولغة النسخ
الخطوة 3

اختر نموذج التعرف والكلمات الرئيسية

تتوفر عدة نماذج ذكاء اصطناعي للغات مختلفة، تختلف في الحجم ودقة التعرف والحمل على الأجهزة. في حقل "نموذج التعرف على الكلام"، اختر لغة النص المفرغ (دون الحاجة لتحديد لغة الكلام المنطوق)، ويمكنك عند اللزوم تحديد كلمات رئيسية لاكتشافها في الحقل أدناه. تتيح لك خيارات "عرض الكلام المتعرف عليه أثناء البث المباشر" و"حفظ الكلام المتعرف عليه في الترجمات عند التسجيل/تصدير الأرشيف" عرض النص المفرغ فوق الفيديو المباشر وفي الأرشيف.

  • "الكلمات الرئيسية للاكتشاف" — يستجيب الموديول فقط للكلمات أو العبارات التي تحددها
  • تراكب النص المفرغ في المعاينة المباشرة وفي الأرشيف
  • "حفظ البيانات في تقرير CSV" — حفظ النص المفرغ في ملف جدول بيانات على القرص
  • ربط إجراء استجابة بعد الموديول: تسجيل، إشعار، أو إرسال أمر
  • الماكرو %VOICE% متاح في موديولات "مرسل طلبات HTTP" و"إرسال البريد الإلكتروني" و"مشغل التطبيقات"
API

التكامل مع البرامج الخارجية

يمكن استخدام ميزة تحويل الصوت إلى نص عبر برامج خارجية — كتفريغ محادثات VoIP مثلًا. زوّد الموديول بملف .mp3 واحصل على النتيجة كنص — حتى على محطات عمل المشغلين التي لا تحتوي على زيوما أو كاميرات. هام: ملفات .mp3 فقط مدعومة.

مثال على طلب عبر واجهة برمجة تطبيقات زيوما (JSON):

curl -F "audio_file=@speech.mp3" "http://192.168.0.67:10090/api?login=Administrator&password=123&speech_recognition=recognition&model=qwen3-asr-1.7b&ttl=10&language=en"

حيث:

  • audio_file=@speech.mp3 — مسار الملف الصوتي على جهازك
  • 192.168.0.67 — عنوان IP لخادم زيوما
  • 10090 — منفذ خادم زيوما
  • Administrator / 123 — بيانات دخول المسؤول (اسم المستخدم دائماً Administrator) وكلمة المرور
  • model=… — نموذج التعرف (راجع القائمة أدناه)
  • language=en — لغة النص المفرغ. إذا اختلفت عن لغة الكلام الفعلي، ستُترجم النصوص تلقائيًا إلى اللغة المحددة

لحفظ النتيجة كملف نصي، أضف >savetext.txt بعد الأمر، حيث savetext.txt هو اسم الملف النصي.

نماذج التعرف الخاصة بـ API:

الاسم الوصف رمز API
الروسية الأساسية 140 ميجابايت tone
الروسية المتقدمة علامات الترقيم، 215 ميجابايت giga
الإنجليزية الأساسية 70 ميجابايت zipformer
متعدد اللغات (أساسي) الترقيم، 1 جيجابايت، 0.6 مليار معلمة qwen3-asr-0.6b
Gemma4 متعدد اللغات محسّن الترقيم، 2.2 جيجابايت، 1.7 مليار معلمة qwen3-asr-1.7b
Gemma4 متعدد اللغات أساسي الترقيم، 2.2 جيجابايت، 1.7 مليار معلمة gemma4-e2b
Gemma4 متعدد اللغات محسّن الترقيم، 7 جيجابايت، 12 مليار معلمة gemma4-12b

قائمة رموز اللغات

en — الإنجليزية، zh — الصينية، de — الألمانية، es — الإسبانية، ru — الروسية، ko — الكورية، fr — الفرنسية، ja — اليابانية، pt — البرتغالية، tr — التركية، pl — البولندية، ca — الكتالونية، nl — الهولندية، ar — العربية، sv — السويدية، it — الإيطالية، id — الإندونيسية، hi — الهندية، fi — الفنلندية، vi — الفيتنامية، he — العبرية، uk — الأوكرانية، el — اليونانية، ms — الملايوية، cs — التشيكية، ro — الرومانية، da — الدنماركية، hu — المجرية، ta — التاميلية، no — النرويجية، th — التايلاندية، ur — الأردية، hr — الكرواتية، bg — البلغارية، lt — الليتوانية، la — اللاتينية، mi — الماورية، ml — المالايالامية، cy — الويلزية، sk — السلوفاكية، te — التيلوغوية، fa — الفارسية، lv — اللاتفية، bn — البنغالية، sr — الصربية، az — الأذربيجانية، sl — السلوفينية، kn — الكنادية، et — الإستونية، mk — المقدونية، br — البريتونية، eu — الباسكية، is — الآيسلندية، hy — الأرمنية، ne — النيبالية، mn — المنغولية، bs — البوسنية، kk — الكازاخية، sq — الألبانية، sw — السواحلية، gl — الجاليكية، mr — الماراثية، pa — البنجابية، si — السنهالية، km — الخميرية، sn — الشونا، yo — اليوروبا، so — الصومالية، af — الأفريقانية، oc — القسطانية، ka — الجورجية، be — البيلاروسية، tg — الطاجيكية، sd — السندية، gu — الغوجاراتية، am — الأمهرية، yi — اليديشية، lo — اللاو، uz — الأوزبكية، fo — الفاروية، ht — الكريولية الهايتية، ps — الباشتو، tk — التركمانية، nn — النينوشك، mt — المالطية، sa — السنسكريتية، lb — اللوكسمبورغية، my — الميانمارية، bo — التبتية، tl — التغلوغية، mg — الملغاشية، as — الأسامية، tt — التترية، haw — الهاوايية، ln — اللينغالا، ha — الهوسا، ba — الباشكيرية، jw — الجاوية، su — السوندانية، yue — الكانتونية.

بدء سريع

كيفية الاختبار

1
تشغيل زيوما

حمّل زيوما وشغّله. استخدم النسخة التجريبية أو فعّل ترخيص Xeoma Standard/Xeoma Pro مع ترخيص الوحدة الإضافية "تحويل الصوت إلى نص".

2
إضافة كاميرا

أضف كاميرا يدوياً أو انتظر حتى يكتشف زيوما الكاميرات في شبكتك تلقائياً. ولتوصيل ميكروفون منفصل، قم بتوصيل وحدة "الميكروفون" واختر مصدر الصوت المناسب.

3
إضافة الوحدة

أضف وحدة "تحويل الصوت إلى نص" إلى السلسلة، وقم بإعداد استجابة للكلمات المفتاحية أو نسخ الكلام المستمر، وإذا لزم الأمر، فعّل تراكب النص المكتوب على صورة الكاميرا والتسجيلات.

4
إعداد الاستجابات

حدد استجابة للحدث — مثل الحفظ بصيغة CSV، أو إشعارات الجوال أو أي خيار آخر.

إعدادات وحدة تحويل الصوت إلى نص في زيوما
تفرض النسخة التجريبية بعض القيود. لاستكشاف ميزة تحويل الصوت إلى نص بشكل أفضل، نوصي بطلب ترخيص تجريبي مجاني يمنحك وصولاً كاملاً إلى جميع الميزات دون قيود أو التزامات، ولا يتطلب سوى عنوان بريد إلكتروني. انقر على الزر أدناه للبدء:
احصل على
ترخيص تجريبي مجاني
فيديو

تحويل الصوت إلى نص: التعرف على الكلام في زيوما

تجربة مجانية

جرب زيوما مجاناً

أدخل اسمك وبريدك الإلكتروني للحصول على ترخيص تجريبي مجاني. لا يُطلب إدخال بطاقة ائتمان.

احصل على تراخيص زيوما التجريبية المجانية عبر البريد الإلكتروني

وظائف كاملة. إرسال فوري.

ننصحك بتجنب استخدام عناوين بريد إلكتروني تحتوي على بيانات شخصية، أو إرسال بيانات شخصية إلينا بأي وسيلة أخرى. وفي حال قيامك بذلك، فإن تقديم هذا النموذج يعني تأكيد موافقتك على معالجة بياناتك الشخصية

هل تحتاج إلى تخصيص الوحدة لتناسب متطلباتك؟

هل تحتاج إلى شيء آخر؟

ألا تلبي الوحدة احتياجاتك تماماً؟ يمكننا تطوير الوظائف التي تحتاجها وإضافتها إلى زيوما كتطوير مدفوع. عرض التفاصيل.

لديك أسئلة؟ تحتاج إلى مساعدة؟ تواصل معنا! يسعدنا مساعدتك!

مستعد للبدء؟

جرّب ميزة تحويل الصوت إلى نص برخصة تجريبية مجانية — دون الحاجة إلى بطاقة ائتمان أو بيانات شخصية.