تحويل الصوت إلى نص
وحدة زيوما الذكية للتعرف على الكلام
تستمع هذه الوحدة إلى التدفق الصوتي من الكاميرا أو ميكروفون منفصل، وتتعرف على الكلام، وتستجيب للكلمات الرئيسية، وتحفظ نصوص المحادثات في تقرير CSV أو تعرضها كنص فوق الفيديو المباشر/الأرشيف حسب تفضيلاتك. كما تدعم تحويل ملفات .mp3 إلى نصوص، مثل تسجيلات المحادثات ومقاطع الفيديو التدريبية وغيرها.

هام: نسخة تجريبية
تتوفر هذه الوحدة بدءاً من إصدار زيوما 24.8.12 وهي في المرحلة التجريبية، لذا قد تُسقط بعض الكلمات أو تحتوي على تكرارات في حالات معينة. لا تتطلب معدات متخصصة؛ إذ يكفي تدفق صوتي من أي كاميرا أو ميكروفون وجهاز كمبيوتر عادي مزود بمعالج رسوميات (GPU).
سيناريوهات التطبيق
يساهم تحويل الصوت إلى نص في تعزيز الأمن على المستوى الشخصي وفي المدن والمجتمعات، وكذلك في القطاع التجاري، مع دعم تحسين العمليات التشغيلية للأعمال.
رعاية كبار السن
الاستجابة الفورية لنداءات الاستغاثة أو الحماية من المحتالين.
كافة الأعمال التجارية
الرقابة الآلية على جودة خدمة العملاء (مثل رصد الألفاظ النابية).
مراكز الاتصال
تحويل تسجيلات المكالمات إلى نصوص لمراقبة الامتثال لسياسات الشركة ونصوص المحادثات المعتمدة.
مراقبة المدن
الأمن ومكافحة الإرهاب والتعرف على العبارات التي تنذر بالخطر.
الرقابة الأبوية
المساعدة في حماية الأطفال من التنمر أو التواصل مع المحتالين.
الشرطة
بالإضافة إلى الكاميرات المحمولة على الجسم: تحويل المحادثات مع المشتبه بهم إلى نصوص ورصد التهديدات.
الأبحاث والتحليلات
جمع الإحصائيات في الخلفية لإجراء دراسات متعلقة بالكلام ووتيرة استخدام المفردات.
التسويق
تتبع مناقشات العملاء للحملات الترويجية وردود أفعالهم تجاه اللوحات الإعلانية وغيرها.
التصفية والأتمتة
رصد العبارات غير المرغوب فيها أو الكلمات الرئيسية للمراقبة الموجهة للمحادثات — دون الحاجة للاستماع إليها جميعاً.
مزايا وحدة تحويل الصوت إلى نص
لا تتطلب معدات خاصة
تعمل على أجهزة الكمبيوتر العادية مع معظم الكاميرات وبطاقات الرسوميات.
مرونة تامة
استجابات متنوعة (بما في ذلك استجابات قابلة للبرمجة) وتكامل مع أنظمة الجهات الخارجية.
عمل في الوقت الفعلي
معالجة فورية للتدفقات دون أي تأخير. تعمل على أجهزتك الخاصة.
حل اقتصادي
يمكن شراء الوحدة كإضافة لترخيص Standard أو Pro.
آلية العمل

بناء السلسلة
نظراً لأن الوحدة تعالج التدفق الصوتي، يلزم وجود مصدر صوت في السلسلة.
- مصدر الصوت: ميكروفون مدمج في الكاميرا، أو ميكروفون USB أو IP منفصل
- نموذج للسلسلة: "Universal Camera" – "تحويل الصوت إلى نص" – "المعاينة والأرشيف"
- ترخيص الوحدة متاح كإضافة لترخيص زيوما Pro أو Standard

تحميل موارد الذكاء الاصطناعي
انقر على أيقونة "تحويل الصوت إلى نص" في السلسلة لفتح إعدادات الوحدة. يبدأ تحميل الموارد الإضافية تلقائياً عند فتح الإعدادات لأول مرة. بمجرد اختفاء رسالة "جاري التحميل"، يكون النظام جاهزاً.
- تحتوي الموارد الإضافية على مجموعات بيانات الذكاء الاصطناعي ويتم تحميلها عند الطلب من خوادم فيليناسوفت
- يتم تحميل الموارد فقط عند الحاجة — مما يحافظ على صغر حجم البرنامج

اختر نموذج التعرف والكلمات الرئيسية
تتوفر عدة نماذج ذكاء اصطناعي للغات مختلفة، تختلف في الحجم ودقة التعرف والحمل على الأجهزة. في حقل "نموذج التعرف على الكلام"، اختر لغة النص المفرغ (دون الحاجة لتحديد لغة الكلام المنطوق)، ويمكنك عند اللزوم تحديد كلمات رئيسية لاكتشافها في الحقل أدناه. تتيح لك خيارات "عرض الكلام المتعرف عليه أثناء البث المباشر" و"حفظ الكلام المتعرف عليه في الترجمات عند التسجيل/تصدير الأرشيف" عرض النص المفرغ فوق الفيديو المباشر وفي الأرشيف.
- "الكلمات الرئيسية للاكتشاف" — يستجيب الموديول فقط للكلمات أو العبارات التي تحددها
- تراكب النص المفرغ في المعاينة المباشرة وفي الأرشيف
- "حفظ البيانات في تقرير CSV" — حفظ النص المفرغ في ملف جدول بيانات على القرص
- ربط إجراء استجابة بعد الموديول: تسجيل، إشعار، أو إرسال أمر
- الماكرو
%VOICE%متاح في موديولات "مرسل طلبات HTTP" و"إرسال البريد الإلكتروني" و"مشغل التطبيقات"
التكامل مع البرامج الخارجية
يمكن استخدام ميزة تحويل الصوت إلى نص عبر برامج خارجية — كتفريغ محادثات VoIP مثلًا. زوّد الموديول بملف .mp3 واحصل على النتيجة كنص — حتى على محطات عمل المشغلين التي لا تحتوي على زيوما أو كاميرات. هام: ملفات .mp3 فقط مدعومة.
مثال على طلب عبر واجهة برمجة تطبيقات زيوما (JSON):
curl -F "audio_file=@speech.mp3" "http://192.168.0.67:10090/api?login=Administrator&password=123&speech_recognition=recognition&model=qwen3-asr-1.7b&ttl=10&language=en"
حيث:
audio_file=@speech.mp3— مسار الملف الصوتي على جهازك192.168.0.67— عنوان IP لخادم زيوما10090— منفذ خادم زيوماAdministrator/123— بيانات دخول المسؤول (اسم المستخدم دائماً Administrator) وكلمة المرورmodel=…— نموذج التعرف (راجع القائمة أدناه)language=en— لغة النص المفرغ. إذا اختلفت عن لغة الكلام الفعلي، ستُترجم النصوص تلقائيًا إلى اللغة المحددة
لحفظ النتيجة كملف نصي، أضف >savetext.txt بعد الأمر، حيث savetext.txt هو اسم الملف النصي.
نماذج التعرف الخاصة بـ API:
| الاسم | الوصف | رمز API |
|---|---|---|
| الروسية الأساسية | 140 ميجابايت | tone |
| الروسية المتقدمة | علامات الترقيم، 215 ميجابايت | giga |
| الإنجليزية الأساسية | 70 ميجابايت | zipformer |
| متعدد اللغات (أساسي) | الترقيم، 1 جيجابايت، 0.6 مليار معلمة | qwen3-asr-0.6b |
| Gemma4 متعدد اللغات محسّن | الترقيم، 2.2 جيجابايت، 1.7 مليار معلمة | qwen3-asr-1.7b |
| Gemma4 متعدد اللغات أساسي | الترقيم، 2.2 جيجابايت، 1.7 مليار معلمة | gemma4-e2b |
| Gemma4 متعدد اللغات محسّن | الترقيم، 7 جيجابايت، 12 مليار معلمة | gemma4-12b |
قائمة رموز اللغات
en — الإنجليزية، zh — الصينية، de — الألمانية، es — الإسبانية، ru — الروسية، ko — الكورية، fr — الفرنسية، ja — اليابانية، pt — البرتغالية، tr — التركية، pl — البولندية، ca — الكتالونية، nl — الهولندية، ar — العربية، sv — السويدية، it — الإيطالية، id — الإندونيسية، hi — الهندية، fi — الفنلندية، vi — الفيتنامية، he — العبرية، uk — الأوكرانية، el — اليونانية، ms — الملايوية، cs — التشيكية، ro — الرومانية، da — الدنماركية، hu — المجرية، ta — التاميلية، no — النرويجية، th — التايلاندية، ur — الأردية، hr — الكرواتية، bg — البلغارية، lt — الليتوانية، la — اللاتينية، mi — الماورية، ml — المالايالامية، cy — الويلزية، sk — السلوفاكية، te — التيلوغوية، fa — الفارسية، lv — اللاتفية، bn — البنغالية، sr — الصربية، az — الأذربيجانية، sl — السلوفينية، kn — الكنادية، et — الإستونية، mk — المقدونية، br — البريتونية، eu — الباسكية، is — الآيسلندية، hy — الأرمنية، ne — النيبالية، mn — المنغولية، bs — البوسنية، kk — الكازاخية، sq — الألبانية، sw — السواحلية، gl — الجاليكية، mr — الماراثية، pa — البنجابية، si — السنهالية، km — الخميرية، sn — الشونا، yo — اليوروبا، so — الصومالية، af — الأفريقانية، oc — القسطانية، ka — الجورجية، be — البيلاروسية، tg — الطاجيكية، sd — السندية، gu — الغوجاراتية، am — الأمهرية، yi — اليديشية، lo — اللاو، uz — الأوزبكية، fo — الفاروية، ht — الكريولية الهايتية، ps — الباشتو، tk — التركمانية، nn — النينوشك، mt — المالطية، sa — السنسكريتية، lb — اللوكسمبورغية، my — الميانمارية، bo — التبتية، tl — التغلوغية، mg — الملغاشية، as — الأسامية، tt — التترية، haw — الهاوايية، ln — اللينغالا، ha — الهوسا، ba — الباشكيرية، jw — الجاوية، su — السوندانية، yue — الكانتونية.
كيفية الاختبار
حمّل زيوما وشغّله. استخدم النسخة التجريبية أو فعّل ترخيص Xeoma Standard/Xeoma Pro مع ترخيص الوحدة الإضافية "تحويل الصوت إلى نص".
أضف كاميرا يدوياً أو انتظر حتى يكتشف زيوما الكاميرات في شبكتك تلقائياً. ولتوصيل ميكروفون منفصل، قم بتوصيل وحدة "الميكروفون" واختر مصدر الصوت المناسب.
أضف وحدة "تحويل الصوت إلى نص" إلى السلسلة، وقم بإعداد استجابة للكلمات المفتاحية أو نسخ الكلام المستمر، وإذا لزم الأمر، فعّل تراكب النص المكتوب على صورة الكاميرا والتسجيلات.
حدد استجابة للحدث — مثل الحفظ بصيغة CSV، أو إشعارات الجوال أو أي خيار آخر.
ترخيص تجريبي مجاني
وحدات أخرى لمعالجة البث الصوتي
تعمل هذه الوحدات بشكل مستقل أو بالتكامل مع وحدة تحويل الصوت إلى نص.
اختر ميكروفون USB أو ميكروفون IP منفصل كمصدر للصوت.
يحلل البث الصوتي ويُطلق تنبيهاً عند تجاوز مستوى الصوت حداً معيناً.
يتعرف على إنذارات السيارات، وبكاء الأطفال، وطلقات الرصاص، والصرخات، وتحطم الزجاج.
تحويل الصوت إلى نص: التعرف على الكلام في زيوما
جرب زيوما مجاناً
أدخل اسمك وبريدك الإلكتروني للحصول على ترخيص تجريبي مجاني. لا يُطلب إدخال بطاقة ائتمان.
احصل على تراخيص زيوما التجريبية المجانية عبر البريد الإلكتروني
وظائف كاملة. إرسال فوري.
ننصحك بتجنب استخدام عناوين بريد إلكتروني تحتوي على بيانات شخصية، أو إرسال بيانات شخصية إلينا بأي وسيلة أخرى. وفي حال قيامك بذلك، فإن تقديم هذا النموذج يعني تأكيد موافقتك على معالجة بياناتك الشخصية
هل تحتاج إلى شيء آخر؟
ألا تلبي الوحدة احتياجاتك تماماً؟ يمكننا تطوير الوظائف التي تحتاجها وإضافتها إلى زيوما كتطوير مدفوع. عرض التفاصيل.
لديك أسئلة؟ تحتاج إلى مساعدة؟ تواصل معنا! يسعدنا مساعدتك!
مستعد للبدء؟
جرّب ميزة تحويل الصوت إلى نص برخصة تجريبية مجانية — دون الحاجة إلى بطاقة ائتمان أو بيانات شخصية.

