مباشر
أين يمكنك متابعتنا

أقسام مهمة

Stories

57 خبر
  • نبض الملاعب
  • العملية العسكرية الروسية في أوكرانيا
  • فيديوهات
  • نبض الملاعب

    نبض الملاعب

  • العملية العسكرية الروسية في أوكرانيا

    العملية العسكرية الروسية في أوكرانيا

  • فيديوهات

    فيديوهات

  • إسرائيل تواصل غاراتها على لبنان

    إسرائيل تواصل غاراتها على لبنان

  • هدنة وحصار المضيق

    هدنة وحصار المضيق

  • فتاة توثق قصف نظام كييف على مدرسة لوغانسك وترسل فيديوهات لأقاربها قبل وفاتها

    فتاة توثق قصف نظام كييف على مدرسة لوغانسك وترسل فيديوهات لأقاربها قبل وفاتها

روسيا.. ابتكار أول برنامج وطني لتوليد المحتوى الصوتي بالذكاء الاصطناعي

طوّر باحثو جامعة نوفوسيبيرسك التقنية الروسية أول برنامج وطني لتوليد المحتوى الصوتي بالذكاء الاصطناعي.

روسيا.. ابتكار أول برنامج وطني لتوليد المحتوى الصوتي بالذكاء الاصطناعي
صورة إرشيفية / abc-av.ru

أفاد بذلك  المشرف على المشروع يغور أنتونيانتس في حديث أدلى به لوكالة "تاس" الروسية.

يهدف هذا التطوير إلى المهام التي تتطلب إنتاجا مستقلا للمقطوعات الموسيقية والأجزاء الغنائية والمؤثرات الصوتية بناء على أوصاف نصية دون الارتباط بخدمات سحابية. ووفقا للمطورين، يوفر النظام دورة كاملة لإنتاج المحتوى الصوتي،  بدءا من الطلب النصي ووصولا للتصدير إلى المنصات واسعة الاستخدام WAV و MP3 و FLAC، ويعمل النظام  في نفس الوقت على أجهزة استهلاكية بحجم ذاكرة فيديو أقل من 6 غيغابايت.

وأشار أنتونيانتس إلى أن  "الميزة الرئيسية لتطويرنا هي الاستقلالية الكاملة عن المنصات الأجنبية وإمكانية العمل في بيئة مغلقة. لقد قمنا بضبط النموذج الأساسي باستخدام محولات LoRA المتخصصة لثلاثة أنواع من المحتوى، وهي الموسيقى الآلية، والأغاني المصحوبة بصوت بشري، والمؤثرات الصوتية، مما يتجنب تأثير اختلاط الخصائص ويحقق تطابقا أدق مع الطلب".

وعلى عكس الحلول الأساسية الموجهة للمستخدمين الناطقين بالإنجليزية، فإن الأداة الجديدة مهيأة للعمل مع الاستعلامات الناطقة بالروسية وتُظهر نتائج تنافسية. فقد بلغ متوسط معيار التقييم الذاتي MOS 4.1 من أصل 5 نقاط، وهو ما يُقارن بمعدلات المنصات التجارية الرائدة.

وأوضح مطور المشروع أرتور خوساينوف قائلا: " من ناحية تقنية تتم المعالجة على عدة مراحل: يقوم نموذج لغوي أولا بتشكيل هيكل دلالي للمقطوعة باستخدام سلسلة من التفكير، ثم يقوم المحول الانتشاري (diffusion transformer) بالتركيب الصوتي في الفضاء الكامن، أما وحدة التصدير فتقوم بتحويل المحتوى إلى الصيغ المستهدفة. وتسمح الواجهة الرسومية المدمجة بإدارة المشاريع، وحفظ وتحميل إعدادات التوليد المسبقة، والمعاينة قبل الاستماع، وتصدير المسارات دون الحاجة إلى محررات خارجية".

وأكد مبتكرو البرنامج أنهم يخططون مستقبلا لتوسيع النظام، بما في ذلك إضافة دعم الصوت المكاني لتطبيقات الواقع الافتراضي، وتنفيذ التكامل مع وحدات تحكم MIDI للتفاعل الحي، وتكييف البرنامج للسيناريوهات الصناعية،  بدءا من إنشاء مقاطع صوتية لألعاب الفيديو ووصولا إلى الدبلجة الآلية للأفلام والبث المباشر والبودكاست والإعلانات التجارية.

المصدر: تاس

التعليقات

إيران توجه تحذيرا لواشنطن بعد الضربة الأخيرة: ردنا سيتجاوز الإقليم

الأمن الفيدرالي الروسي: اغتيال القيادة الإيرانية جرى باستخدام برمجيات خبيثة في أنظمة المراقبة

خامنئي يوجه رسالة إلى الحكومات الإسلامية

قراءة إسرائيلية لطلب ترامب تطبيع السعودية ودول أخرى مع إسرائيل.. لماذا ذكر مصر والأردن وتركيا؟

مصدر عسكري لتسنيم: التحقيقات الفنية تؤكد وقوف إسرائيل وراء هجمات بمسيرات استهدفت الإمارات

"سي إن إن" عن مصدر سعودي: المملكة لن تطبع مع إسرائيل إلا بعد وجود مسار واضح نحو إقامة دولة فلسطينية

برنياع: كلما كان الزئير أكبر كانت الهزيمة أعمق.. الحرب مع إيران انكشاف إستراتيجي لإسرائيل وأمريكا

لبنان لحظة بلحظة.. إسرائيل تقيد أعداد التجمعات و"حزب الله" يحيي ذكرى تحرير الجنوب

جهود نتنياهو لإعادة تشكيل الشرق الأوسط تأتي بنتائج عكسية

زاخاروفا: المحكمة الجنائية الدولية "تجمّع غير شرعي" يحمي الغرب ويحاكم قادة إفريقيا

كاتب إسرائيلي: الفشل الأمريكي في إيران يتحول إلى كارثة في إسرائيل التي تواجه أخطر وضع في تاريخها

معارك ضارية مع الجيش الإسرائيلي في جنوب لبنان و"حزب الله" ينفذ 32 عملية عسكرية نوعية في يوم واحد فقط

ترامب: اليورانيوم الإيراني عالي التخصيب سيسلم فورا للولايات المتحدة أو يدمر في مكانه

الخارجية الروسية: لافروف تحدث مع روبيو وأبلغه ببدء القوات الروسية شن ضربات منظمة على منشآت في كييف

مدفيديف تعليقا على رفض بروكسل إجلاء دبلوماسييها من كييف: يبدو أن لديهم فائضا ويريدون تقليص عددهم