تكنولوجيا

سونو تطلق نموذج v6 بمشاركة شركات التسجيلات… لكنه ما زال يخفق في محاكاة العيوب البشرية

أعلنت شركة سونو (Suno) إطلاق نموذجها الموسيقي الجديد v6 بالذكاء الاصطناعي، وهو أول نموذج تطوره الشركة بمساعدة مباشرة من صناعة التسجيلات الموسيقية. وقال جاك برودي من سونو لموقع ذا فيرج إن النموذج الجديد «تم تدريبه من الصفر، بمجموعة بيانات جديدة لا تتضمن نفس البيانات التي دُربت عليها نماذجنا السابقة».

تشمل بيانات التدريب محتوى مرخصاً من شركاء مثل مجموعة وارنر ميوزيك وBMG وبيليف، إلى جانب «بيانات المستخدمين». ومع ذلك، لا يتضح حتى الآن ما إذا كانت بيانات تدريب v6 خالية تماماً من المحتوى المشكوك في طريقة الحصول عليه.

ثلاثة نماذج مختلفة ووظائف جديدة

من أبرز التغييرات في v6 أن الإصدار يشمل ثلاثة نماذج منفصلة: v6 وv6-wild وv6-mini. نموذج mini متاح مجاناً للجميع ويركز على الإنشاء السريع والخفيف الموارد، لكن النتائج التي ينتجها أبسط وغالباً ما تحمل آثاراً تكشف أنها من إنتاج الذكاء الاصطناعي. أما v6-wild فمصمم ليكون أقل قابلية للتوقع، وقال برودي إنه موجه لـ«الأخطاء السعيدة والعيوب الطبيعية». لكن في اختبار محدود، كان من الصعب ملاحظة فرق بين wild والنموذج القياسي v6.

وتحسنت النماذج الثلاثة بشكل كبير في فهم الأنواع الموسيقية. فعند إعادة استخدام أوامر نصية طلبت موسيقى «هايبربوب» أو «كراوتروك» وفشلت مع النماذج الأقدم، أصاب v6 العلامات السطحية لكل نوع طُرح عليه. لكنه لا يزال عاجزاً عن تقديم «العيوب الطبيعية» الحقيقية: فمحاولات الحصول على نتائج نشاز أو خارج الطبقة أو متنافرة فشلت في كل مرة، مهما كان الضغط على النموذج.

وحتى عند طلب «غناء بنبرة واحدة» و«بدون طبول»، تجاهل النموذج الأمر تماماً. كما أن الطلبات المتكررة للحصول على «بيانو نشاز يُعزف بعشوائية دون اعتبار للمقام أو الإيقاع» و«خارج الطبقة تماماً عن بقية الأغنية» لم تنتج شيئاً من هذا القبيل. في المقابل، يحتفظ v6 بالعيوب غير الطبيعية للموسيقى المولدة بالذكاء الاصطناعي، إذ يبدو أن الغناء ينتج آثاراً حادة الحواف أكثر من v5.

تعديل الأغاني بالمحادثة ودمج العناصر

يتضمن v6 أيضاً تحديثات جوهرية تغير طريقة تفاعل المستخدمين معه. يمكن للمستخدمين الآن تعديل أجزاء من الأغنية بلغة عادية داخل محادثة، وتغيير عناصر فردية مثل خط الغيتار أو كلمة من الكلمات دون إعادة توليد المقطع كاملاً. كما يستطيع v6 دمج عناصر متعددة من مكتبة المستخدم في سونو لتكوين إبداعات جديدة. ولم تعد الأوامر النصية مقصورة على الوصف الكتابي، إذ يمكن إنشاء مقاطع بناءً على صور أو فيديو أو صوت آخر.

يبدأ طرح سونو v6 اليوم، وتقول الشركة إنها ستسحب نماذجها السابقة في نهاية المطاف.

المصدر: theverge

زر الذهاب إلى الأعلى