← العودة إلى المدونة
Aiحوالي 1 دقيقة قراءة

Suno يتحدث الآن، ويجلب موسيقاه التصويرية الخاصة به

نُشر في 2 أكتوبر 2026
Suno يتحدث الآن، ويجلب موسيقاه التصويرية الخاصة به

في 1 أكتوبر، أطلقت Suno ميزة Speech في نسخة تجريبية عامة لكل المستخدمين على الويب وiOS وAndroid. تكتب فكرة أو قصيدة أو نصًا كتبته بالفعل، ثم تصف الصوت والمزاج الموسيقي الذي تريده خلفه. وتعيد Speech الاثنين في مقطع واحد.

وصف جاك برودي، رئيس المنتجات في Suno، هذه الميزة في الإعلان بأنها أول نموذج صوتي يولّد الصوت والموسيقى معًا في مقطع واحد متماسك. هذا التأطير هو المنتج بأكمله. فهناك أدوات كثيرة تنتج صوتًا صناعيًا، وأدوات كثيرة تنتج موسيقى. والوعد هنا هو أن الإيقاع والمزاج يُطابقان المعنى أثناء توليد الاثنين معًا، بدل أن يُجمعا لاحقًا في محرر، وهو المصير الذي لطالما انتهت إليه كل مقدمة بودكاست هاوية.

الآليات بسيطة عن قصد. يأخذ الوضع البسيط وصفًا باللغة الطبيعية، مثل «قبطان بحري يحمس طاقمه قبل عاصفة»، ويولّد الكلام والموسيقى معًا. أما الوضع المتقدم فيأخذ نصًا دقيقًا ويكشف عن عناصر تحكم في جنس الصوت، والأسلوب الصوتي، والإيقاع، ومقدار التنوع في كل عملية توليد. وهناك مفتاح لإزالة الموسيقى تمامًا إذا أردت سردًا نظيفًا فقط. وتحد النسخة التجريبية التوليد عند نحو ثماني دقائق.

ماذا تعني كلمة «بيتا» هنا

تتسم Suno بصراحة غير معتادة بشأن حالة الميزة. تقول ملاحظة برودي إن اللكنة البريطانية قد تشرد أحيانًا إلى أستراليا ثم تعود، وإن الوقفات الدرامية قد تكون درامية جدًا. هذا النوع من الإفصاح أندر مما ينبغي في منشورات الإطلاق، وهو يخبرك بشيء عن أين لا يزال نموذج الصوت.

كما لم تذكر الشركة أي لغات مدعومة، ما يعني أن الأداء خارج الإنجليزية غير مُتحقق منه حتى تجرّبه. وبما أن جمهور Suno الحالي عالمي، فإن غياب قائمة لغات في إطلاق ميزة الكلام هو إشارة وليس سهوًا. استنساخ الصوت صعب في الإنجليزية وأصعب في لغات ذات أنظمة نغمية أغنى، وSuno تطلق المنتج قبل أن تستطيع أن تعِد بالكثير.

ولم يُقل شيء أيضًا عن مستويات التسعير، أو حدود التوليد، أو الحقوق التجارية للصوت. فهذه توجد في تفاصيل الخطط، وعلى أي شخص يخطط لاستخدام Speech في أعمال العملاء أن يقرأها بعناية، نظرًا لتاريخ Suno.

التحول نحو الترخيص

شكّل العام الماضي تحولًا بطيئًا لـ Suno من كشط البيانات إلى إبرام الاتفاقيات. في 9 سبتمبر، أصدرت v6، وهو جيل من نماذج الموسيقى بُني مع Warner Music Group وBMG وBelieve. وتتكون العائلة من ثلاثة أجزاء: الطراز الرائد v6 وv6-wild الموجّه للاستكشاف لمشتركي Pro وPremier، وv6-mini للجميع. وتقول Suno إن v6 يمكنه تعديل جزء من أغنية موجودة باستخدام لغة عادية، وبناء مزيج من عدة مصادر في طلب واحد، وعزل الصوت لبناء إيقاع جديد، وإنشاء موسيقى من النص والصوت والصور والفيديو، وإعادة كتابة كلمة غنائية واحدة دون إعادة بناء الأغنية كاملة. ومع طرح v6، تخطط الشركة لسحب نماذجها الأقدم ونقل المنصة بالكامل إلى الجيل الجديد.

هذه ترقية حقيقية في القدرات، وهي أيضًا استراتيجية قانونية. فصفقات الترخيص تحوّل Suno من مدّعى عليه إلى شريك، وتجارب الفنانين القائمة على الموافقة المسبقة التي تقول الشركة إنها تبنيها، حيث يختار الفنانون المشاركة ويتقاضون أجرًا، هي شكل عمل يريد أن يتوقف عن التعرّض للدعاوى.

لم تتوقف الدعاوى. قاضت Sony Music وUniversal Music Group شركة Suno بسبب انتهاك حقوق النشر، وفي سبتمبر 2026 وسّعت شركات التسجيلات القضية باتهام بغسل النماذج: استخدام نماذج أقدم يُزعم أنها منتهكة لتوليد صوت اصطناعي لتدريب نماذج أحدث. وهذا ادعاء أحدّ من التدريب على أغانٍ جُمعت بالكشط، لأنه يصف سلسلة انتهاك تستمر بعد أن تعلن شركة أنها نظّفت سجلها.

وفي الوقت نفسه، قال الرئيس التنفيذي ميكي شولمان لبلومبرغ في اليوم نفسه الذي أُطلقت فيه Speech إن Suno تجاوزت بكثير مليوني مشترك و300 مليون دولار من الإيرادات التي أعلنتها آخر مرة. شركة بهذا الحجم تتوسع إلى الكلام تفعل أكثر من مجرد إضافة ميزة. إنها تبني محفظة من أدوات الصوت التوليدي ضمن اشتراك واحد كي يجد العميل سببًا أقل للرحيل.

الفئات التي يقلّص هذا العمل مهامها

السؤال الصحيح عن أي أداة جديدة ليس ما تفعله، بل عمل مَن تحلّ محله. واستنادًا إلى الاستخدامات التي أبلغت عنها Suno خلال شهر من الاختبار الخاص، هناك أربع فئات ستشعر به فورًا.

صانعو الفيديوهات القصيرة هم الفئة الأنسب بشكل واضح. مقدمة موسيقية مميزة، وانتقالات بين المقاطع، ونغمة ختامية: أصول كانت تتطلب ملحنًا وجلسة تسجيل تأتي الآن من عملية توليد واحدة. التقليص حقيقي، لأن خط الإنتاج القديم كان فيه خطوة صعبة يطابق فيها إنسان مقطعًا موسيقيًا مع نص، وهذه الخطوة صارت الآن داخل النموذج.

ويحصل صنّاع البودكاست على نسخة أيضًا. فمقطع مروي تحته موسيقى أصلية كان مشكلة من شقين وصار الآن شقًا واحدًا، كما أن مفتاح إيقاف الموسيقى يعني توفر قراءة نظيفة عندما يحتاجها عميل.

الفئة الثالثة أقل وضوحًا وربما أكبر. تميل حالات الاختبار التي أبلغت عنها Suno بقوة إلى محتوى شخصي وشبه شخصي: قراءات درامية لرسائل نصية من الأصدقاء، وملاحظات صوتية بموسيقى ملحمية، وتأملات موجّهة، وخطب تحفيزية، وقصص ما قبل النوم لأطفال الفريق أنفسهم. وهذا هو النمط نفسه الذي سار عليه مولّد الأغاني في Suno. فقد أصبح عنصرًا أساسيًا في أعياد الميلاد والنكات الداخلية قبل أن يصبح أداة إنتاج، والشركة تضع Speech في المسار نفسه، وتسمي الفئة «ترفيه إبداعي».

المنافسون موجودون في الساحة بالفعل. تهيمن ElevenLabs على تركيب الصوت منذ 2023، ولدى Adobe أداة تحويل النص إلى كلام، وتعمل Google DeepMind على الكلام منذ عقد. ميزة Suno ليست جودة الصوت، التي تشير تحذيرات النسخة التجريبية إلى أنها متأخرة عن المتصدرين. بل هي الاقتران: وصف واحد، وتسجيل واحد، وكلمات منطوقة وموسيقى أصلية تتناسب مع بعضها بالفعل.

الجزء غير المحسوم

تبدو الفجوة بين قصة منتج Suno وقصتها القانونية هي موضع الاهتمام. فتوسّع Speech ما يمكن للمنصة أن تنتجه، وتوسّع أيضًا ما يمكن اتهام المنصة بإنشائه. أداة صوت تنتج سردًا بالأسلوب الذي يختاره المستخدم تقترب من انتحال الشخصية، ونموذج يولّد الموسيقى إلى جانب الكلام يرث كل سؤال حول بيانات التدريب يدور حوله الجدل بالفعل في جانب الموسيقى.

جواب Suno حتى الآن هو الصفقات والإفصاح. فقد وقّعت مع شركات التسجيلات، وأضافت فحصًا للصوت والكلمات المرفوعة، ووعدت بخيارات مشاركة للفنانين مع الدفع. هذا أكثر مما فعلته معظم شركات الصوت التوليدي. وهو أيضًا ليس جوابًا نهائيًا، لأن ادعاء غسل النماذج، إن صحّ، يصف مشكلة داخل تاريخ تدريب Suno نفسه وليس على أطرافه.

ما تجيده Speech هو إزالة خطوة كانت تتطلب متخصصين اثنين وحجز جلسة. وما لا تفعله هو حسم ما إذا كانت النماذج التي تقف خلفها قد بُنيت بالطريقة التي تقول الشركة الآن إنها تبني بها. سيبقى هذان السؤالان يسيران بالتوازي، وسيُجاب عن واحد منهما فقط باستخدام المنتج.

مقالات ذات صلة