سونو تطلق Speech تجريبياً: أول موديل يولّد الكلام والموسيقى معاً في مسار واحد

سونو تطلق ميزة Speech التجريبية لتوليد الكلام المنطوق والموسيقى في مسار واحد. ما الجديد فعلاً، من يستفيد منها، وما حدودها قبل الاعتماد عليها إنتاجياً.

سونو تطلق Speech تجريبياً: أول موديل يولّد الكلام والموسيقى معاً في مسار واحد
جدول المحتويات

أطلقت شركة سونو مساء يوم 1 أكتوبر 2026 ميزة «Speech» في نسخة تجريبية مفتوحة للجميع، وهي ميزة تصفها الشركة بأنها أول موديل صوتي يولّد الكلام المنطوق والموسيقى المصاحبة له معاً في مسار واحد متماسك. بدلاً من أن تسجّل صوتك ثم تبحث عن موسيقى خلفية من مكتبة منفصلة، تكتب النص وتصف نوع الصوت والطابع الموسيقي، فيخرج المسار جاهزاً بهوية واحدة من أول ثانية إلى آخرها.

الإعلان وقع في تدوينة رسمية بعنوان «Introducing Speech (beta)» بقلم جاك برودي، مدير المنتجات في سونو، وصف فيها الميزة بأنها «طريقة جديدة للتعبير عن إبداعك». وهذا الإطلاق يكمل مسار الشركة خلال الأسابيع الماضية الذي بدأ بإطلاق موديلات v6 المرخّصة بالتعاون مع شركات الموسيقى، ثم أداة Suno Studio 2.0 لصناع المحتوى المحترفين — وهو مسار يحوّل سونو من «مولّد أغانٍ» إلى منصة إنتاج صوتي متكاملة.

سونو تعلن ميزة Speech التجريبية لتوليد الكلام والموسيقى معاً
الصورة الرسمية للإعلان من مدونة سونو، 1 أكتوبر 2026.

كيف تعمل الميزة؟

آلية الاستخدام كما شرحتها الشركة بسيطة في ظاهرها: تكتب فكرتك — قصيدة، نص، فكرة، أو حتى شيئاً كتبته سابقاً — ثم تصف الصوت الذي تريده والطابع الموسيقي المناسب، وينتج النظام مساراً صوتياً كاملاً يجمع الأداء الصوتي والتوزيع الموسيقي. الفكرة التقنية الجديدة هنا هي الدمج نفسه: الكلام والموسيقى يتولدان معاً فيعملق واحد، فيتطابق الإيقاع والمزاج مع المعنى بدلاً من تركيبهما لاحقاً بالبريد القديم: تسجيل، ثم مونتاج، ثم بحث عن موسيقى «تشبه» المشاعر.

وقد نشرت سونو فيديو تعليمياً رسمياً على قناتها يشرح خطوات الاستخدام من داخل المنصة:

الفيديو التعليمي الرسمي من قناة Suno على يوتيوب.

واجهة ميزة Speech في سونو لتوليد الكلام والموسيقى
صورة رسمية من تدوينة الإطلاق توضح هوية الميزة البصرية.

من التجارب الأولى إلى الجميع

سونو لم تطلق الميزة على عواهنها: الشركة قالت إنها أمضت الشهر الماضي في اختبار Speech مع مجموعة صغيرة من المستخدمين، وأن أبرز ما خرج من هذه الاختبارات كان استخدامات لم تتوقعها الشركة نفسها — قراءات درامية لرسائل الأصدقاء، مقطوعات موسيقية ملحمية لمقاطع صوتية عادية، جلسات تأمل، قصائد، كلمات تحفيزية، وقصص ما قبل النوم. هذا التنوع هو رسالة الإعلان الحقيقية: الميزة ليست موجّهة للاستوديوهات فقط بل لأي شخص يملك نصاً ويريد أن يسمعه بصوت حي.

ماذا يعني هذا لك كصانع محتوى؟

الفئة الأكثر استفادة عربياً هي من يصنعون المحتوى الصوتي أو يحتاجون مقدمات صوتية لأعمالهم: صناع الريلز والشورتس الذين يريدون مقدمة موسيقية مع جملة تعريفية، أصحاب القنوات التعليمية الذين يحوّلون مقالاتهم إلى صوت، ومن يجهّزون مواد إعلانية قصيرة. الأثر العملي هو اختصار ثلاث خطوات (كتابة، تسجيل، تلحين) في واحدة، مع إمكانية التجريب السريع: عشرة اقتراحات لنفس النص بعشرة أمزجة مختلفة قبل أن تختار.

لكن هنا يجب التوقف عند حقائق صريحة. الإعلان الرسمي لم يذكر قائمة اللغات المدعومة، ولم يذكر العربية إطلاقاً — لذا لا يمكننا تأكيد جودة الأداء الصوتي العربي قبل التجربة الفعلية، ومقاطع الشرح أشارت إلى أن النسخة الحالية قد تتذبذب في حتى اللهجات الإنجليزية نفسها. كما أن التدوينة لم تتضمن تفاصيل عن حدود الاستخدام أو التكلفة أو حقوق الاستخدام التجاري للمسارات الناتجة، وهذه معلومات يجب مراجعتها في شروط المنصة قبل أي عمل تجاري، خاصة أن ملف سونو القانوني مع شركات الموسيقى معقّد تاريخياً رغم تحولها الأخير نحو الترخيص الرسمي مع شركات مثل BMG وBelieve وTuneCore.

إن أردت نقطة انطلاق، ابدأ من النص نفسه: منصة ARWriter تكتب لك النص العربي أو الإنجليزي المنظم للإلقاء — مقدمة قناة، دعاء مؤدى، سرد قصة — ثم تأخذه إلى Speech لتوليد الأداء الصوتي الكامل. وقد غطينا سابقاً إطلاق موديلات سونو v6 المرخّصة بالتفصيل لمن يريد فهم خلفية الترخيص.

لمن هذه الأداة تحديداً؟

عند تقييم أي أداة جديدة، السؤال الأهم ليس «ماذا تفعل» بل «أين تختصر عليّ أنا عملاً حقيقياً». هذه أكثر الفئات استفادة ظاهرة من Speech وفق ما أعلنته الشركة عن استخداماتها الاختبارية:

  • صناع المحتوى القصير: مقدمة صوتية موسيقية لهوية قناة، فواصل بين الفقرات، خاتمة تترك أثراً — كل ما كان يتطلب ملحّناً ومؤدياً يصبح مساراً واحداً متكرراً بتكلفة صفري تقريباً.
  • المحتوى التأملي والتعليمي: جلسات تأمل وتمارين تنفس وقصص ما قبل النوم كانت أبرز استخدامات الاختبار الخاص، وهي سوق ضخمة عربياً حيث يبحث الجمهور عن صوت هادئ موصول بموسيقى خفيفة.
  • أصحاب المتاجر والعلامات الصغيرة: إعلانات صوتية قصيرة للراديو الرقمي والبودكاست بميزانية صفر، مع إمكانية توليد عشر نسخ من نفس النص واختيار الأنسب قبل الإطلاق.
  • المؤلفون والشعراء: تحويل قصيدة أو فصل إلى أداء مسموع دون استئجار استوديو — وهي نقطة تحول لمن يريد «كتاباً صوتياً» تجريبياً قبل استثمار الإنتاج الكامل.

ولو دعمت الميزة العربية بجودة مقبولة — وهو ما لم يؤكده الإعلان كما أسلفنا — فستكون إضافة نوعية للمحتوى العربي الصوتي الذي يعاني من نقص أدوات الاحتراف مقارنة بالإنجليزية.

ماذا يعني هذا للصناعة الأوسع؟

خلف الميزة تقوم مواجهة اقتصادية أكبر. سوق الموسيقى الترخيصية التقليدية — التي تدفع لها المتاجر والوكالات آلاف الدولارات سنوياً مقابل موسيقى خلفية — تجد نفسها أمام مولّد يصنع الموسيقى والصوت معاً بلا وسطاء. ومؤدو الأصوات المحترفون يواجهون سؤالاً مزدوجاً: المنافسة من جهة، وفرصة استخدام الميزة لتوسيع إنتاجهم من جهة أخرى. كما أن خطوة سونو تأتي في سياق سباق واضح: شركات الصوت الكبرى تتجه نحو دمج التوليد في أدواتها، وسونو تريد أن تكون «منصة الصوت الشاملة» قبل أن تلحق بها البقية — فبعد أن حسمت قضية الترخيص بالشراكات الرسمية، صار التوسع نحو الكلام المنطوق الخطوة المنطقية التالية لجذب جمهور أوسع من صناع الأغاني.

كيف تجربها اليوم؟

  1. ادخل إلى حسابك في سونو وابحث عن وضع Speech داخل المنصة.
  2. ابدأ بنص قصير لا يتجاوز فقرة — فكرة واحدة واضحة.
  3. اصف الصوت بدقة («رجل بصوت دافئ، إيقاع هادئ، موسيقى بيانية خفيفة») بدل وصف عام («صوت جميل وموسيقى لطيفة»).
  4. ولّد ثلاث نسخ مختلفة الطابع من نفس النص وقارنها بأذنك قبل الحكم على الميزة كلها.
  5. سجّل ملاحظاتك عن اللغات التي جرّبتها — هذه المعلومة ستحدد قيمتها لعملك لاحقاً.

مقارنة سريعة: أين تقف Speech من بدائلها؟

الأداةالكلام المنطوقالموسيقىالدمج في مسار واحد
سونو Speech (تجريبي)نعمنعمنعم — وهي الميزة المعلنة
مولّدات الصوت التقليدية (مثل ElevenLabs)نعم وبجودة عاليةلالا — تركيب يدوي
مولّدات الموسيقى (مثل سونو نفسها للأغاني)غناء فقطنعمجزئياً — غناء لا كلام منطوق

الخلاصة: القيمة الجديدة ليست في توليد الصوت ولا في توليد الموسيقى منفردَين — كلاهما موجود منذ سنوات — بل في صنعهما معاً بإيقاع واحد.

حدود وعيوب يجب قولها بصدق

سونو نفسها لم تدّعِ الكمال، بل كتبت بحرفية عالية أن «التجريبي يعني تجريبي فعلاً»: اللهجة البريطانية قد «تشرد إلى الأسترالية وتعود»، والوقفات الدرامية قد تكون «درامية جداً». أضف إلى ذلك أن الأداة في نسخة تجريبية أولى قد تتغير قواعد استخدامها بسرعة، وأن غياب تفاصيل الخطط والأسعار من الإعلان يجعل الاعتماد عليها إنتاجياً في هذه المرحلة رهاناً مبكراً. كما أن جودة الكلام المولّد تُقاس بالتفاصيل الدقيقة — نبرة نهاية الجملة، والوقفات الطبيعية، والنطق السليم للأسماء — وهي بالضبط ما لا يظهر في العروض التسويقية ويظهر فور الاستخدام الفعلي المطوّل. الأصح الآن هو التجربة والتعلم، لا بناء خط إنتاج كامل فوقها.

أسئلة شائعة

هل تدعم ميزة Speech اللغة العربية؟

الإعلان الرسمي لم يذكر قائمة لغات، والعربية غير مؤكدة. الطريقة الوحيدة للتحقق هي التجربة الفعلية داخل المنصة وتقييم النتيجة بأذنك قبل الاعتماد عليها.

هل الميزة مجانية؟

التدوينة الرسمية لم تحدد خطط أو أسعاراً للميزة. سونو تعمل بنظام اشتراكات معروض على صفحة أسعارها، وعلى المستخدم مراجعة حدود خطته الحالية هناك.

هل يمكنني استخدام الناتج تجارياً؟

الإعلان لم يتناول حقوق الاستخدام التجاري للمسارات الصوتية الناتجة عن Speech. راجع شروط الاستخدام وخطة اشتراكك في سونو قبل أي استخدام تجاري، فالحقوق تختلف عادة بين الخطط.

ما الفرق بين Speech والأغاني التي تولّدها سونو أصلاً؟

الأغاني تقوم على الغناء، بينما Speech تولّد كلاماً منطوقاً — كقارئ نصوص — مصحوباً بموسيقى أصلية مولّدة معه في المسار نفسه.

متى أُطلقت الميزة؟

أُعلنت في 1 أكتوبر 2026 كنسخة تجريبية مفتوحة للجميع بعد شهر من الاختبار الخاص مع مجموعة صغيرة من المستخدمين.

المصادر

المصدر الأولي: تدوينة Introducing Speech (beta) على مدونة سونو الرسمية بقلم جاك برودي (1 أكتوبر 2026)، والفيديو التعليمي الرسمي على قناة الشركة. وللاستماع لتحليل أوسع لتطور المنصة اقرأ تغطيتنا لـإطلاق Suno Studio 2.0، أو استعرض أدوات الكتابة في ARWriter لأفكار نصوص جاهزة للتحويل الصوتي.