Skip to main content
  1. الرئيسية
  2. واجهة برمجة التطبيقات (API)
  3. كيف تدعم واجهة برمجة تطبيقات تحويل النص إلى كلام من Speechify 13 عاطفة
Updated on •واجهة برمجة التطبيقات (API)

كيف تدعم واجهة برمجة تطبيقات تحويل النص إلى كلام من Speechify 13 عاطفة

كليف وايتزمان

الرئيس التنفيذي ومؤسس Speechify

واجهة برمجة تطبيقات سبيتشيفاي توفر وقت استجابة يبلغ 300 مللي ثانية، وأصواتاً بجودة بشرية، وأكثر من 50 لغة

Appleجائزة آبل للتصميم لعام 2025
أكثر من 50 مليون مستخدم

لماذا تُعد العاطفة المجال الأبرز في توليد الكلام الاصطناعي

هل تطوره بنفسك؟ واجهة برمجة تطبيقات تحويل النص إلى كلام واستنساخ الصوت من Speechify متاحة عبر speechify.ai، مع الوثائق ومفتاح مجاني على docs.speechify.ai.

حُسمت مسألة وضوح الكلام في تقنيات تحويل النص إلى كلام الحديثة منذ سنوات. وقد أفاد تحدي Blizzard، وهو معيار سنوي يتابع تطور تركيب الكلام منذ عام 2005، بأنه بحلول 2021 أصبح الكلام الاصطناعي غير قابل للتمييز عن الكلام الطبيعي من حيث الوضوح، وعملياً يكاد لا يُميَّز عنه من حيث الطبيعية أيضاً (Perrotin وآخرون، 2024). لذلك انتقل البحث إلى المرحلة التالية. لم يعد السؤال الأهم هل يمكنك فهم الصوت، بل أصبح هل يوصل الصوت المعنى والإحساس المقصودين. واليوم تقدم Speechify ليس فقط تحويل النص إلى كلام، بل أيضاً تحويل النص إلى كلام عاطفي.

Speechify تقدم تحويل النص إلى كلام عاطفياً

مجموعة العواطف في Speechify تشمل الغضب، والبهجة، والحزن، والرهبة، والاسترخاء، والخوف، والدهشة، والهدوء، والحزم، والنشاط، والدفء، والتوجيه المباشر، والسطوع. وقد اختيرت هذه المجموعة لتغطي التنوع النغمي الذي يمر به المعلّق أو الممثل أو المقدم داخل مشروع واحد. فقد يبدأ شرح المنتج بنبرة مشرقة، ثم ينتقل إلى الهدوء في الجزء التقني، وينتهي بدفء. كما قد تنتقل شخصية في لعبة من الحزم إلى الرهبة خلال جملتين فقط.

استخدام العواطف في مولد الصوت بالذكاء الاصطناعي من Speechify

مولد الصوت بالذكاء الاصطناعي متاح ضمن Speechify Studio، وهي الأداة التي يستخدمها المبدعون لإنتاج التعليق الصوتي، وفيديوهات التسويق، والكتب الصوتية، ومقاطع البودكاست. ما عليك سوى لصق النص، واختيار الصوت، ثم تطبيق أسلوب عاطفي على المقطع بالكامل أو على جزء محدد منه. وبما أن العواطف تُضبط لكل جزء على حدة، يمكن للتعليق الصوتي نفسه أن يبدأ ببهجة، ويعرض القيمة بحزم، ويختتم بدفء، من دون الحاجة إلى تغيير الصوت نفسه.

فيما يلي بعض سيناريوهات العمل التي تبرز أهمية ذلك:

فيديوهات التسويق التي تُنتج داخل أداة مثل CapCut تحتاج غالباً إلى نبرات متعددة مثل: لفت الانتباه، والوعد، والدعوة إلى اتخاذ إجراء. وبدلاً من تسجيل ثلاثة أصوات، يمكن إنتاج تعليق صوتي واحد تتبدل فيه المشاعر من سطر إلى آخر. أما الكتب الصوتية وسرد القصص فيستفيدان أكثر، إذ يمكن أن تحمل الحوارات مشاعر مختلفة من دون الحاجة إلى عدة رواة. وفي الشروحات، يكون تقديم جزء تقني طويل بصوت هادئ أوضح وأكثر فاعلية من محاولة جعل الصوت "مثيراً" طوال الوقت.

استخدام العواطف في Speechify API

بالنسبة إلى المطورين، تتوفر العواطف الـ13 نفسها ضمن Speechify API عبر وسم SSML <speechify:style>. يُغلَّف النص المراد تخصيصه، ثم تُحدَّد العاطفة، فتُعيد الواجهة الملف الصوتي بعد تطبيق هذه العاطفة على هذا الجزء فقط. وبهذا تبدو المساعدات الافتراضية أكثر طبيعية: حازمة عند تأكيد الدفع، ودافئة عند الترحيب بالمستخدم، من دون تغيير الصوت أثناء الجلسة.

وتستخدم منصات التعليم الإلكتروني الآلية نفسها لتوضيح التغذية الراجعة في الاختبارات: بهجة عند الإجابات الصحيحة، وتوجيه مباشر عند التصحيح، وهدوء في التلميحات. كما تمرر محركات القصص التفاعلية حوارات الشخصيات عبر الواجهة مع وسم عاطفة لكل سطر، ما يتيح لصوت مستنسخ واحد أداء عدة شخصيات.

مولد الصوت بالذكاء الاصطناعي من Speechify أم Speechify API: أيهما أنسب لك؟

حالة الاستخدام

مولد الصوت بالذكاء الاصطناعي (الاستوديو)

واجهة برمجة التطبيقات

التعليق الصوتي، والتسويق، والكتب الصوتية

نعم، مع محرر مرئي وعواطف لكل تحديد

ممكن، لكنه أكثر من اللازم

أصوات التطبيقات، والمساعدات الافتراضية، والتعليم الإلكتروني

غير مناسب

نعم، مع وسوم SSML <speechify:style>

طريقة الاستخدام

واجهة ويب

REST API

الأفضل في الحالات التالية

عند إنتاج ملف صوتي نهائي

عند توليد الصوت لحظياً داخل منتجك

أين تُحدث الأصوات العاطفية فرقاً في العمل الإبداعي

يُعد تحويل النص إلى كلام المدعوم بالعواطف العنصر الذي كان ينقص كثيراً من الأعمال الإبداعية. سواء كان صوت واحد بأسلوب المشاهير يقرأ كتاباً صوتياً كاملاً، أو شخصية متحركة تجمع بين الدعابة والحزن، أو افتتاحية بودكاست مؤثرة، فكل ذلك لم يكن ممكناً بالجودة نفسها مع التركيب الخالي من العاطفة. وقد أصبح هذا ممكناً الآن لأن العاطفة باتت جزءاً من الصوت نفسه، لا مجرد توجيه في النص. وبالنسبة إلى المبدعين الذين يستخدمون أصوات المشاهير والشخصيات في Speechify، تتيح أنماط العاطفة الانتقال من صوت مطابق للنموذج إلى صوت يعبّر بصدق.

هل يحسّن الأداء العاطفي الاستيعاب فعلاً؟

نعم، ويمكن قياس ذلك حتى خارج نطاق الذكاء الاصطناعي. ففي دراسة أُجريت عام 2022 على أطفال بين 11 و13 عاماً، ثم أُعيدت عام 2025، وجد Dylman وChampoux-Larsson أن المستمعين أجابوا عن عدد أكبر من الأسئلة بشكل صحيح عندما استُخدم إلقاء عاطفي إيجابي مقارنة بالنبرة المحايدة (Dylman وآخرون، 2025). ولم تكن زيادة الفهم طفيفة، بل استمرت في التذكر الفوري والمؤجل. وبالنسبة إلى المحتوى التعليمي، وشروحات المنتجات، وأي محتوى صوتي طويل يحتاج إلى الاحتفاظ بالمعلومة، فإن الصوت العاطفي المناسب أداة فعالة لتحسين الفهم.

الأسئلة الشائعة

ما المقصود بتحويل النص إلى كلام مع عواطف؟

هو كلام اصطناعي يحمل نبرة عاطفية مختارة، مثل البهجة أو الحزن، فوق الكلمات نفسها، بحيث يمكن إلقاء الجملة ذاتها بطرق متعددة. ومع Speechify يمكنك اختيار العاطفة لكل جزء.

كم عدد العواطف التي تدعمها Speechify؟

ثلاث عشرة عاطفة: الغضب، والبهجة، والحزن، والرهبة، والاسترخاء، والخوف، والدهشة، والهدوء، والحزم، والنشاط، والدفء، والمباشرة، والسطوع. وهي جميعاً متوفرة في كل من مولد الصوت بالذكاء الاصطناعي وواجهة برمجة تطبيقات Speechify.

أين أتحكم بالعاطفة في مولد الصوت بالذكاء الاصطناعي؟

داخل Speechify Studio، بعد إدخال النص، ستجد محدد العاطفة بجوار اختيار الصوت. طبّقه على المقطع كاملاً أو على جزء محدد، ثم أعد التوليد.

كيف أستخدم العواطف في Speechify API؟

لفّ النص بوسم SSML <speechify:style> مع اسم العاطفة كقيمة للخاصية. ثم تعيد الواجهة الملف الصوتي بعد تطبيق العاطفة على الجزء الموسوم فقط.

هل يمكنني دمج عدة عواطف في تعليق صوتي واحد؟

نعم. العواطف تُطبَّق لكل جزء في Speechify Studio ولكل قسم SSML في الواجهة، بحيث يمكن لتسجيل صوتي واحد أو جلسة واحدة أن تنتقل بالنبرة من سطر إلى آخر من دون تغيير الصوت.

هل الأصوات العاطفية طبيعية بقدر الأصوات المحايدة؟

نعم، إلى حد كبير. فالنماذج العاطفية لتحويل النص إلى كلام الموثقة علمياً تحقق نحو 3.94 من 5 في التعبير و3.98 من 5 في الطبيعية، ما يعني أن التقييمات متقاربة جداً بين النمطين.

هل يساعد الأداء العاطفي فعلاً المستمعين على تذكر المحتوى؟

نعم، وهذا ما تؤكده الأبحاث على المتحدثين البشر. فقد حسّنت النبرة الإيجابية حفظ المعلومات الواقعية في دراسات مضبوطة. وينطبق المبدأ نفسه على التعليقات الصوتية بالذكاء الاصطناعي عندما تُوجَّه جيداً.

هل يمكنني استخدام الأصوات العاطفية في التعليقات الصوتية التجارية؟

تغطي تراخيص Speechify الاستخدام التجاري للصوت الناتج، بما في ذلك الأنماط العاطفية. يُرجى مراجعة خطة الاشتراك لمعرفة حدود طول المخرجات.

هل تعمل العواطف مع الأصوات المستنسخة أو أصوات المشاهير؟

نعم. تُطبَّق أنماط العواطف فوق الصوت الأساسي في Speechify، لذا يمكن للصوت المستنسخ أن يحمل جميع العواطف الـ13 من دون الحاجة إلى تسجيل كل واحدة على حدة.

ما الفرق بين هذا وبين ضبط السرعة أو الطبقة فقط؟

العواطف تغيّر الأداء الصوتي بالكامل، بما في ذلك الوقفات، والتشديد، ومنحنى المقاطع، والطاقة. لذلك لا تبدو النبرة "الغاضبة" مجرد نسخة أسرع وأعلى من النبرة المحايدة.


وصول سريع وسهل إلى أصوات سبيتشيفاي المفضلة عبر واجهة برمجة التطبيقات – سريعة، قابلة للتوسّع، وسهلة الاستخدام للمطورين

احصل على وصول API
Sparse JavaScript keywords import, from, const, await on a white background

شارك هذا المقال

كليف وايتزمان

الرئيس التنفيذي ومؤسس Speechify

كليف وايتزمان مدافع عن ذوي عسر القراءة والرئيس التنفيذي ومؤسس تطبيق Speechify، أفضل تطبيق لتحويل النص إلى كلام في العالم، إذ نال أكثر من 100,000 تقييم بخمس نجوم وتصدّر متجر التطبيقات ضمن فئة الأخبار والمجلات. في عام 2017، أدرجته فوربس ضمن قائمة 30 تحت 30 تقديراً لجهوده في جعل الإنترنت أكثر سهولة وصولاً لذوي صعوبات التعلّم. ظهر كليف وايتزمان في منصات مثل EdSurge وInc. وPC Mag وEntrepreneur وMashable، وغيرها من وسائل الإعلام الرائدة.

Speechify

عن سبيتشيفاي

أفضل قارئ لتحويل النص إلى كلام

سبيتشيفاي هو المنصة الرائدة عالميًا لتحويل النص إلى كلام، يثق به أكثر من 50 مليون مستخدم ومدعوم بأكثر من 500,000 مراجعة خماسية النجوم عبر تطبيقاته الخاصة بتحويل النص إلى كلام على iOS، أندرويد، إضافة كروم، تطبيق الويب، وتطبيقات سطح المكتب لماك. في عام 2025، منحت آبل سبيتشيفاي جائزة Apple Design Award المرموقة في WWDC، واصفةً إياه بأنه “مورد أساسي يساعد الناس على عيش حياتهم.” يقدم سبيتشيفاي أكثر من 1,000 صوت طبيعي في أكثر من 60 لغة، ويُستخدم في ما يقرب من 200 دولة. من بين الأصوات المشهورة: سنوب دوج وغوينث بالترو. للمبدعين والشركات، Speechify Studio يوفر أدوات متقدمة، بما في ذلك مولِّد الصوت بالذكاء الاصطناعي، استنساخ الصوت بالذكاء الاصطناعي، الدبلجة بالذكاء الاصطناعي، ومغيّر الصوت بالذكاء الاصطناعي. كما يدعم سبيتشيفاي منتجات عالمية رائدة بجودة عالية وبأسعار مناسبة عبر واجهة برمجة تطبيقات تحويل النص إلى كلام الخاصة به. ظهر في وول ستريت جورنال، سي إن بي سي، فوربس، تيك كرانش، وغيرها من المنصات الإخبارية الرائدة، ويُعدّ سبيتشيفاي أكبر مزود لخدمة تحويل النص إلى كلام في العالم. زر speechify.com/news، speechify.com/blog، وspeechify.com/press لمعرفة المزيد.