HeyGen

يختار صُنّاع المحتوى في HeyGen منصة Fish Audio لاستنساخ الصوت بمعدل ثلاثة إلى واحد مقارنة بالبدائل.

HeyGen منصة فيديو بالذكاء الاصطناعي لصنّاع المحتوى المعرفي، يستخدمها المعلمون ومطوّرو الدورات ومتخصصو التواصل المؤسسي لإنتاج فيديو احترافي دون استوديو أو مؤدّي أصوات. نقلت الشركة طبقتها الصوتية إلى Fish Audio للحفاظ على لهجات صنّاع المحتوى الدوليين لديها.

المنتجات المستخدمة
Fish Audio S2 Proواجهة برمجة تحويل النص إلى كلاماستنساخ الصوت
تم النقل من
ElevenLabs

ماذا يحدث حين يبتعد الصوت عن الإنجليزية الأمريكية؟

ينتمي صُنّاع المحتوى في HeyGen إلى مختلف أنحاء العالم. يتحدث الأستراليون والهنود والبريطانيون والجنوب أفريقيين والسنغافوريون والأيرلنديون والاسكتلنديون والفلبينيون وأبناء الكاريبي الإنجليزية، لكن لكل منهم طابعه الصوتي الخاص.

كانت طبقة تحويل النص إلى كلام التي تستخدمها HeyGen في الإنتاج تولّد إنجليزية أمريكية دقيقة وتدفع سائر اللكنات نحوها. تسطّح الإيقاع وتلاشت خصائص حروف العلة. وعادت اللكنة التي يعرف بها الجمهور صانع المحتوى بصوت قريب من الأمريكية المحايدة. تكرر هذا النمط في معظم السوق لسبب واضح: النماذج التي تتدرب أولًا على الإنجليزية الأمريكية ثم تُكيّف لاحقًا تؤدي جيدًا فيها، بينما تتراجع جودتها على نحو متوقع في غيرها.

الشكوى الأكثر تكرارًا في قائمة الدعم

لاحظ صنّاع المحتوى المشكلة فورًا. أصبح تشابه اللهجة شكوى متكررة، إذ لم تعد أصواتهم تبدو كأصواتهم الحقيقية. والأهم أن المشكلة تركزت في الجمهور نفسه الذي كانت HeyGen تسعى إلى تنميته. احتاج صنّاع المحتوى حول العالم إلى انتقال أصواتهم بين اللغات واللهجات دون فقدان الهوية التي تجعلهم معروفين.

اختبرت HeyGen السوق بسؤال واحد

لم يكن التقييم مقارنة بين الميزات. لم تبحث HeyGen عن أقل زمن استجابة أو أكثر أداء تعبيرًا أو أطول قائمة لغات مدعومة. اختزلت التقييم في سؤال أبسط بكثير: عندما يستنسخ صانع المحتوى صوته، هل يظل يبدو مثله؟

وبشكل أدق، اختبرت HeyGen قدرة النموذج على الحفاظ على اللهجة التي تجعل الصوت مميزًا. هل يستطيع صانع محتوى بريطاني الاحتفاظ بلهجته البريطانية؟ وهل يمكن للصوت الانتقال بين اللغات دون أن يتحول تلقائيًا إلى نسخة أمريكية من نفسه؟

أصبح ذلك هو المعيار. قد يكون الصوت سريعًا ومعبّرًا ومبهرًا تقنيًا، لكنه يفشل في الاختبار إذا تغيرت لهجته.

Fish نموذج صوتي رائع لتعظيم تشابه الصوت في الأصوات الفريدة جدا.

John Wu

مدير هندسة الصوت في HeyGen

التشابه تغلّب على زمن الاستجابة والتكلفة

اختارت HeyGen تقنية Fish Audio لأنها كانت الأنسب لهذا المعيار. كانت السرعة والتكلفة مهمتين، لكنهما لم تكونا حاسمتين. وبعد استيفاء متطلبات الأداء، أصبح الفارق بسيطًا: أي نموذج يستطيع إعادة إنتاج الصوت بأكبر قدر من الأمانة عبر اللهجات المختلفة؟

تميّزت Fish Audio بالحفاظ على خصائص الصوت الأصلي بدلًا من تسويتها نحو نمط موحّد. ومنح هذا الاتساق HeyGen القدرة على توسيع منتجها الصوتي إلى مزيد من صنّاع المحتوى والأسواق دون مطالبتهم بالتنازل عن الطريقة التي تبدو بها أصواتهم.

لم تكن النتيجة مجرد نموذج صوتي أفضل. فقد أزالت عائقًا أمام استخدام HeyGen عبر اللغات، ومنحت الشركة أساسًا أقوى لاستراتيجيتها العالمية لصنّاع المحتوى.

حجم الإنتاج الكامل منذ الأسبوع الأول

نشرت HeyGen نموذج S2 Pro عبر واجهة Fish Audio السحابية. ويمر عبر النموذج كل فيديو ينشره صانع محتوى بصوت مدعوم من Fish. لم تكن هناك حاجة إلى إطلاق تدريجي أو مجموعة تجريبية؛ انتقل التكامل مباشرة إلى نطاق الإنتاج.

النتيجة: أصوات تحتفظ بهويتها

منذ الانتقال إلى Fish Audio، لم تواجه HeyGen أي مشكلة في تشابه اللهجة ضمن بيئة الإنتاج. وفي اختبارات الصوت، اختار صنّاع المحتوى Fish Audio على البديل بنسبة 3 إلى 1.

تدعم Fish Audio اليوم التجارب الصوتية لصنّاع المحتوى لدى HeyGen حول العالم، لتساعد كل صوت على الاحتفاظ بهوية صاحبه بوضوح، أينما تحدث.

اقرأ المزيد من قصص العملاء

Fish Audio

جاهزون عندما تكون مستعدًا

تحدث مع فريقنا عن النشر الخاص بك. سنأتي مستعدين.